미스트랄 AI가 문서 구조 인식을 개선한 전용 OCR 모델 '미스트랄 OCR 4.1'을 13일(현지시간) 개발자 플랫폼에 공개했다. 기존 'OCR 4' 대비 바운딩 박스 정확도를 높여 다단 신문 레이아웃, 기술 도면의 여러 주석 영역, 개별 인용 항목 등 복잡한 문서 구조를 원형에 가깝게 보존하며 텍스트 블록 누락 문제도 줄였다. 큰따옴표 임의 변환을 방지하고 체크박스 인식 범위를 넓혔으며 우에서 좌로 읽는 언어의 표 처리 능력도 향상시켰다. 기존 'mistral-ocr-latest' 사용자는 별도 모델명 지정 없이 개선 사항을 자동 적용받을 수 있다.
- •미스트랑 OCR 4.1, 13일 개발자 플랫폼 공개, 바운딩 박스 정확도 대폭 개선
- •다단 신문 레이아웃, 기술 도면 다중 주석 영역 등 복잡한 문서 구조 보존
- •인용 항목 개별 바운딩 박스 할당, 텍스트 블록 누락 문제 감소
- •큰따옴표 원문 유지, 체크박스 인식 확대, RTL 언어 표 처리 개선
- •기존 'mistral-ocr-latest' 사용자는 자동으로 개선사항 적용
0단 자동
AI가 규칙대로 쓰고 그대로 게시했습니다. 사람이 따로 보지 않았습니다.
- 규칙 판
- 규칙 판 도입 이전 기사입니다.
- 남기는 것
- 규칙 판 · 모델 · 시각
- 판 기록
- 아직 없습니다.
미스트랄 AI, 문서 레이아웃 보존 능력 높인 'OCR 4.1' 공개

- 1.미스트랑 AI, 문서 레이아웃 보존 강화한 전용 인식 모델 '미스트랑 OCR 4.1' 공개
- 2.바운딩 박스 정확도 개선으로 다단 문서·기술 도면·인용 목록 등 복잡 레이아웃 원형 유지
- 3.인용 항목마다 개별 박스 할당, 따옴표·체크박스 인식 개선 등 문자 인식 정확도도 향상
- 4.결과를 JSON·마크다운으로 변환, 기존 mistral-ocr-latest 사용자는 자동 업그레이드
왜 중요한가?
범용 LLM 기반 문서 인식은 비용·지연시간 문제가 있는데, 문서 구조화에 특화된 전용 모델로 기업의 대량 문서 자동화·데이터베이스 연동 파이프라인에 실질적 비용 이점을 제공한다.
언급 프로젝트
본문 미리보기
미스트랄 AI가 복잡한 문서의 구조와 내용을 정확하게 인식할 수 있도록 개선한 전용 문서 인식 모델 ‘미스트랄 OCR 4.1’을 공개했다. 단순히 문자를 읽는 수준을 넘어 여러 단으로 구성된 문서와 기술 도면, 표, 인용 목록 등 복잡한 레이아웃을 원래 형태에 가깝게 유지하면서 디지털 데이터로 변환하는 데 초점을 맞췄다.미스트랄 AI는 13일(현지시간) 개발자 플랫폼을 통해 미스트랄 OCR 4.1을 선보였다.기존 'OCR 4'를 기반으로 문서 내 문자와 이미지 등 각 요소의 위치를 표시하는 바운딩 박스 정확도를 높인 것이 핵심이다.
전체 내용이 궁금하다면?
원문을 직접 읽어보세요
이 글이 만들어진 과정
- 11:23AI 초안

