Mistral выпустила OCR 4: распознаёт документы лучше всех конкурентов и стоит $2 за тысячу страниц
Mistral выпустила OCR 4 — модель распознаёт структуру документов, поддерживает 170 языков и стоит от $2 за тысячу страниц через Batch API.
Французская AI-компания Mistral выпустила четвёртую версию своей системы оптического распознавания текста — OCR 4. Модель не просто извлекает текст из документов, но и понимает их структуру: отмечает, где на странице находится каждый элемент, определяет его тип (заголовок, таблица, уравнение, подпись) и показывает, насколько уверена в каждом фрагменте.
На независимом тесте 600+ документов на 12+ языках живые аннотаторы предпочли результаты OCR 4 всем конкурентам — в среднем в 72% случаев. На публичном бенчмарке OlmOCRBench модель набрала 85.20 балла — лучший результат среди протестированных систем.
Практическая разница заметна. Инженер компании Rogo, которая автоматизирует финансовый анализ, говорит, что OCR 4 даёт такую же точность, как у более дорогих «агентных» парсеров документов, но работает в 17 раз быстрее и обходится в 8 раз дешевле. Для компании Anaqua, которая управляет патентами, скорость оказалась критичной: OCR 4 обрабатывает страницы в 4 раза быстрее предыдущего провайдера.
Модель поддерживает 170 языков, включая редкие — хинди, грузинский, армянский, бенгальский. По словам Mistral, именно на малых языках разрыв с конкурентами особенно заметен: большинство систем там работают плохо, OCR 4 сохраняет высокую точность.
Цены: через обычный API — $4 за тысячу страниц, через Batch API со скидкой — $2. Document AI, который дополнительно структурирует текст в нужный JSON-формат, стоит $5 за тысячу страниц.
Модель достаточно компактна, чтобы работать в одном контейнере на собственных серверах компании — это важно для организаций с требованиями к хранению данных. Enterprise-развёртывание доступно по запросу.
OCR 4 уже работает через Mistral Studio, Amazon SageMaker и Microsoft Foundry. Интегрирована с открытым Search Toolkit — набором инструментов для построения поисковых систем на основе документов.