Mistral OCR

Mistral OCR — первая OCR-модель Mistral AI для извлечения текста, изображений и структуры из PDF и других документов.

Mistral OCR — первая оптимизированная модель Mistral AI для распознавания документов, выпущенная 6 марта 2025 года. Она принимает изображения и PDF, извлекает текст и встроенные изображения в упорядоченном виде и ориентирована на мультимодальное понимание документов.

Извлечение содержимого документа

Текст, изображения, таблицы и уравнения

В отличие от распознавания только отдельных символов, Mistral OCR анализирует элементы документа и их расположение. Разработчик описывал извлечение текста и встроенных изображений с сохранением порядка, чтобы результат можно было передать системе поиска или обработки знаний. Это особенно важно для презентаций и сложных PDF, где смысл зависит от сочетания текста и визуальных элементов.

Интеграция

API и конвейер поиска по документам

Mistral позиционировала OCR как API-компонент для работы с PDF и изображениями, который можно включить перед индексацией или retrieval-augmented generation. Компания также сообщала о выборочной возможности самостоятельного размещения для организаций с повышенными требованиями к данным. Модель не является готовой поисковой системой: извлечённые фрагменты нужно хранить и связывать с источниками отдельно.

Обновления OCR

OCR 2 и новые поколения

Первое обновление сервиса — OCR 2, выпущенное в мае 2025 года. Затем появились OCR 3, OCR 4 и OCR 4.1. В API карточка первоначальной модели помечена как deprecated с 2 декабря 2025 года.

Дата выпуска и источник

Первичная публикация разработчика

Анонс датирован 06.03.2025; модель принимает изображения и PDF и извлекает переплетённые текст и изображения. API-версия deprecated с 02.12.2025. Источник: официальная публикация или документация Mistral AI.

Сведения о разработчике и его моделях: Mistral AI в Вики Futuretools.ru.