Mistral OCR
Mistral OCR — первая OCR-модель Mistral AI для извлечения текста, изображений и структуры из PDF и других документов.
Mistral OCR — первая оптимизированная модель Mistral AI для распознавания документов, выпущенная 6 марта 2025 года. Она принимает изображения и PDF, извлекает текст и встроенные изображения в упорядоченном виде и ориентирована на мультимодальное понимание документов.
Извлечение содержимого документа
Текст, изображения, таблицы и уравнения
В отличие от распознавания только отдельных символов, Mistral OCR анализирует элементы документа и их расположение. Разработчик описывал извлечение текста и встроенных изображений с сохранением порядка, чтобы результат можно было передать системе поиска или обработки знаний. Это особенно важно для презентаций и сложных PDF, где смысл зависит от сочетания текста и визуальных элементов.
Интеграция
API и конвейер поиска по документам
Mistral позиционировала OCR как API-компонент для работы с PDF и изображениями, который можно включить перед индексацией или retrieval-augmented generation. Компания также сообщала о выборочной возможности самостоятельного размещения для организаций с повышенными требованиями к данным. Модель не является готовой поисковой системой: извлечённые фрагменты нужно хранить и связывать с источниками отдельно.
Обновления OCR
OCR 2 и новые поколения
Первое обновление сервиса — OCR 2, выпущенное в мае 2025 года. Затем появились OCR 3, OCR 4 и OCR 4.1. В API карточка первоначальной модели помечена как deprecated с 2 декабря 2025 года.
Дата выпуска и источник
Первичная публикация разработчика
Анонс датирован 06.03.2025; модель принимает изображения и PDF и извлекает переплетённые текст и изображения. API-версия deprecated с 02.12.2025. Источник: официальная публикация или документация Mistral AI.
Сведения о разработчике и его моделях: Mistral AI в Вики Futuretools.ru.