Извлечение структурированных данных из документов
Nutrient Data Extraction API преобразует PDF, отсканированные изображения и файлы Office в пространственный JSON или Markdown. Результат может содержать ограничивающие рамки, оценки достоверности и контекст страницы.
Режимы обработки и схема данных
Доступны четыре режима: от недорогого извлечения текста до обработки с помощью ИИ для сложной вёрстки, рукописного текста и формул. Пользователь может задать JSON Schema, чтобы сопоставить извлечённые значения со своей моделью данных.
Рабочие процессы
API рассчитан на детерминированную обработку документов, включая RAG, индексацию для поиска, автоматизацию агентами и очереди проверки человеком. Данные можно интегрировать с базами данных, ERP- и CRM-системами, а также ИИ-конвейерами.







