Jina AI Выйдет на рынок с революционным распознаванием текста в документах

Компания Jina AI, известная своими инновационными решениями в области искусственного интеллекта, объявила о выпуске новой системы распознавания текста в документах под названием jina-ocr-v1. Эта система способна преобразовывать PDF, сканы, таблицы, диаграммы и счета в Markdown, что делает ее идеальным инструментом для автоматизации процессов обработки документов.
Модель jina-ocr-v1 имеет 3,4 миллиарда параметров и работает на основе технологии DeepSeek-OCR. Быстрая технология прогнозирования FastMTP позволяет системе предсказывать три токена в каждом шаге, сохраняя при этом точность и без потерь.
Система jina-ocr-v1 показала высокие результаты в тестировании на различных наборах данных, включая OmniDocBench v1.6 и olmOCR-Bench. В частности, она показала результаты 91,14% на OmniDocBench v1.6 и 83,4% на olmOCR-Bench. Кроме того, система может обработать до 2,57 страниц в секунду на одном A100.

Весы модели jina-ocr-v1 доступны на портале Hugging Face под лицензией CC BY-NC 4.0, что позволяет использовать их в коммерческих целях. Кроме того, доступ к модели можно получить через Jina Reader.
Этот прорыв в области распознавания текста в документах может иметь серьезные последствия для различных отраслей, включая финансовый сектор, здравоохранение и образование. Компания Jina AI продолжает развивать свои инновационные решения, и мы ждем с нетерпением увидеть, как эта технология будет использоваться в будущем.
Обсуждение
0Здесь пока пусто. Эксперты еще не успели поделиться мнением...
