SYS.MONITOR
POSITION:0, 0
CLICKS.CTR:0
LANG.CODE:UNKNOWN
SYS.THEME:DARK
RENDER:60 FPS
VIEWPORT:0x0
SESSION:0s
← Назад к новостям
Опубликовано: 19 сентября 2026 г.

Jina AI Выйдет на рынок с революционным распознаванием текста в документах

Jina AI Выйдет на рынок с революционным распознаванием текста в документах

Компания Jina AI, известная своими инновационными решениями в области искусственного интеллекта, объявила о выпуске новой системы распознавания текста в документах под названием jina-ocr-v1. Эта система способна преобразовывать PDF, сканы, таблицы, диаграммы и счета в Markdown, что делает ее идеальным инструментом для автоматизации процессов обработки документов.

Модель jina-ocr-v1 имеет 3,4 миллиарда параметров и работает на основе технологии DeepSeek-OCR. Быстрая технология прогнозирования FastMTP позволяет системе предсказывать три токена в каждом шаге, сохраняя при этом точность и без потерь.

Система jina-ocr-v1 показала высокие результаты в тестировании на различных наборах данных, включая OmniDocBench v1.6 и olmOCR-Bench. В частности, она показала результаты 91,14% на OmniDocBench v1.6 и 83,4% на olmOCR-Bench. Кроме того, система может обработать до 2,57 страниц в секунду на одном A100.

Весы модели jina-ocr-v1 доступны на портале Hugging Face под лицензией CC BY-NC 4.0, что позволяет использовать их в коммерческих целях. Кроме того, доступ к модели можно получить через Jina Reader.

Этот прорыв в области распознавания текста в документах может иметь серьезные последствия для различных отраслей, включая финансовый сектор, здравоохранение и образование. Компания Jina AI продолжает развивать свои инновационные решения, и мы ждем с нетерпением увидеть, как эта технология будет использоваться в будущем.

#Jina AI#распознавание текста#документы#Markdown#DeepSeek-OCR#FastMTP#OmniDocBench#olmOCR-Bench

Обсуждение

0

Здесь пока пусто. Эксперты еще не успели поделиться мнением...