MXStat
MXStat
Введите текст для поиска
Расширенный поиск каналов
  • Вход на сайт
  • Каталог
    Каталог каналов Региональные подборки Поиск каналов
    Добавить канал
  • Рейтинги
    Рейтинг каналов Рейтинг публикаций
    Рейтинги брендов и персон
  • Аналитика
  • Поиск по публикациям
  • Мониторинг Max
MachineLearning

22 Sep, 12:24

Открыть в Max Поделиться

Jina AI улучшила DeepSeek-OCR

jina-ocr-v1 https://huggingface.co/jinaai/jina-ocr-v1)' rel='nofollow' target='_blank'>(https://huggingface.co/jinaai/jina-ocr-v1)' rel='nofollow' target='_blank'>https://huggingface.co/jinaai/jina-ocr-v1)
 - 3B модель для разбора документов на английском и китайском языках, рассчитанная под локальный запуск на недорогих системах.

Модель принимает скан, фотографию или PDF и на выходе выдаёт Markdown с поддержкой LaTeX.

Кроме полной транскрипции она распознаёт отдельные таблицы и формулы, подписывает изображения, отвечает на вопросы по документу и извлекает ключевые поля.

🟡Архитектура

DeepSeek-OCR с визуальным энкодером DeepEncoder на 380 млн параметров, который сжимает страницу до 256 визуальных токенов и при необходимости добавляет до девяти фрагментов по 100 токенов. Декодер - смесь экспертов на 3 млрд общих и 570 млн активных параметров.

Вклад Jina - спекулятивное декодирование FastMTP, где один общий блок предлагает три токена вперёд, а декодер принимает самую длинную часть, совпадающую с его собственным выбором.

🟡Тесты

На olmOCR-Bench модель набрала 83,4 балла - на 7,4 больше DeepSeek-OCR и выше olmOCR-2 с 8B параметров (82,4), но ниже chandra-ocr-2 (85,8) и dots.mocr (83,9).

На OmniDocBench v1.6 результат 91,14 против 90,25 у DeepSeek-OCR-2, но хуже более компактных PaddleOCR-VL-1.6 (96,34) и HunyuanOCR-1.5 (94,74).

По пропускной способности модель первая среди 14 систем - 2,57 страницы в секунду на одной A100 при 32 параллельных запросах.

На L4 FastMTP ускоряет генерацию в 1,95 раза в обычном режиме, но с CUDA-графами прирост падает до 1,17 раза.

⚠️ FastMTP работает только в vLLM 0.21 и новее

Без установки модель доступна через https://jina.ai/reader)' rel='nofollow' target='_blank'>Jina Reader (https://jina.ai/reader)' rel='nofollow' target='_blank'>https://jina.ai/reader)
 и онлайhttps://jina.ai/api-dashboard/document-ocr-test/)' rel='nofollow' target='_blank'>н-песочницу (https://jina.ai/api-dashboard/document-ocr-test/)' rel='nofollow' target='_blank'>https://jina.ai/api-dashboard/document-ocr-test/)
 по ключу API Jina.


📌Лицензирование: CC BY-NC 4.0


🟡Блогпост (https://jina.ai/news/jina-ocr-v1-faster-document-parsing-on-low-budget-gpus/)' rel='nofollow' target='_blank'>https://jina.ai/news/jina-ocr-v1-faster-document-parsing-on-low-budgehttps://huggingface.co/jinaai/jina-ocr-v1)' rel='nofollow' target='_blank'>t-gpus/)
🟡Веса (https://huggingface.co/jinaai/jina-ocr-v1)' rel='nofollow' target='_blank'>https://huggingface.co/jinaai/jina-https://arxiv.org/pdf/2609.03181)' rel='nofollow' target='_blank'>ocr-v1)
🟡Arxiv (https://arxiv.org/pdf/2609.03181)' rel='nofollow' target='_blank'>https://arxiv.org/pdf/260https://jina.ai/api-dashboard/document-ocr-test/)' rel='nofollow' target='_blank'>9.03181)
🟡Демо (https://jina.ai/api-dashboard/document-ocr-test/)' rel='nofollow' target='_blank'>https://jina.ai/api-dashboard/document-ocr-test/)


@ai_machinelearning_big_data

#AI #ML #OCR #Deepsek #JinaOCRv1 #JinaAI

775 8
Каталог
Каталог каналов Подборки каналов Поиск каналов Добавить канал
Рейтинги
Рейтинг каналов Max
Контакты
Написать в Max Написать в Telegram Написать на почту
Всякая всячина
Пользовательское соглашение Политика конфиденциальности
Наши каналы
MXStat в Telegram MXStat в Max
Наши боты
MXAuthBot MXAnalyticsBot
Made by TGStat