К содержанию
Выпуск №16 · 24 июня 2026 / Новости

Модель Unlimited-OCR на 3.3B параметров появилась на платформе ModelScope

Это мультиязычная OCR‑модель размером 3.3B, рассчитанная на разбор документов за один проход.

Редакция 24 июня 2026 г., 10:03 MSK

В Telegram

Модель Unlimited-OCR появилась на платформе ModelScope. Это мультиязычная OCR‑модель размером 3.3B, рассчитанная на разбор документов за один проход. Она умеет работать как с отдельными изображениями, так и с многостраничными документами и PDF. Проект распространяется по лицензии MIT.

Разработчики ориентировали модель на анализ целых документов, а не отдельных вырезанных фрагментов изображения. Для длинных последовательностей OCR заявлена максимальная длина вывода 32K. Есть и два режима обработки изображений: Base и gundam. Они рассчитаны на разные типы макетов документов.

Как сообщает r/LocalLLaMA (Reddit), система использует inference на базе Transformers и может обслуживаться через SGLang с потоковыми запросами, совместимыми с OpenAI API. Сам проект описывают как попытку продвинуть подходы к разбору документов в стиле DeepSeek-OCR.

Ключевые факты

  • Модель Unlimited-OCR с 3.3B параметров размещена на ModelScope и распространяется по лицензии MIT.

  • Unlimited-OCR поддерживает one-shot разбор single images, multi-page documents и PDFs.

  • Заявлена длина вывода до 32K для длинных OCR-последовательностей.

  • Модель использует Transformers inference и SGLang serving с OpenAI-compatible streaming requests и включает режимы изображений Base и gundam для разных макетов документов.

Как процитировать

«Модель Unlimited-OCR на 3.3B параметров появилась на платформе ModelScope». hegai.media, 24 июня 2026 г.. https://hegai.media/novosti/model-unlimited-ocr-na-3-3b-parametrov-poyavilas-na-platforme-modelsco--181284a4-4548-41af-8c1c-d5ee69491f0c

так материал выглядит в мессенджере