К содержанию
Выпуск №22 · 30 июня 2026 / Новости

TurboOCR v3 ускорил обработку документов до ~520 изображений в секунду на RTX 5090

TurboOCR v3, self-hosted OCR-сервер для обработки документов, который работает полностью локально.

Редакция 30 июня 2026 г., 19:06 MSK

В Telegram

TurboOCR v3, self-hosted OCR-сервер для обработки документов, который работает полностью локально. В версии v3 весь конвейер переведён на модели PP-OCRv6 вместо PP-OCRv5: по данным разработчиков, производительность на наборе FUNSD выросла примерно с 270 до 520 изображений в секунду при использовании v6 tiny и RTX 5090.

Система поддерживает HTTP и gRPC, а также прямую обработку PDF. Как сообщает r/LocalLLaMA (Reddit), главным изменением в v3 стала встроенная структурированная обработка документов: конвейер теперь включает анализ layout, преобразование таблиц в HTML, формул, в LaTeX и формирование Markdown с сохранением порядка чтения.

Для таблиц и формул используется отдельное включение по запросу, чтобы дополнительные функции не влияли на производительность без необходимости. В стек TurboOCR входят C++, TensorRT FP16, multi-stream, gRPC/HTTP, direct PDF endpoint и PP-OCRv6.

Ключевые факты

  • TurboOCR v3 работает полностью локально в формате self-hosted OCR-сервера

  • Производительность на FUNSD выросла примерно с 270 до 520 изображений в секунду при использовании PP-OCRv6 tiny и RTX 5090

  • В v3 добавлена структурированная обработка: layout, таблицы в HTML, формулы в LaTeX и Markdown с порядком чтения

  • В стек проекта входят C++, TensorRT FP16, multi-stream, gRPC/HTTP, direct PDF endpoint и PP-OCRv6

Как процитировать

«TurboOCR v3 ускорил обработку документов до ~520 изображений в секунду на RTX 5090». hegai.media, 30 июня 2026 г.. https://hegai.media/novosti/turboocr-v3-uskoril-obrabotku-dokumentov-do-520-izobrazheniy-v-sekundu--f7b4f079-2bb1-420e-8ae3-6011c1e5d739

так материал выглядит в мессенджере