Точность olmOCR-2
Профильная модель распознавания документов уверенно читает русские сканы: плотные таблицы, печати, мелкий шрифт и колонки.
Сервис читает PDF, фотографии и офисные файлы и возвращает чистый текст с таблицами, заголовками и списками. Договор, счёт или акт превращаются в структуру, которую можно сразу отдать в работу.
olmOCR-2 · GPU · Работает офлайн
Без облачных подписок и ручной вычитки: загрузили документ — забрали текст, пригодный для дальнейшей обработки.
Профильная модель распознавания документов уверенно читает русские сканы: плотные таблицы, печати, мелкий шрифт и колонки.
Заголовки, списки и таблицы сохраняются в GitHub-разметке — колонки не рассыпаются в сплошной текст, как при копировании из PDF.
Цифровой текстовый слой отдаётся мгновенно, а модель включается только там, где страница действительно отсканирована.
Если на картинке объект, а не документ, сервис это замечает и возвращает описание изображения вместо правдоподобного набора букв.
Один эндпоинт для всех форматов, ключи с раздельным доступом, живой прогресс по страницам и остановка задачи на лету.
Сервис развёрнут на вашем сервере: документы и результаты не покидают периметр и не уходят во внешние облака.
Порядок один и тот же — и в панели, и по API.
Перетащите файл в панель или отправьте его по API. Подходят сканы, фотографии и офисные форматы.
Страницы уходят в модель по одной: виден прогресс, задачу можно остановить, а уже распознанное сохранится.
Скопируйте текст, скачайте файл или получите его по API — вместе с числом страниц и таймингами.
Отправьте файл на POST /v1/ocr — флаг structured=true сохраняет таблицы и заголовки, а sync=true вернёт результат в том же ответе.
Документация APIcurl -X POST "http://ваш-сервер:8044/v1/ocr?sync=true" \
-H "Authorization: Bearer $OCR_API_KEY" \
-F "file=@akt-1042.pdf" \
-F "structured=true"
Панель уже развёрнута рядом: пачка сканов станет текстом, пока вы наливаете кофе.