OCR API Документ в текст
Распознавание документов · Локально

Из скана —
в готовый Markdown

Сервис читает PDF, фотографии и офисные файлы и возвращает чистый текст с таблицами, заголовками и списками. Договор, счёт или акт превращаются в структуру, которую можно сразу отдать в работу.

olmOCR-2 · GPU · Работает офлайн

Возможности

Всё, что нужно для распознавания

Без облачных подписок и ручной вычитки: загрузили документ — забрали текст, пригодный для дальнейшей обработки.

Точность olmOCR-2

Профильная модель распознавания документов уверенно читает русские сканы: плотные таблицы, печати, мелкий шрифт и колонки.

Таблицы и структура

Заголовки, списки и таблицы сохраняются в GitHub-разметке — колонки не рассыпаются в сплошной текст, как при копировании из PDF.

Умный выбор пути

Цифровой текстовый слой отдаётся мгновенно, а модель включается только там, где страница действительно отсканирована.

Фото описываются, а не выдумываются

Если на картинке объект, а не документ, сервис это замечает и возвращает описание изображения вместо правдоподобного набора букв.

REST API для интеграций

Один эндпоинт для всех форматов, ключи с раздельным доступом, живой прогресс по страницам и остановка задачи на лету.

Работает в вашем контуре

Сервис развёрнут на вашем сервере: документы и результаты не покидают периметр и не уходят во внешние облака.

Как это работает

Три шага от скана до текста

Порядок один и тот же — и в панели, и по API.

01

Загрузите документ

Перетащите файл в панель или отправьте его по API. Подходят сканы, фотографии и офисные форматы.

PDFJPGTIFFDOCXXLSXODT
02

Распознавание

Страницы уходят в модель по одной: виден прогресс, задачу можно остановить, а уже распознанное сохранится.

GPUТаблицыПрогресс
03

Заберите Markdown

Скопируйте текст, скачайте файл или получите его по API — вместе с числом страниц и таймингами.

MDJSONAPI
API

Одна команда — и документ в работе

Отправьте файл на POST /v1/ocr — флаг structured=true сохраняет таблицы и заголовки, а sync=true вернёт результат в том же ответе.

Документация API
bash · curl
curl -X POST "http://ваш-сервер:8044/v1/ocr?sync=true" \
  -H "Authorization: Bearer $OCR_API_KEY" \
  -F "file=@akt-1042.pdf" \
  -F "structured=true"

Загрузите первый документ

Панель уже развёрнута рядом: пачка сканов станет текстом, пока вы наливаете кофе.