Как мы написали свой OCR и автоматизировали горы первички

Когда внутренних заказчиков становится слишком много — каждый со своими хотелками и типом документов — поддерживать кучу отдельных сервисов уже нереально.Отдел кадров приносит документы о приёме на работу, бухгалтерия...
<5 — 2026'da uzaya kaç SpaceX Starship fırlatması ulaşacak?
В сфере искусственного интеллекта произошло заметное событие. Когда внутренних заказчиков становится слишком много — каждый со своими хотелками и типом документов — поддерживать кучу отдельных сервисов уже нереально. Отдел кадров приносит документы о приёме на работу, бухгалтерия хочет сверять финансовую отчётность, другие подразделения — своё. Нужен был единый сервис, который умеет распознавать документы и гибко настраивать извлечение данных под любой шаблон.
Ситуацию усложнил уход западных вендоров — тот же ABBYY стал недоступен. Просто взять и купить готовый зарубежный софт мы не могли — ни по соображениям безопасности, ни по факту: рынок сам закрыл эту возможность. Нужно было решение, которое работает строго внутри защищённого контура.
Технические детали
С открытым API, через который можно интегрироваться с практически любой внутренней системой. Так в Гринатоме (ИТ-интеграторе Росатома) мы начали разработку Атом. Это система, которая не просто видит текст на скане, а понимает структуру документа.
Вытаскивает реквизиты, проверяет наличие подписей и печатей.
Этот прогресс даёт важные сигналы о будущем отрасли, и технологический мир внимательно наблюдает.






