Запущен REST API для распознавания российских документов: паспорт, ВУ и СТС в JSON за один POST

Распознавание российских документов — паспорта, водительского удостоверения или СТС — теперь доступно через открытый REST API, который принимает фотографию и возвращает структурированный JSON. Проект под названием reqdoc.ru опубликован на Хабре и предлагает self-service доступ с демо-режимом без рег

Запущен REST API для распознавания российских документов: паспорт, ВУ и СТС в JSON за один POST

Распознавание российских документов — паспорта, водительского удостоверения или СТС — теперь доступно через открытый REST API, который принимает фотографию и возвращает структурированный JSON. Проект под названием reqdoc.ru опубликован на Хабре и предлагает self-service доступ с демо-режимом без регистрации. Это решение может стать альтернативой дорогим корпоративным OCR-сервисам, особенно для стартапов и небольших компаний, которым нужна быстрая верификация данных.

Как работает новый API для распознавания документов

API доступен по адресу reqdoc.ru и не требует регистрации для тестирования — есть демо-режим без ключа. Разработчик описывает его как self-service: любой желающий может отправить изображение документа и сразу получить результат. Контракт API построен на REST-принципах: единственная конечная точка принимает multipart/form-data с изображением и возвращает JSON. В ответе содержатся поля, специфичные для каждого типа документа: для паспорта — серия, номер, дата выдачи, код подразделения, фамилия, имя, отчество; для ВУ — категории, срок действия; для СТС — VIN, марка, модель, год выпуска.

Автор подчёркивает, что основная сложность заключалась именно в специфике российских документов. Например, паспорт РФ имеет уникальные особенности: серия и номер разделены, код подразделения пишется в формате XXX-XXX, а фамилия, имя и отчество могут содержать букву «ё». Водительское удостоверение нового образца содержит штрихкод, который нужно декодировать, а СТС — множество полей с разными форматами. Разработчик учёл эти нюансы и заложил их в парсинг.

Предыстория и контекст

Проблема распознавания документов в России стоит остро: многие западные OCR-сервисы не обучены на российских паспортах и водительских удостоверениях. Существующие российские решения — например, от Smart Engines или VisionLabs — предлагают высокое качество, но ориентированы на корпоративных клиентов и требуют заключения договора. Открытых API, которые можно было бы бесплатно протестировать без регистрации, практически нет. Автор проекта, вероятно, столкнулся с этой проблемой в своей практике и решил создать альтернативу.

Проект опубликован на Хабре в разделе «Разработка», что указывает на его техническую направленность. Пост содержит ссылку на демо и приглашает к обсуждению контракта API. Автор явно ищет обратную связь: какие ещё типы документов стоит добавить, какие поля важны, какие форматы изображений поддерживать. Это похоже на этап валидации спроса перед коммерциализацией.

Какие документы поддерживаются и как это работает?

На текущий момент API распознаёт три типа документов: паспорт гражданина РФ, водительское удостоверение (всех образцов) и свидетельство о регистрации транспортного средства (СТС). Для каждого из них определён свой набор выходных полей. Например, для паспорта возвращается: серия, номер, дата выдачи, код подразделения, фамилия, имя, отчество, дата рождения, место рождения, пол. Для ВУ — серия, номер, дата выдачи, срок действия, категории, фамилия, имя, отчество, дата рождения, место рождения, орган, выдавший документ. Для СТС — VIN, марка, модель, год выпуска, номер кузова, номер шасси, цвет, мощность двигателя, экологический класс.

Процесс прост: разработчик отправляет POST-запрос на эндпоинт с изображением (поддерживаются JPEG, PNG, PDF). Сервер обрабатывает изображение, применяет OCR и возвращает JSON. В демо-режиме ключ не нужен, но для production-использования, вероятно, потребуется регистрация. Автор обещает, что API будет доступен для интеграции в любые проекты.

Технические подробности и сравнение с аналогами

Из поста на Хабре можно понять, что в основе API лежит собственный OCR-движок, обученный на российских документах. Разработчик упоминает, что использовал открытые библиотеки компьютерного зрения и нейросети, но не раскрывает точную архитектуру. Ключевая особенность — поддержка именно российских форматов, которые отличаются от международных. Например, в паспорте РФ серия и номер разделены нестандартно, а в ВУ нового образца есть двумерный штрихкод, содержащий машиночитаемую зону.

Сравнивая с аналогами: Smart Engines предлагает SDK для мобильных устройств, но его стоимость начинается от нескольких сотен тысяч рублей. VisionLabs также ориентирована на B2B. AWS Textract и Google Vision не умеют корректно распознавать российские паспорта. Таким образом, новый API может занять нишу простого и недорогого решения для стартапов и небольших компаний.

Кого затронет и как

Новый API в первую очередь полезен разработчикам, которые интегрируют верификацию документов в свои продукты. Это могут быть финтех-сервисы, банки, страховые компании, каршеринги, сервисы аренды жилья, платформы для онлайн-регистрации. Также API пригодится мобильным разработчикам, создающим приложения для сканирования документов. В России и СНГ спрос на такие решения высок, так как многие процессы требуют подтверждения личности.

Для конечных пользователей польза в том, что они смогут быстрее проходить верификацию, не вводя данные вручную. Для бизнеса — снижение операционных затрат и уменьшение ошибок при вводе данных. Однако стоит учитывать, что API пока поддерживает только три типа документов, и, возможно, потребуется доработка для других видов удостоверений.

Что будет дальше

Автор планирует расширять список поддерживаемых документов. В комментариях к посту уже спрашивают про загранпаспорт, ИНН, СНИЛС, пенсионное удостоверение и военный билет. Он также рассматривает возможность добавления распознавания лиц для сверки с фото в документе. Если проект получит достаточную обратную связь и коммерческий интерес, возможно, появится платная версия с более высокой точностью и SLA.

Пока API находится на стадии бета-тестирования. Разработчик приглашает всех желающих попробовать демо и оставить отзыв. Вполне вероятно, что в ближайшие месяцы проект станет полноценным коммерческим продуктом.

Итог

Новый self-service REST API для распознавания российских документов — своевременное решение, закрывающее потребность в простом и доступном инструменте. Паспорт, ВУ и СТС теперь можно распознать одним POST-запросом. Если проект получит развитие, он может стать стандартом де-факто для быстрой интеграции верификации документов в российских IT-продуктах.