Платформа Content AI (бывшая российская ABBYY) для потокового распознавания документов: читает счета, накладные, паспорта и договоры, извлекает данные и отдаёт их в 1С, ERP или СЭД. Ставится только в контур заказчика, облачной версии нет. Лицензия считается от числа обработанных страниц в год, и минимальный пакет крупный; готовые описания типов документов покупаются отдельно от лицензии.
О продукте
ContentCapture — платформа интеллектуальной обработки документов от ООО «Контент ИИ» (товарный знак Content AI), Москва. Это та самая команда и та самая технологическая линейка, что раньше работала в России под маркой ABBYY: ContentReader — прямой наследник FineReader, а ContentCapture — платформенный продукт для потока документов. В реестре отечественного ПО — запись №17598 от 17.05.2023, причём с ИИ-маркировкой: продукт официально отнесён к сфере искусственного интеллекта.
Устройство — конвейер из семи шагов: импорт, классификация, распознавание, извлечение и проверка данных, верификация человеком, выполнение действий, экспорт. Каждый шаг разобран в модулях ниже. Верификация здесь штатный шаг, а не признак неудачи: операторы не исчезают, их работа меняется с набора на вычитку. Человеку остаётся ещё обучение новому классу документов, настройка проверочных алгоритмов, сопровождение сценариев в Git и администрирование серверов.
Какие документы читает из коробки
В таком классе систем это главное, на что стоит смотреть, — не заявленная точность, а перечень готовых описаний. У Content AI он публичный и большой:
- Бухгалтерия и финансы: счёт, счёт-фактура и корректировочная, платёжные и банковские документы, ПКО и РКО, приходный ордер М-4, бухгалтерский баланс, акт сверки, справка 2-НДФЛ, авансовый отчёт, акт выполненных работ, КС-2, КС-3, ОС-15.
- Товарные и логистические: ТОРГ-12, ТОРГ-13, УПД, УКД, транспортная накладная, ТТН, накладная СМГС, СТС, ПТС, грузовая таможенная декларация, сертификат соответствия.
- Личность и KYC: паспорт РФ и загранпаспорт, водительское удостоверение, СНИЛС, военный билет, свидетельства о рождении и о браке. Отдельно — паспорта и удостоверения личности граждан Беларуси, Казахстана, Узбекистана, Таджикистана, Кыргызстана и Азербайджана.
- Миграционные: миграционная карта, виза РФ и уведомление о e-visa, вид на жительство, РВП, разрешение на работу, патент.
- Регистрационные: свидетельства ИНН, в том числе иностранной компании, ОГРН и ОГРНИП, выписки и листы записи ЕГРЮЛ и ЕГРИП, карточка с образцами подписей.
- Кадровые: дипломы, трудовая книжка и выписка из неё, СТД-Р, приказ на командировку, согласие на обработку персональных данных, выписки и справки ПФР.
- Судебные: судебный приказ, исполнительный лист, определение суда, постановления о возбуждении и окончании исполнительного производства, о наложении и снятии ареста, об обращении взыскания.
Рядом со списком разработчик оговаривается: «Указан неполный список. Если необходимого документа не оказалось в списке — напишите нам». То есть на любой ваш нетиповой бланк описание делается отдельно.
Как продаётся
Цена считается от объёма страниц в год, а не от числа пользователей, и у годовой лицензии есть жёсткий нижний порог, ниже которого платформа не продаётся: маленький поток документов оцифровать здесь нельзя. Схема по умолчанию — подписка на 1 или 3 года с техподдержкой в стоимости; бессрочные лицензии возможны «по отдельному согласованию».
Прямых продаж нет. Дословно: «Компания не осуществляет прямые продажи программного обеспечения конечным пользователям». Прайс-листы лежат в закрытом разделе партнёрского портала. Значит, условия вы в любом случае узнаете от интегратора, и они будут его, а не разработчика: публикуемые цифры разработчик помечает как рекомендованные розничные, потому что «фактические цены продажи конечным пользователям зависят от ценовой политики авторизованных партнёров».
На сайте есть ROI-калькулятор. Пользоваться им стоит с поправкой: он считает по вашим же введённым допущениям, а базовая цифра экономии подписана честно и странно — «По нашим оценкам, продукты Embedika экономят в среднем 70% времени на анализе документов», то есть взята из оценки стороннего разработчика. Сам разработчик помечает: «Расчёт носит предварительный характер».
Что докупается отдельно
Гибкие описания типов документов покупаются отдельно от лицензии — они помечены в схеме счёта ниже. Это важнее, чем кажется: базовая подписка не означает, что все перечисленные разработчиком типы документов у вас заработают. Перечень выше — это то, что готово; на всё остальное описание делается отдельно и за отдельные деньги.
Кроме них — дополнительные модули платформы, серверы и их администрирование, внедрение партнёром.
Требования к железу и ОС
Состав окружения — в характеристиках ниже. Смысл этих цифр простой: инфраструктура целиком на вас. Домен, база данных, сервер приложений, станции обработки, Git-репозиторий сценариев — систему нужно кому-то держать, и облачной альтернативы у неё нет.
Отдельно стоит проверить парк сканеров. Разработчик перечисляет поддерживаемых производителей — Canon, Epson, HP, Kodak, Xerox, Fujitsu и другие, — но тут же пишет: «в общем случае компания Content AI не может гарантировать и не гарантирует работоспособность своих программ с любыми сканерами».
Где обрабатываются данные
Данные не уходят из вашего контура. Ответ разработчика в FAQ прямой: «ContentCapture разворачивается в контуре заказчика. Все данные и код остаются под полным контролем заказчика». Облачной SaaS-версии нет вообще — это не сервис с загрузкой файлов на чужой сервер, а система, которую вы ставите и админите сами. Для персональных данных, паспортов и банковской первички это обычно решающий довод.
Состав защиты разработчик перечисляет подробно: пять способов аутентификации, единый вход через SAML, JWT, OIDC и Active Directory, ролевой доступ, TLS 1.2, шифрование баз и файловых хранилищ включая S3, журнал событий безопасности с экспортом в формат CEF.
Какая именно LLM отвечает за атрибутивное распознавание, разработчик на сайте не называет. Раз всё работает внутри контура, вопрос «что будет, если модель отключат» стоит здесь мягче, чем у облачных ИИ-сервисов, — но состав моделей всё равно придётся уточнять у партнёра при пилоте.
Что важно знать до выбора
Цифру «98%» нельзя читать как гарантию. Она встречается на сайте дважды, и оба раза — в клиентских кейсах с конкретным типом документов: в проекте с «Маздой» это собственные бланки и анкеты, в проекте с «Бургер Кингом» — товарно-транспортные накладные. Формулировка везде «качество распознавания достигает 98%». Универсальной гарантии по любым вашим документам из этого не следует, и разработчик её не даёт. Единственный честный способ узнать свою цифру — прогнать на пилоте собственную пачку сканов.
Что при этом заявлено проверяемо: выдержанная нагрузка — до 2 млн документов в сутки, а из клиентов на сайте названы Альфа-банк, Россельхозбанк, X5 Group, СИБУР, FESCO, «Бургер Кинг», «Мазда», Softline, ТЭК-Торг и «Ридан».
ИИ здесь в четырёх местах, и разработчик сам очерчивает границу. Атрибутивное распознавание через LLM — для неструктурированных текстов, «перегруженных канцелярской лексикой»: договоров, приказов, претензий, уставов, протоколов, доверенностей. ICR — рукописный текст в паспортах, анкетах, заявлениях. Свёрточные и генеративно-состязательные сети — предобработка изображения: шумы, перекос, текст на сложном фоне. ML — классификация входящих по типам. Поверх этого платформа выполняет и следующий шаг процесса, а сценарий можно продиктовать словами: «ИИ-агент превращает описание задачи на естественном языке в готовый сценарий автоматизации». Но в FAQ разработчик сам себя останавливает: «ContentCapture теперь RPA-платформа? Нет. Интеллектуальная обработка документов остаётся основой платформы».
Кому не подойдёт
Малому бизнесу. Минимальный объём годовой лицензии плюс отдельная плата за описания документов, плюс серверы, плюс внедрение партнёром — это бюджет крупной бухгалтерии или банка, а не компании с десятком счетов в месяц.
Тем, кто хочет «загрузить скан по API и получить JSON». Облака нет; для встраивания в своё приложение у Content AI отдельные продукты — ContentReader Engine (OCR SDK) и PassportReader SDK.
Тем, кому нужна фиксированная публичная цена. Её нет и не будет: считают по страницам, продают через партнёров, прайс закрыт.
Сколько стоит
Цена считается от объёма страниц в год, а не от числа пользователей, и годовая лицензия начинается с фиксированного порога, ниже которого платформа не продаётся: маленький поток документов оцифровать здесь нельзя. Техподдержка входит в стоимость. Прямых продаж у разработчика нет: «Компания не осуществляет прямые продажи программного обеспечения конечным пользователям», прайс-листы лежат в закрытом разделе партнёрского портала. Публикуемые цифры — рекомендованные розничные: «фактические цены продажи конечным пользователям зависят от ценовой политики авторизованных партнёров».
Сумм мы не публикуем: они меняются чаще, чем мы успеваем их проверять, а устаревшая цифра подрывает доверие ко всему разбору. Актуальную стоимость называет сам разработчик.
У разработчика заявлено тарифов и пакетов: 3 — Годовая подписка на пакет страниц, Подписка на 3 года, Бессрочная лицензия
Что различается в тарифах
Со страницы тарифов разработчика. Суммы не приводим: они меняются, и на его сайте они всегда сегодняшние.
Порядок ступеней — со страницы тарифов разработчика, не наша оценка: тарифы отличаются охватом, а не оценкой качества.
1С-коннектор ContentCapture
Отдельный продукт: читает счета, акты, счета-фактуры, ТОРГ-12, УПД и УКД и подставляет суммы, НДС и количество позиций прямо в 1С. Сверка идёт на едином экране внутри 1С, пакетная обработка — через «горячую папку».
Страница модуля →Гибкие описания типов документов
Готовые описания документов — от счёта-фактуры и ТОРГ-12 до паспортов, миграционных и судебных — покупаются отдельно от лицензии. Это важно: базовая подписка не означает, что все перечисленные разработчиком типы документов у вас заработают. Рядом со списком разработчик оговаривается: «Указан неполный список. Если необходимого документа не оказалось в списке — напишите нам», то есть на любой нетиповой бланк описание делается отдельно.
Страница модуля →Импорт
Первый шаг конвейера. В одном потоке — письма и вложения, бумага со сканеров и МФУ, файлы из «горячих папок» и по FTP, офисные форматы, изображения, PDF и PDF/A, XPS.
Страница модуля →Классификация
Сортировка входящих по типам машинным обучением. Формулировка разработчика: «в систему достаточно ввести 10 образцов нового класса документа, и технология автоматически научится определять тип документа по внешнему виду или взаимному расположению элементов».
Страница модуля →Распознавание
Печатный текст — более 200 языков, рукопечатный ввод по клеточкам — 110 языков, рукописный текст — русский и английский. Типы текста: типографский, рукописный, пишущая машинка, матричный принтер, индекс, OCR-A, OCR-B, MICR. Штрихкоды — 24 типа, включая QR, Datamatrix и PDF-417.
Страница модуля →Извлечение и проверка данных
Атрибутивное распознавание через LLM для неструктурированных текстов, «перегруженных канцелярской лексикой»: договоров, приказов, претензий, уставов, протоколов, доверенностей. Гибкие описания документов — тот самый публичный список готовых типов — покупаются отдельно от лицензии.
Страница модуля →Верификация оператором
Отдельные рабочие станции верификации и три метода проверки: посимвольная (групповая), документарная в окне и контекстная по полям; неуверенно распознанные символы подсвечиваются. Рядом — HTML5-консоль мониторинга с отчётами по работе операторов, ошибкам и производительности.
Страница модуля →Выполнение действий
Шестой шаг конвейера: платформа создаёт запись в учётной системе, шлёт уведомление, собирает пакет документов, запускает согласование. Сценарий можно продиктовать словами: «ИИ-агент превращает описание задачи на естественном языке в готовый сценарий автоматизации»; сценарии хранятся в Git-репозитории заказчика.
Страница модуля →Экспорт
Данные — CSV, DBF, TXT, XLS/XLSX, XML, JSON; базы Oracle, SQL Server, Access, PostgreSQL; SharePoint, ERP, ECM, CRM, СЭД. Изображения — PDF и PDF/A с текстовым слоем под картинкой, TIFF, JPEG, JPEG 2000, PCX, BMP, PNG. Выгружать можно в несколько мест и форматов одновременно.
Страница модуля →Жёлтым со знаком «плюс» — то, что тарифицируется отдельно и добавляется к счёту. Зелёным с галочкой — то, что уже входит в тариф.
Структуру видно, сумму — нет: точную цифру называет только сам разработчик, и только на сегодня.
Модули (9)
Функциональные блоки в составе платформы
Первый шаг конвейера. В одном потоке — письма и вложения, бумага со сканеров и МФУ, файлы из «горячих папок» и по FTP, офисные форматы, изображения, PDF и PDF/A, XPS.
Сортировка входящих по типам машинным обучением. Формулировка разработчика: «в систему достаточно ввести 10 образцов нового класса документа, и технология автоматически научится определять тип документа по внешнему виду или взаимному расположению элементов».
Печатный текст — более 200 языков, рукопечатный ввод по клеточкам — 110 языков, рукописный текст — русский и английский. Типы текста: типографский, рукописный, пишущая машинка, матричный принтер, индекс, OCR-A, OCR-B, MICR. Штрихкоды — 24 типа, включая QR, Datamatrix и PDF-417.
Атрибутивное распознавание через LLM для неструктурированных текстов, «перегруженных канцелярской лексикой»: договоров, приказов, претензий, уставов, протоколов, доверенностей. Гибкие описания документов — тот самый публичный список готовых типов — покупаются отдельно от лицензии.
Отдельные рабочие станции верификации и три метода проверки: посимвольная (групповая), документарная в окне и контекстная по полям; неуверенно распознанные символы подсвечиваются. Рядом — HTML5-консоль мониторинга с отчётами по работе операторов, ошибкам и производительности.
Шестой шаг конвейера: платформа создаёт запись в учётной системе, шлёт уведомление, собирает пакет документов, запускает согласование. Сценарий можно продиктовать словами: «ИИ-агент превращает описание задачи на естественном языке в готовый сценарий автоматизации»; сценарии хранятся в Git-репозитории заказчика.
Данные — CSV, DBF, TXT, XLS/XLSX, XML, JSON; базы Oracle, SQL Server, Access, PostgreSQL; SharePoint, ERP, ECM, CRM, СЭД. Изображения — PDF и PDF/A с текстовым слоем под картинкой, TIFF, JPEG, JPEG 2000, PCX, BMP, PNG. Выгружать можно в несколько мест и форматов одновременно.
Отдельный продукт: читает счета, акты, счета-фактуры, ТОРГ-12, УПД и УКД и подставляет суммы, НДС и количество позиций прямо в 1С. Сверка идёт на едином экране внутри 1С, пакетная обработка — через «горячую папку».
Готовые описания документов — от счёта-фактуры и ТОРГ-12 до паспортов, миграционных и судебных — покупаются отдельно от лицензии. Это важно: базовая подписка не означает, что все перечисленные разработчиком типы документов у вас заработают. Рядом со списком разработчик оговаривается: «Указан неполный список. Если необходимого документа не оказалось в списке — напишите нам», то есть на любой нетиповой бланк описание делается отдельно.
Возможности (11)
Что решение умеет делать — по данным с сайта разработчика
Характеристики (16)
Паспортные данные — развёртывание, интеграции, безопасность
Ещё 10 характеристик
О разработчике
Редакция Soframe сверила факты с сайтом разработчика 8 сентября 2026 г. Что-то устарело — напишите нам, поправим.