Платформа Content AI (бывшая российская ABBYY) для потокового распознавания документов: читает счета, накладные, паспорта и договоры, извлекает данные и отдаёт их в 1С, ERP или СЭД. Ставится только в контур заказчика, облачной версии нет. Лицензия считается от числа обработанных страниц в год, и минимальный пакет крупный; готовые описания типов документов покупаются отдельно от лицензии.

О продукте

ContentCapture — платформа интеллектуальной обработки документов от ООО «Контент ИИ» (товарный знак Content AI), Москва. Это та самая команда и та самая технологическая линейка, что раньше работала в России под маркой ABBYY: ContentReader — прямой наследник FineReader, а ContentCapture — платформенный продукт для потока документов. В реестре отечественного ПО — запись №17598 от 17.05.2023, причём с ИИ-маркировкой: продукт официально отнесён к сфере искусственного интеллекта.

Устройство — конвейер из семи шагов: импорт, классификация, распознавание, извлечение и проверка данных, верификация человеком, выполнение действий, экспорт. Каждый шаг разобран в модулях ниже. Верификация здесь штатный шаг, а не признак неудачи: операторы не исчезают, их работа меняется с набора на вычитку. Человеку остаётся ещё обучение новому классу документов, настройка проверочных алгоритмов, сопровождение сценариев в Git и администрирование серверов.

Какие документы читает из коробки

В таком классе систем это главное, на что стоит смотреть, — не заявленная точность, а перечень готовых описаний. У Content AI он публичный и большой:

  • Бухгалтерия и финансы: счёт, счёт-фактура и корректировочная, платёжные и банковские документы, ПКО и РКО, приходный ордер М-4, бухгалтерский баланс, акт сверки, справка 2-НДФЛ, авансовый отчёт, акт выполненных работ, КС-2, КС-3, ОС-15.
  • Товарные и логистические: ТОРГ-12, ТОРГ-13, УПД, УКД, транспортная накладная, ТТН, накладная СМГС, СТС, ПТС, грузовая таможенная декларация, сертификат соответствия.
  • Личность и KYC: паспорт РФ и загранпаспорт, водительское удостоверение, СНИЛС, военный билет, свидетельства о рождении и о браке. Отдельно — паспорта и удостоверения личности граждан Беларуси, Казахстана, Узбекистана, Таджикистана, Кыргызстана и Азербайджана.
  • Миграционные: миграционная карта, виза РФ и уведомление о e-visa, вид на жительство, РВП, разрешение на работу, патент.
  • Регистрационные: свидетельства ИНН, в том числе иностранной компании, ОГРН и ОГРНИП, выписки и листы записи ЕГРЮЛ и ЕГРИП, карточка с образцами подписей.
  • Кадровые: дипломы, трудовая книжка и выписка из неё, СТД-Р, приказ на командировку, согласие на обработку персональных данных, выписки и справки ПФР.
  • Судебные: судебный приказ, исполнительный лист, определение суда, постановления о возбуждении и окончании исполнительного производства, о наложении и снятии ареста, об обращении взыскания.

Рядом со списком разработчик оговаривается: «Указан неполный список. Если необходимого документа не оказалось в списке — напишите нам». То есть на любой ваш нетиповой бланк описание делается отдельно.

Как продаётся

Цена считается от объёма страниц в год, а не от числа пользователей, и у годовой лицензии есть жёсткий нижний порог, ниже которого платформа не продаётся: маленький поток документов оцифровать здесь нельзя. Схема по умолчанию — подписка на 1 или 3 года с техподдержкой в стоимости; бессрочные лицензии возможны «по отдельному согласованию».

Прямых продаж нет. Дословно: «Компания не осуществляет прямые продажи программного обеспечения конечным пользователям». Прайс-листы лежат в закрытом разделе партнёрского портала. Значит, условия вы в любом случае узнаете от интегратора, и они будут его, а не разработчика: публикуемые цифры разработчик помечает как рекомендованные розничные, потому что «фактические цены продажи конечным пользователям зависят от ценовой политики авторизованных партнёров».

На сайте есть ROI-калькулятор. Пользоваться им стоит с поправкой: он считает по вашим же введённым допущениям, а базовая цифра экономии подписана честно и странно — «По нашим оценкам, продукты Embedika экономят в среднем 70% времени на анализе документов», то есть взята из оценки стороннего разработчика. Сам разработчик помечает: «Расчёт носит предварительный характер».

Что докупается отдельно

Гибкие описания типов документов покупаются отдельно от лицензии — они помечены в схеме счёта ниже. Это важнее, чем кажется: базовая подписка не означает, что все перечисленные разработчиком типы документов у вас заработают. Перечень выше — это то, что готово; на всё остальное описание делается отдельно и за отдельные деньги.

Кроме них — дополнительные модули платформы, серверы и их администрирование, внедрение партнёром.

Требования к железу и ОС

Состав окружения — в характеристиках ниже. Смысл этих цифр простой: инфраструктура целиком на вас. Домен, база данных, сервер приложений, станции обработки, Git-репозиторий сценариев — систему нужно кому-то держать, и облачной альтернативы у неё нет.

Отдельно стоит проверить парк сканеров. Разработчик перечисляет поддерживаемых производителей — Canon, Epson, HP, Kodak, Xerox, Fujitsu и другие, — но тут же пишет: «в общем случае компания Content AI не может гарантировать и не гарантирует работоспособность своих программ с любыми сканерами».

Где обрабатываются данные

Данные не уходят из вашего контура. Ответ разработчика в FAQ прямой: «ContentCapture разворачивается в контуре заказчика. Все данные и код остаются под полным контролем заказчика». Облачной SaaS-версии нет вообще — это не сервис с загрузкой файлов на чужой сервер, а система, которую вы ставите и админите сами. Для персональных данных, паспортов и банковской первички это обычно решающий довод.

Состав защиты разработчик перечисляет подробно: пять способов аутентификации, единый вход через SAML, JWT, OIDC и Active Directory, ролевой доступ, TLS 1.2, шифрование баз и файловых хранилищ включая S3, журнал событий безопасности с экспортом в формат CEF.

Какая именно LLM отвечает за атрибутивное распознавание, разработчик на сайте не называет. Раз всё работает внутри контура, вопрос «что будет, если модель отключат» стоит здесь мягче, чем у облачных ИИ-сервисов, — но состав моделей всё равно придётся уточнять у партнёра при пилоте.

Что важно знать до выбора

Цифру «98%» нельзя читать как гарантию. Она встречается на сайте дважды, и оба раза — в клиентских кейсах с конкретным типом документов: в проекте с «Маздой» это собственные бланки и анкеты, в проекте с «Бургер Кингом» — товарно-транспортные накладные. Формулировка везде «качество распознавания достигает 98%». Универсальной гарантии по любым вашим документам из этого не следует, и разработчик её не даёт. Единственный честный способ узнать свою цифру — прогнать на пилоте собственную пачку сканов.

Что при этом заявлено проверяемо: выдержанная нагрузка — до 2 млн документов в сутки, а из клиентов на сайте названы Альфа-банк, Россельхозбанк, X5 Group, СИБУР, FESCO, «Бургер Кинг», «Мазда», Softline, ТЭК-Торг и «Ридан».

ИИ здесь в четырёх местах, и разработчик сам очерчивает границу. Атрибутивное распознавание через LLM — для неструктурированных текстов, «перегруженных канцелярской лексикой»: договоров, приказов, претензий, уставов, протоколов, доверенностей. ICR — рукописный текст в паспортах, анкетах, заявлениях. Свёрточные и генеративно-состязательные сети — предобработка изображения: шумы, перекос, текст на сложном фоне. ML — классификация входящих по типам. Поверх этого платформа выполняет и следующий шаг процесса, а сценарий можно продиктовать словами: «ИИ-агент превращает описание задачи на естественном языке в готовый сценарий автоматизации». Но в FAQ разработчик сам себя останавливает: «ContentCapture теперь RPA-платформа? Нет. Интеллектуальная обработка документов остаётся основой платформы».

Кому не подойдёт

Малому бизнесу. Минимальный объём годовой лицензии плюс отдельная плата за описания документов, плюс серверы, плюс внедрение партнёром — это бюджет крупной бухгалтерии или банка, а не компании с десятком счетов в месяц.

Тем, кто хочет «загрузить скан по API и получить JSON». Облака нет; для встраивания в своё приложение у Content AI отдельные продукты — ContentReader Engine (OCR SDK) и PassportReader SDK.

Тем, кому нужна фиксированная публичная цена. Её нет и не будет: считают по страницам, продают через партнёров, прайс закрыт.

Сколько стоит

По запросу — разработчик считает цену индивидуально

Цена считается от объёма страниц в год, а не от числа пользователей, и годовая лицензия начинается с фиксированного порога, ниже которого платформа не продаётся: маленький поток документов оцифровать здесь нельзя. Техподдержка входит в стоимость. Прямых продаж у разработчика нет: «Компания не осуществляет прямые продажи программного обеспечения конечным пользователям», прайс-листы лежат в закрытом разделе партнёрского портала. Публикуемые цифры — рекомендованные розничные: «фактические цены продажи конечным пользователям зависят от ценовой политики авторизованных партнёров».

Сумм мы не публикуем: они меняются чаще, чем мы успеваем их проверять, а устаревшая цифра подрывает доверие ко всему разбору. Актуальную стоимость называет сам разработчик.

У разработчика заявлено тарифов и пакетов: 3 — Годовая подписка на пакет страниц, Подписка на 3 года, Бессрочная лицензия

Что различается в тарифах
Годовая подписка на пакет страниц
Цена считается от объёма страниц в год, а не от числа пользователейТехподдержка входит в стоимостьЕсть жёсткий минимальный объём закупки
Подписка на 3 года
Та же схема, что и годовая, но на три годаТехподдержка входит в стоимость
Бессрочная лицензия
Только по отдельному согласованию

Со страницы тарифов разработчика. Суммы не приводим: они меняются, и на его сайте они всегда сегодняшние.

Тарифы на сайте разработчика
1 · тарифа
Годовая подписка на пакет страниц
Подписка на 3 года
Бессрочная лицензия

Порядок ступеней — со страницы тарифов разработчика, не наша оценка: тарифы отличаются охватом, а не оценкой качества.

×
2 · 9 модулей — что входит, а за что доплата
1С-коннектор ContentCapture

Отдельный продукт: читает счета, акты, счета-фактуры, ТОРГ-12, УПД и УКД и подставляет суммы, НДС и количество позиций прямо в 1С. Сверка идёт на едином экране внутри 1С, пакетная обработка — через «горячую папку».

Страница модуля →
Гибкие описания типов документов

Готовые описания документов — от счёта-фактуры и ТОРГ-12 до паспортов, миграционных и судебных — покупаются отдельно от лицензии. Это важно: базовая подписка не означает, что все перечисленные разработчиком типы документов у вас заработают. Рядом со списком разработчик оговаривается: «Указан неполный список. Если необходимого документа не оказалось в списке — напишите нам», то есть на любой нетиповой бланк описание делается отдельно.

Страница модуля →
Импорт

Первый шаг конвейера. В одном потоке — письма и вложения, бумага со сканеров и МФУ, файлы из «горячих папок» и по FTP, офисные форматы, изображения, PDF и PDF/A, XPS.

Страница модуля →
Классификация

Сортировка входящих по типам машинным обучением. Формулировка разработчика: «в систему достаточно ввести 10 образцов нового класса документа, и технология автоматически научится определять тип документа по внешнему виду или взаимному расположению элементов».

Страница модуля →
Распознавание

Печатный текст — более 200 языков, рукопечатный ввод по клеточкам — 110 языков, рукописный текст — русский и английский. Типы текста: типографский, рукописный, пишущая машинка, матричный принтер, индекс, OCR-A, OCR-B, MICR. Штрихкоды — 24 типа, включая QR, Datamatrix и PDF-417.

Страница модуля →
Извлечение и проверка данных

Атрибутивное распознавание через LLM для неструктурированных текстов, «перегруженных канцелярской лексикой»: договоров, приказов, претензий, уставов, протоколов, доверенностей. Гибкие описания документов — тот самый публичный список готовых типов — покупаются отдельно от лицензии.

Страница модуля →
Верификация оператором

Отдельные рабочие станции верификации и три метода проверки: посимвольная (групповая), документарная в окне и контекстная по полям; неуверенно распознанные символы подсвечиваются. Рядом — HTML5-консоль мониторинга с отчётами по работе операторов, ошибкам и производительности.

Страница модуля →
Выполнение действий

Шестой шаг конвейера: платформа создаёт запись в учётной системе, шлёт уведомление, собирает пакет документов, запускает согласование. Сценарий можно продиктовать словами: «ИИ-агент превращает описание задачи на естественном языке в готовый сценарий автоматизации»; сценарии хранятся в Git-репозитории заказчика.

Страница модуля →
Экспорт

Данные — CSV, DBF, TXT, XLS/XLSX, XML, JSON; базы Oracle, SQL Server, Access, PostgreSQL; SharePoint, ERP, ECM, CRM, СЭД. Изображения — PDF и PDF/A с текстовым слоем под картинкой, TIFF, JPEG, JPEG 2000, PCX, BMP, PNG. Выгружать можно в несколько мест и форматов одновременно.

Страница модуля →

Жёлтым со знаком «плюс» — то, что тарифицируется отдельно и добавляется к счёту. Зелёным с галочкой — то, что уже входит в тариф.

=
счёт

Структуру видно, сумму — нет: точную цифру называет только сам разработчик, и только на сегодня.

Модули (9)

Функциональные блоки в составе платформы

Импорт Входит в тариф

Первый шаг конвейера. В одном потоке — письма и вложения, бумага со сканеров и МФУ, файлы из «горячих папок» и по FTP, офисные форматы, изображения, PDF и PDF/A, XPS.

Классификация Входит в тариф

Сортировка входящих по типам машинным обучением. Формулировка разработчика: «в систему достаточно ввести 10 образцов нового класса документа, и технология автоматически научится определять тип документа по внешнему виду или взаимному расположению элементов».

Распознавание Входит в тариф

Печатный текст — более 200 языков, рукопечатный ввод по клеточкам — 110 языков, рукописный текст — русский и английский. Типы текста: типографский, рукописный, пишущая машинка, матричный принтер, индекс, OCR-A, OCR-B, MICR. Штрихкоды — 24 типа, включая QR, Datamatrix и PDF-417.

Извлечение и проверка данных Входит в тариф

Атрибутивное распознавание через LLM для неструктурированных текстов, «перегруженных канцелярской лексикой»: договоров, приказов, претензий, уставов, протоколов, доверенностей. Гибкие описания документов — тот самый публичный список готовых типов — покупаются отдельно от лицензии.

Верификация оператором Входит в тариф

Отдельные рабочие станции верификации и три метода проверки: посимвольная (групповая), документарная в окне и контекстная по полям; неуверенно распознанные символы подсвечиваются. Рядом — HTML5-консоль мониторинга с отчётами по работе операторов, ошибкам и производительности.

Выполнение действий Входит в тариф

Шестой шаг конвейера: платформа создаёт запись в учётной системе, шлёт уведомление, собирает пакет документов, запускает согласование. Сценарий можно продиктовать словами: «ИИ-агент превращает описание задачи на естественном языке в готовый сценарий автоматизации»; сценарии хранятся в Git-репозитории заказчика.

Экспорт Входит в тариф

Данные — CSV, DBF, TXT, XLS/XLSX, XML, JSON; базы Oracle, SQL Server, Access, PostgreSQL; SharePoint, ERP, ECM, CRM, СЭД. Изображения — PDF и PDF/A с текстовым слоем под картинкой, TIFF, JPEG, JPEG 2000, PCX, BMP, PNG. Выгружать можно в несколько мест и форматов одновременно.

1С-коннектор ContentCapture Коннектор

Отдельный продукт: читает счета, акты, счета-фактуры, ТОРГ-12, УПД и УКД и подставляет суммы, НДС и количество позиций прямо в 1С. Сверка идёт на едином экране внутри 1С, пакетная обработка — через «горячую папку».

Гибкие описания типов документов Доплата

Готовые описания документов — от счёта-фактуры и ТОРГ-12 до паспортов, миграционных и судебных — покупаются отдельно от лицензии. Это важно: базовая подписка не означает, что все перечисленные разработчиком типы документов у вас заработают. Рядом со списком разработчик оговаривается: «Указан неполный список. Если необходимого документа не оказалось в списке — напишите нам», то есть на любой нетиповой бланк описание делается отдельно.

Возможности (11)

Что решение умеет делать — по данным с сайта разработчика

Извлечение данных без шаблонов
На каждый новый бланк нужен программист
Интеграция с 1С
нативная синхронизация каталога/заказов/счетов с 1С; критично для РФ.
Классификация и разделение пакета документов
Сканируем пачку — потом вручную раскладываем, где договор, где акт
Подготовка и контроль качества изображения
Фото с телефона кривые и тёмные — распознаётся мусор
Проверка извлечённых данных по правилам
Распознали — а сумма в строках не сходится с итогом
Распознавание первичных бухгалтерских документов
Бухгалтер полдня вводит счета и накладные
Распознавание рукописного текста
Анкеты и заявления заполнены от руки — их никто не читает, кроме человека
Распознавание таблиц
Таблицы из сканов разваливаются при переносе
Распознавание удостоверений личности
Паспорт клиента вбиваем руками, ошибки в серии и номере
Ещё 2 возможности

Характеристики (16)

Паспортные данные — развёртывание, интеграции, безопасность

Развёртывание установка в контур заказчика
Цены на сайте опубликованы частично
Требования к серверу Сервер приложений — 3 ГГц и 16+ ядер; станции обработки — не менее 2,5 ГБ ОЗУ на каждое ядро и обязательно в домене. База — MS SQL Server 2016 SP2+ или PostgreSQL 15+ (под Linux — только PostgreSQL), под Windows дополнительно IIS 7+. ОС — Windows и отечественные Linux: Astra Linux 1.7.3 и 1.8, РЕД ОС 7.3 и 8, Alt Linux 10.1, Platform V SberLinux OS Server 8.8.
Типы документов бухгалтерская первичка, удостоверения личности (паспорт, ВУ, СНИЛС), кадровые документы, договоры и юридические документы, банковские и финансовые справки, миграционные документы, судебные документы, таможенные и транспортные документы
Дообучение под данные заказчика входит в продукт
Обработка данных в РФ данные остаются в контуре заказчика
Ещё 10 характеристик
Люди в контуре обработки верификация оператором заказчика
Номер реестровой записи 17598
Как заявлена точность число без методики замера
В реестре отечественного ПО есть, номер опубликован
Модель тарификации за объём (минуты, страницы, токены), подписка за период
Где обрабатываются документы контур заказчика
Форма поставки готовый интерфейс
Целевой масштаб бизнеса крупный бизнес
Тип решения платформа в контуре заказчика
Происхождение ИИ-моделей собственные, не раскрыты

О разработчике

Редакция Soframe сверила факты с сайтом разработчика 8 сентября 2026 г. Что-то устарело — напишите нам, поправим.

Похожие решения

Чем заменить ContentCapture →