Ии документы – запрос, за которым стоят очень разные задачи: от «прочитай этот договор» до «сделай так, чтобы бумаги перестали теряться». Разберём по порядку.
Четыре задачи, которые закрываются уже сегодня
Первая – разбор входящих. Счета, накладные, заявки, резюме приходят в свободной форме, а нужны структурированные поля. Ии работа с документами тут даёт самый быстрый эффект: человек перестаёт перепечатывать данные руками.
Вторая – поиск по своим документам. Не по названию файла, а по смыслу: «какие у нас условия возврата для оптовиков». Ии документация превращается из папки, куда никто не заглядывает, в то, что можно спросить словами.
Третья – подготовка черновиков. Договор по шаблону, коммерческое предложение, акт. Ии для создания документов в ворде экономит не столько время на печать, сколько время на «вспомнить, где лежит правильный шаблон».
Четвёртая – сверка. Сравнить две версии договора и показать, что изменилось. Скучная работа, где человек устаёт и пропускает, а машина не устаёт.
Кому это нужно в первую очередь
Бухгалтерии – счета, акты, накладные. Самый очевидный и самый посчитанный случай.
Отделу кадров – резюме и заявления. Разбор входящих резюме экономит первые часы скучного чтения, а решение всё равно остаётся за человеком.
Юристам – сверка версий договоров. Не оценка, а именно поиск отличий: где поменяли срок, где убрали пункт про ответственность.
Клиентскому отделу – заявки в свободной форме. Человек пишет как умеет, а система достаёт из этого структурированный запрос.
Общий признак у всех четырёх: документов много, они однотипные, и ошибка находится на проверке, а не у клиента. Там, где этого признака нет, я браться не советую.
Чего пока отдавать не стоит
Юридическую оценку. Модель уверенно перескажет пункт договора и так же уверенно ошибётся в его последствиях. Проверка юристом остаётся обязательной.
Итоговое решение. Одобрить, отказать, подписать – это человек. ИИ готовит материал для решения, а не принимает его.
Работу с плохо отсканированными бумагами. Кривой скан с печатью поверх текста по-прежнему читается с ошибками, и лучше это знать заранее.
Всё, где цена ошибки выше стоимости ручной проверки. Простое правило, которое экономит много нервов.
Что делать, если документы приходят по-разному
Это самый частый случай и главная причина, по которой жёсткие шаблоны не работают. Один поставщик присылает PDF, другой фотографию, третий вообще текст в письме.
Решение не в том, чтобы заставить всех присылать одинаково – это невозможно. Решение в модели, которая понимает смысл полей, а не их расположение на листе.
Практическое следствие: не пытайтесь описать все формы заранее. Соберите реальную выборку за месяц, и система научится на ней, включая исключения.
С чего начинать, чтобы получилось
Возьмите один тип документа, который приходит чаще всего. Не «все документы компании», а именно один: например, счета от поставщиков.
Посчитайте, сколько времени сейчас уходит на его обработку и сколько бывает ошибок. Без этих двух цифр вы через месяц не докажете себе, что стало лучше.
Соберите полсотни реальных примеров, включая кривые. Именно на них видно, где система будет спотыкаться, а не на трёх идеальных образцах.
И решите заранее, что происходит, когда ИИ не уверен. Правильный ответ – помечает и отдаёт человеку, а не угадывает.
Почему документооборот – хорошая точка входа
Потому что результат виден в часах, а не в ощущениях. Обработка счетов либо стала быстрее, либо нет.
Потому что риск ограничен: ошибка находится на проверке, а не всплывает у клиента.
И потому что здесь легко посчитать деньги. Час бухгалтера умножить на количество документов – вот и весь бизнес-кейс, не нужны сложные выкладки.
В моём кейсе с процессной аналитикой похожая логика: сначала стало видно, где в процессе теряется время, а уже потом решали, что автоматизировать. Порядок именно такой, а не наоборот.
Сколько это стоит
Обработка документов – от 50 000 ₽. Цена зависит от того, сколько типов документов и насколько они разнообразны по форме.
Корпоративный бот, который отвечает по вашей базе документов, – от 75 000 ₽. Здесь основная работа не в модели, а в том, чтобы привести документы в порядок.
И честно про скрытую часть: если регламенты писались давно и с тех пор изменились только на словах, сначала придётся их актуализировать. Эту работу почти никто не закладывает, а она бывает больше самой разработки.
Как выглядит рабочая схема на практике
Документ приходит на почту или загружается в папку. Первый шаг – распознавание: если это скан, из него достаётся текст.
Второй шаг – извлечение полей. Номер, дата, сумма, контрагент, позиции. Здесь и работает модель: она понимает, что перед ней, даже если бланк непривычный.
Третий шаг – проверка. Суммы сходятся, дата в допустимом диапазоне, контрагент есть в базе. Всё, что не прошло проверку, помечается и уходит человеку.
Четвёртый – запись в вашу систему и уведомление ответственного. Именно на этом шаге появляется польза: данные оказались там, где нужно, без ручного ввода.
Вся схема живёт или умирает на третьем шаге. Автоматизация без проверок – это ускоренное производство ошибок, и это главное, что я проверяю в чужих внедрениях.
Сколько времени это экономит на самом деле
Считать надо не «сколько секунд на документ», а полный цикл: найти письмо, открыть вложение, перепечатать, перепроверить, положить в папку, отметить в реестре.
В моей практике на типовом входящем документе ручной цикл – это несколько минут вместе с переключением внимания. Автоматика убирает почти всё, кроме проверки спорных случаев.
Отсюда простая арифметика: сто документов в месяц по несколько минут – это рабочий день сотрудника, который можно вернуть. Двести – два дня. На этом и строится решение, брать или не брать.
Грабли, на которые уже наступил
Система, обученная на идеальных примерах, разваливается на реальных. Собирайте кривые сканы и нестандартные формы с самого начала.
Без явного «не уверен» ИИ будет тихо ошибаться. Флаг неуверенности важнее точности.
Автоматизация плохого процесса делает плохой процесс быстрее. Если документы теряются из-за того, что за них никто не отвечает, ИИ этого не починит.
Вопросы и ответы
Может ли ИИ прочитать скан и вытащить данные?
Да, если скан читаемый. С кривыми и затёртыми печатями точность падает, это надо проверять на ваших реальных примерах.
Заменит ли это бухгалтера или юриста?
Нет. Снимет с них перепечатывание и поиск, решения останутся за людьми.
Где будут храниться наши документы?
У вас, если разворачиваем локально. Для чувствительных документов это обычно обязательное условие.
Сколько стоит и сколько занимает?
От 50 000 ₽, запуск на одном типе документов – две-три недели, включая тестирование на ваших примерах.
С какого документа начать?
С самого частого и самого однотипного. Первый успех должен быть быстрым, иначе проект умрёт на согласованиях.
Что если формат документов постоянно меняется?
Тогда нужна не жёсткая схема, а модель, которая понимает смысл полей. Это дороже, но переживает изменения формы.