Как считать окупаемость ИИ?
Где ИИ окупается, определяют четыре свойства самой задачи: частота повторов, наличие эталона правильного ответа, цена проверки ошибки и то, чем занять освободившегося человека. Квартал в заголовке — это порог отбора: задача попадает в список, если экономия за три месяца покрывает запуск и содержание. Считается всё до покупки инструмента.
| Свойство задачи | Что оно решает в расчёте |
|---|---|
| Частота | Экономия умножается на число повторов. Чем реже событие, тем меньше произведение |
| Эталон ответа | Даёт базу сравнения и способ проверить ответ модели |
| Цена проверки | Когда ошибку находит клиент, к расходам добавляется стоимость репутации |
| Занятость времени | Освобождённый час оплачивается, пока ему не нашли применение |
Считайте так: обращений в месяц × минут ручной работы × стоимость минуты. Стоимость минуты берите свою — месячные затраты на сотрудника разделите на рабочие часы и на шестьдесят. Скажем, при ста обращениях в месяц по семь минут и стоимости минуты в шесть рублей потолок экономии выходит четыре тысячи двести рублей в месяц, и дальше именно с этой цифрой сравниваются все расходы на запуск и содержание.
Цена самой модели тут наименьшая часть счёта и самая обманчивая. Тысяча токенов GigaChat Lite стоит 6,5 копейки, Pro — 50 копеек (прайс для юрлиц, проверено 27 августа 2026). Дальше начинается умножение. Один вопрос пользователя разворачивается в три-семь обращений к модели, и вместе с вопросом в неё уезжает подставленный текст документов, за который вы тоже платите (разбор юнит-экономики, Кирилл Гришанин, июнь 2026). Автор разбора продаёт внедрение таких систем, и расчёт работает против его интереса.
Основные деньги лежат в другом месте: описание процесса, сведение данных, интеграция с 1С и почтой, обучение людей. Сравнение путей — доработать учётную систему или поставить отдельный контур рядом — вынесено отдельно. Ежемесячно к токенам добавляется вторая строка — время сотрудника на выборочную проверку ответов.
Окупается: разбор входящих заявок и писем
Счётчик здесь готов до всякого внедрения: число обращений в месяц, время до первого осмысленного ответа, доля писем, ушедших не тому сотруднику. Все три снимаются из почты и CRM за один заход. Порог по объёму высокий: тридцать обращений в месяц по пять минут дают два с половиной часа экономии в месяц.
Счёт начинает сходиться примерно с трёхсот обращений в месяц — это уже больше трёх рабочих дней ежемесячно. Если заявки до сих пор живут в таблице, счётчик придётся заводить с нуля: эта развилка разобрана раньше.
Самый крупный замер эффекта сделан на клиентской поддержке — 5 179 операторов и около трёх миллионов чатов.
Access to the tool increases productivity, as measured by issues resolved per hour, by 14% on average, including a 34% improvement for novice and low-skilled workers but with minimal impact on experienced and highly skilled workers.
По-русски: выработка выросла на 14 % в среднем, на 34 % у новичков и практически не изменилась у опытных сотрудников. Механика видна во второй половине цифры: инструмент раздаёт новичку опыт, накопленный сильными коллегами.
Второе наблюдение объясняет, откуда берётся выигрыш. В испытании агента для разбора фишинговых писем — 167 аналитиков безопасности, очередь из 25 писем — 83 % прироста дала сортировка очереди по важности и 17 % сами ответы модели (arXiv:2511.13860; исследование Microsoft о собственном продукте). Для любой очереди работает одно и то же: деньги приносит порядок разбора.
Если задача у вас названа, а счёт не сходится, пришлите два числа — частоту и минуты на одну операцию — в бот. Посчитаю и скажу, где у вас порог. Что входит в работу по ИИ-контуру и вилки цен — на странице услуг.
Окупается: черновики документов
Коммерческие предложения, письма клиентам, служебные записки, первые версии актов. Порог здесь ниже, чем у заявок: документ занимает не минуты, а часы, поэтому счёт сходится уже на двух-трёх десятках документов в месяц. Замер по этой задаче самый чистый из существующих.
Предзарегистрированный эксперимент, 453 профессионала с высшим образованием, задачи по своей специальности, качество оценивали вслепую практики той же профессии. Время на задачу сократилось на 40 %, оценка качества выросла на 18 % (Science, 2023).
Выигрыш идёт с этапа черновика. Отсюда и граница применимости. В документе, который печатается готовой формой из 1С, экономить нечего: там уже ноль минут ручной работы.
Окупается: поиск по своим регламентам и договорам
Задача считается, когда документов сотни, лежат они в разных местах и у них есть версии. Счётчик — сколько раз в неделю сотрудник спрашивает коллегу «а где посмотреть», и сколько минут занимает поиск нужного пункта в договоре. На десяти регламентах в одной папке быстрее открыть папку.
Здесь же лежит ограничение, о котором стоит знать до покупки. Промышленные юридические системы поиска проверены независимо на 202 запросах с экспертной разметкой.
While hallucinations are reduced relative to general-purpose chatbots, we find that the AI research tools made by LexisNexis (Lexis+ AI) and Thomson Reuters (Westlaw AI-Assisted Research and Ask Practical Law AI) each hallucinate between 17% and 33% of the time.
То есть от 17 до 33 % ответов содержат вымысел. Лучшая из проверенных систем отвечала точно в 65 % случаев, вторая — в 42 %. Отсюда требование к внедрению: ответ выдаётся со ссылкой на пункт, и пункт открывает человек. Тогда экономится поиск.
Почему замена менеджеров не окупается?
Расчёт упирается в четвёртое свойство. Час, который бот снял с менеджера, продолжает оплачиваться, пока этому часу не нашли применение. К этому добавляются две статьи расходов: качество на нетиповых обращениях и ответственность за сказанное клиенту. Обе всплывают уже после запуска, когда бюджет потрачен.
Первая — качество на нетиповых обращениях. В рандомизированном полевом эксперименте на 647 операторах и 680 тысячах чатов длительность обращения снизилась на 16,8 % (arXiv:2605.14830). Клиентская оценка при этом упала на 0,412 балла из пяти. Нетиповое обращение — это как раз то, где решается сделка.
Вторая — ответственность. В деле Moffatt v. Air Canada трибунал обязал авиакомпанию выплатить 812 канадских долларов за неверный ответ чат-бота и отклонил довод, что бот отвечает за себя сам (2024 BCCRT 149). Ответ бота связывает компанию.
Считается здесь другая конфигурация: подсказка менеджеру во время разговора, при которой решение и подпись остаются за человеком.
Почему прогноз спроса на трёх точках не работает?
Короткая история не позволяет разделить сезонность, тренд и случайный разброс. У этого есть точная граница: месячной модели с сезонностью нужно минимум 14 наблюдений, методу Хольта-Уинтерса — 17 (Hyndman, Kostenko, Foresight, 2007). Это математический предел: при более короткой истории интервал прогноза становится бесконечным.
Оттуда же простое правило: чтобы сузить вилку прогноза вдвое, историю нужно удлинить вчетверо. На трёх точках любая модель выдаст произвольное число.
Сложность модели нехватку данных не компенсирует. На соревновании M5 машинное обучение выиграло — на 42 840 рядах и 5,4 годах ежедневных данных Walmart, то есть на объёме, которого у малого предприятия не бывает. Обычное экспоненциальное сглаживание обошли там 7,5 % команд (International Journal of Forecasting, 2022).
Откуда берутся расходящиеся цифры в отчётах, я разбирал отдельно.
Какие ещё три запроса не окупаются?
Три оставшихся проваливают счёт по тем же свойствам: событие слишком редкое, эталона нет, ошибка стоит дорого. Каждый из них приходит от собственника регулярно и выглядит разумной идеей. Ограничение здесь лежит в свойствах самой задачи, и любой инструмент упрётся в него одинаково.
- Распознавание брака камерой на малых партиях. Модель учится на примерах дефектов. У малого производства брака мало, и каждый раз он новый. Размечать примеры приходится технологу — самому дорогому человеку в цехе.
- Холодный обзвон роботом. С 1 сентября 2025 массовые вызовы от организаций и ИП допускаются только с согласия абонента, оператор связи показывает данные звонящего и вправе блокировать вызовы без согласия (разъяснение по ФЗ от 01.04.2025 № 41-ФЗ). Экономика добивает остальное: распознавание речи у Сбера стоит 0,6 ₽ за минуту при минимальной оплате 15 000 ₽ в месяц, и с 15 июля 2026 года новым клиентам эта схема закрыта вовсе (прайс SaluteSpeech, 27 августа 2026).
- Задача, которую закрывают два правила. Формулировку даёт отчёт RAND по итогам 65 интервью. Командам поручали применять ИИ к данным с несколькими доминирующими закономерностями — теми, что быстро описываются парой условий «если — то» (RAND RR-A2680-1).
Как проверить свою задачу за 15 минут?
Понадобится одна задача, три числа за прошлый месяц и калькулятор. Расчёт занимает четверть часа, делается на своих данных и даёт ответ ещё до первого разговора с подрядчиком. Ниже порядок из трёх шагов: первые два дают числа, третий переводит их в решение.
- Посчитайте потолок. Сколько раз задача случилась, сколько минут занимала каждый раз, во сколько обходится минута работы сотрудника. Произведение трёх чисел — верхняя граница месячной экономии.
- Сложите расходы. Разовый запуск плюс ежемесячное содержание вместе со временем на проверку ответов. Если потолок покрывает сумму за три месяца, задача проходит порог.
- Ответьте, чем займётся освободившийся человек. Пока ответа нет, экономия остаётся бумажной.
| Задача | Что решает счёт |
|---|---|
| Разбор входящих заявок | Сходится примерно с 300 обращений в месяц |
| Черновики документов | Сходится с двух-трёх десятков документов в месяц |
| Поиск по регламентам | Сходится, когда документов сотни и у них есть версии |
| Замена менеджеров ботом | Освободившееся время остаётся оплаченным |
| Прогноз спроса на короткой истории | Меньше 14 наблюдений — интервал бесконечен |
| Распознавание брака на малых партиях | Примеров дефектов мало, разметка стоит времени технолога |
| Холодный обзвон роботом | Согласие абонента плюс порог оплаты сервиса |
| Задача для пары правил | Экономия меньше стоимости запуска |
Источники
- Прайс GigaChat для юридических лиц — 0,065 / 0,5 / 0,65 ₽ за 1000 токенов, минимальный платёж 600 ₽ в месяц; проверено 27.08.2026
- Прайс SaluteSpeech для юридических лиц — 0,6 ₽ за минуту распознавания, минимальная стоимость 15 000 ₽ в месяц, с 15.07.2026 схема закрыта для новых клиентов
- Кирилл Гришанин. «Юнит-экономика LLM в 2026», Хабр, 10.06.2026 — три-семь вызовов модели на один запрос, доля стоимости подставленных документов
- Brynjolfsson, Li, Raymond. «Generative AI at Work», NBER WP 31161 — 5 179 операторов, около 3 млн чатов, ноябрь 2020 — февраль 2021; метод не эксперимент, а ступенчатое внедрение с разностью разностей
- «Randomized Controlled Trials for Phishing Triage Agent», arXiv:2511.13860 — 167 аналитиков безопасности, 83 % прироста от приоритизации очереди. Исследование Microsoft о собственном продукте
- Noy, Zhang. «Experimental evidence on the productivity effects of generative AI», Science, 2023 — 453 профессионала, предзарегистрированный эксперимент, минус 40 % времени и плюс 18 % качества
- Magesh и др. «Hallucination-Free? Assessing the Reliability of Leading AI Legal Research Tools», Journal of Empirical Legal Studies, 2025 — 202 запроса, от 17 до 33 % галлюцинаций, точность 65 % и 42 %
- Полевой эксперимент в клиентской поддержке, arXiv:2605.14830 — 647 операторов, 680 676 чатов, август 2024; минус 16,8 % длительности при падении оценки на 0,412 балла
- Moffatt v. Air Canada, 2024 BCCRT 149 — 812 канадских долларов за неверный ответ чат-бота
- Hyndman, Kostenko. «Minimum Sample Size Requirements for Seasonal Forecasting Models», Foresight, 2007 — 14 и 17 наблюдений как математический предел, правило «вчетверо длиннее ряд — вдвое уже вилка»
- Makridakis и др. Итоги соревнования M5, International Journal of Forecasting, 2022 — 42 840 рядов, 5,4 года данных, 7,5 % команд выше экспоненциального сглаживания
- RAND RR-A2680-1 — 65 полуструктурированных интервью, задачи, которые закрываются правилами «если — то»
- Массовые вызовы: что изменилось с 01.09.2025 — ФЗ от 01.04.2025 № 41-ФЗ, согласие абонента, право оператора блокировать вызовы
Любая из восьми задач меняет статус вместе с объёмом. Поэтому счётчик стоит завести даже при отрицательном ответе: через год поток может вырасти вдвое, и расчёт придётся повторить.