реплика

Вендор закроется через год: рынок голосовых агентов в России

Российский рынок голосовых ИИ-агентов: четыре типа игроков, три фактора отсева — доступ к моделям, данные в РФ, цена входа — и что спросить у поставщика.

ВПВадим ПоповВадим Поповсооснователь «Реплики»·23 сентября 2026·7 минут чтения

Российский рынок голосовых ИИ-агентов сейчас плотный: платформы, отраслевые решения, интеграторы, речевая аналитика — и почти все говорят про одно и то же. Через три года их будет меньше, и отсев пойдёт по трём внешним факторам: доступ к моделям, требования к данным на территории России и цена входа.

Короткий ответ. Останутся те, у кого решён вопрос с моделями — свой локальный стек или устойчивый доступ к внешнему; у кого хранение записей соответствует 152-ФЗ; и кто выдерживает себестоимость полноценного LLM-агента, а не продаёт скриптовый обзвон под видом агента. Это прогноз, а не наблюдение, но опирается он на уже действующие ограничения.

Ниже — расклад по типам игроков, три фактора отсева и вопросы, которые из этого следуют уже сейчас.

Российский рынок голосовых ИИ-агентов: четыре типа игроков

Игроков удобно различать не по названиям, а по тому, что именно вы покупаете. По исследованию Just AI (публикация telesputnik), долю выручки более 5% на рынке разговорного ИИ держат MTS Exolve, Ростелеком Контакт-центр, VS Robotics, BSS, Just AI, Twin24, Neuro.net, Zvonobot, Kvint.io и Tomoru — но это разбивка про деньги, а не про тип решения.

Тип игрокаЧто вы покупаетеКто на рынке (примеры)Что придётся делать самому
Платформа для самостоятельной сборкиКонструктор, API, телефонияVoximplant, Aimylogic (запуск обзвона по событию в CRM)Сценарий, база знаний, интеграции, поддержка
Готовое решение под задачу или отрасльНастроенный сценарий и запускTomoru, Twin, Neuro.net, RobovoiceДанные, доступы, приёмку по своим критериям
Интегратор и партнёрВнедрение поверх чужой платформыРешения в маркетплейсе Битрикс24, в том числе Tomoru и TWINПостановку задачи и владельца проекта внутри
Речевая аналитикаРазбор записей, а не разговор3iTech, ЦРТ, Speech AnalyticsСобственно агента — это соседний класс продукта

Названия здесь — примеры типов, а не рейтинг: сравнивать их «лучше — хуже» без общей методики некорректно. Важнее другое различение: платформа перекладывает работу на вас и дешевле в подписке, готовое решение дороже и берёт работу на себя. Где ломается расчёт между ними — в статье своя разработка или готовая платформа.

Про оценки объёма рынка

Публичные оценки российского рынка разговорного ИИ расходятся в разы в зависимости от учёта госзаказа. Поэтому здесь нет ни одной цифры про «объём рынка». Глобальный контекст — в материале куда идут голосовые AI-агенты.

Фактор первый: доступ к моделям

Это самое жёсткое ограничение, и оно уже действует. По публикациям на Habr, доступ к аудио-API OpenAI и Google Gemini для российских номеров и юрлиц ограничен. Прокси решает вопрос формально и создаёт два новых: добавляет задержку — при бюджете латентности менее 500 мс по P95 это критично — и порождает риски трансграничной передачи персональных данных.

Локальная альтернатива есть: распознавание и синтез — Яндекс SpeechKit, Salute Speech от Сбера, Tinkoff VoiceKit; языковые модели — GigaChat и YandexGPT. Локальный стек проигрывает в универсальности и выигрывает в предсказуемости: он не отключится по решению чужой юрисдикции. Сравнение — в статье про локальные модели или западные.

Отсев здесь пойдёт по простому признаку: поставщик, у которого вся архитектура держится на одном внешнем API через прокси, зависит от решения, принимаемого не в России и не им. Это не оценка компании, а описание конструкции риска.

Фактор второй: данные внутри России и маркировка

Записи разговоров и транскрипты — персональные данные, а значит, работает 152-ФЗ, включая локализацию: данные россиян должны храниться в базах на территории РФ. С 1 сентября 2025 года (закон № 156-ФЗ от 24.06.2025) согласие на обработку оформляется отдельным документом, а не строкой в пользовательском соглашении. Детали хранения — в статье про 152-ФЗ и запись разговоров.

Медицина0:00
Момент, с которого разговор становится персональными данными: клиент записывается на комплексную проверку зрения, агент уточняет филиал по району, называет стоимость 3 950 ₽ и запрашивает ФИО и дату рождения. На вопрос про рецепт агент отвечает, что его выпишет врач после осмотра, и передаёт запись коллегам для подтверждения времени.

Второе требование — маркировка звонков, действующая с 1 сентября 2025 года (закон № 41-ФЗ, пункт 9.1 статьи 46 закона № 126-ФЗ «О связи», Постановление Правительства № 1300 от 28.08.2025). Юрлицо передаёт оператору связи название организации и категорию звонка, на экране абонента отображается подпись до 32 символов. Для поставщика это означает обязательную интеграцию с операторской инфраструктурой — что потребуется от телефонии, стоит выяснять до договора.

Оба требования ничего не запрещают — они добавляют стоимость соответствия, и небольшой поставщик без российского облака и договорённостей с операторами несёт её тяжелее.

Фактор третий: цена входа

Третий фильтр — экономический. По оценке платформы LPTracker, полная себестоимость минуты качественного AI-звонка — около 14,15 ₽: телефония около 1,65 ₽, распознавание до 5 ₽, языковая модель 4–6 ₽, синтез около 1,5 ₽. По оценке Gravitel, скриптовые роботы на рынке идут по 3–8 ₽/мин, агенты на языковых моделях — по 10–25 ₽/мин.

Отсюда правило чтения любого прайса: ставка 1–3 ₽/мин физически не вмещает языковую модель. Это не жадность и не щедрость, а разные технологии, и дальше они будут расходиться. Что складывается в цену — в разборе стоимости голосового AI-агента.

Глобально тот же отсев описан у Gartner: в пресс-релизе от 25 июня 2025 года сказано, что из тысяч вендоров, называющих себя agentic, реально таковыми являются лишь около 130. Это прогноз по мировому рынку, на Россию он напрямую не переносится, но механика та же.

Что это значит при выборе поставщика сейчас

Практический вывод не в том, чтобы угадать победителя, а в том, чтобы решение пережило три года.

  • На чьих моделях работают распознавание, языковая часть и синтез? С названиями и указанием, где физически выполняется запрос.
  • Где хранятся записи и транскрипты? Нужна юрисдикция, а не слово «в облаке».
  • Что будет, если внешний API станет недоступен? Есть ли запасной стек и сколько занимает переключение.
  • Как реализована маркировка звонков? Через какого оператора и что нужно от вас.
  • Кому принадлежат сценарий, база знаний и записи при расторжении? Это пункт договора, а не вопрос доверия — что ещё смотреть.
  • Можно ли проверить это на пилоте на своих данных? Демо на стенде поставщика не отвечает ни на один вопрос выше.

Полный список неудобных вопросов — в статье как выбрать голосового AI-агента.

Чего этот прогноз не учитывает

Прогноз про отсев может не сбыться в описанном виде, и вот три причины.

Регулирование меняется быстрее рынка. Требования к данным и звонкам за последний год уже менялись; новая норма способна как поднять порог входа, так и снять часть ограничений.

Доступ к моделям — переменная, а не константа. Ограничения могут и смягчиться, и ужесточиться, а обе стороны этого сценария переставляют игроков местами.

Крупные платформы могут поглотить нишу. Если операторы связи и облачные провайдеры включат голосовых агентов в свой пакет, конкуренция сместится на удобство подключения.

И общее ограничение: всё сказанное описывает рынок, а не ваш сценарий. Единственный честный предиктор — пилот на своей базе со своим определением успеха.

Частые вопросы

Кто останется на российском рынке голосовых ИИ-агентов
Прогноз, а не факт: те, у кого решён вопрос с моделями, кто выполняет требования 152-ФЗ по хранению записей в России и выдерживает себестоимость полноценного LLM-агента. Отсев пойдёт по этим трём признакам, а не по качеству презентаций.
Можно ли использовать западные модели для голосового агента в России
С оговорками: по публикациям на Habr доступ к аудио-API OpenAI и Google Gemini для российских номеров и юрлиц ограничен, а прокси добавляет задержку при бюджете менее 500 мс и создаёт риски трансграничной передачи данных. Локальные варианты — SpeechKit, Salute Speech, VoiceKit, GigaChat, YandexGPT.
Где должны храниться записи разговоров с агентом
Записи и транскрипты — персональные данные, и по 152-ФЗ данные россиян хранятся в базах на территории РФ. С 1 сентября 2025 года согласие на обработку оформляется отдельным документом. Это не юридическая консультация: схему хранения стоит согласовать с юристом.
Чем платформа отличается от готового решения
Платформа даёт конструктор и API, а сценарий, базу знаний и интеграции вы делаете сами; готовое отраслевое решение берёт эту работу на себя и стоит дороже. Решает не цена подписки, а наличие внутри компании владельца агента.

Вывод

Российский рынок голосовых ИИ-агентов через три года будет уже, но не потому, что технология разочарует. Сузят его внешние вещи: чей стек моделей доступен, где лежат записи и сколько стоит минута с языковой моделью внутри. Для заказчика отсюда один сдвиг — спрашивать не про функции, а про конструкцию: на чьих моделях, в какой юрисдикции, с каким запасным вариантом. Если хотите проверить конкретное решение на своих звонках — можем собрать демо на вашем сценарии.

Тип поставщика слышно в первом же разговоре

Соберите агента по своему сайту и позвоните ему как клиент — это бесплатно. Полторы минуты покажут, что стоит за словами в презентации: удержание контекста, скорость реакции и поведение вне сценария.

собрать агента бесплатноВведёте адрес сайта — агент соберётся сам. Ему можно позвонить и поговорить.