Сколько стоит разработать приложение с ИИ-ассистентом
Окно чата сделать несложно. Основной бюджет уходит на память, доступ к данным, интеграции, подтверждение действий и обработку ошибок.
Надёжная оценка зависит от реального объёма продукта: ролей пользователей, основных сценариев, интеграций, правил работы с данными, админ-панели, тестирования и требований к запуску. Короткий список функций полезнее универсального прайс-листа, потому что показывает решения, которые меняют объём работ. В калькуляторе Appfyl можно описать именно ту версию, которую вы планируете создать.
Оцените приложение в коротком опросе
НачатьСначала одна понятная задача
Первая демонстрация обычно впечатляет. Пользователь пишет просьбу, нейросеть отвечает уверенно, и на несколько минут кажется, что личный ассистент почти готов. А потом наступает обычный вторник: два календаря показывают разное, встреча уже переносилась, и никто не решил, означает ли команда «передвинь звонок» предложение нового времени или шесть отправленных уведомлений.
Именно здесь чат превращается в настоящий продукт. Он должен понимать, чьи данные читает, какой источник считать актуальным, что можно запомнить, когда спросить разрешение и как объяснить действие, которое выполнилось наполовину. По нашему опыту, эти незаметные правила требуют больше внимания, чем само окно переписки.
Отсюда и разница в стоимости. Составить черновик по вставленному тексту — одна задача. Прочитать календарь, выбрать время, создать встречу и сохранить предпочтение — связанный процесс с правами и последствиями. На короткой демонстрации разница кажется небольшой. Через неделю реального использования она становится очевидной.
Ниже разберем именно такой продукт. Общий расчет затрат на модели, данные и тестирование есть в статье о стоимости разработки приложения с ИИ. Если вы пока выбираете сам сценарий, начните с обзора полезных ИИ-функций для мобильного приложения.
Фраза «ассистент помогает человеку организовать жизнь» хорошо звучит на слайде и совершенно не помогает команде. Другое дело: пользователь диктует заметку о встрече, приложение находит свободное время, предлагает три варианта и добавляет выбранный после подтверждения. Более узкое обещание не делает идею слабее — оно впервые позволяет честно проверить результат.
Другие хорошие задачи для первой версии: отвечать на вопросы по материалам курса, готовить сообщение клиенту с учетом состояния заказа, составлять список покупок по сохраненным предпочтениям или разбирать входящее обращение и передавать его нужному сотруднику.
У каждой задачи должны быть исходные данные, надежный источник, ожидаемый результат и запасной путь. Если в календаре нет свободного времени, ассистент не должен придумывать его. Если в базе знаний нет ответа, лучше показать подходящий раздел или предложить обратиться к человеку.
Затем приходится ответить на неудобный вопрос: ассистент предлагает или делает сам? Подготовить письмо и отправить его — разные уровни ответственности. В первой версии мы обычно оставляем последнее подтверждение человеку, пока не накопятся реальные ошибки. Это не отказ от автоматизации, а нормальный способ не дать ей обогнать доверие пользователя.
Три уровня сложности
| Уровень | Что получает пользователь | Что приходится разрабатывать |
|---|---|---|
| Узкий помощник | Краткий пересказ, классификацию, черновик или ответ из проверенного источника | Экран приложения, подключение готовой модели, набор проверок, ограничения и обычный запасной сценарий |
| Подключенный ассистент | Ответ с учетом профиля, предпочтений, календаря, каталога или системы учета клиентов | Вход в аккаунт, права, поиск данных, память, интеграции, админ-панель и инструменты поддержки |
| Ассистент с правом действия | Отправку, запись, изменение данных или подготовку покупки | Подтверждения, журнал, защита от дублей, отмена, усиленная безопасность и постоянное наблюдение |
Для многих новых продуктов достаточно второго уровня. Ассистент уже понимает контекст и экономит время, но важное изменение остается под контролем человека. Такой подход обычно полезнее, чем попытка сразу создать полностью самостоятельного помощника.
Что находится за окном чата
Надежная система состоит из нескольких отдельных частей. Нейросеть понимает запрос и предлагает ответ или действие. Сервер проверяет пользователя и его права. Память выдает только разрешенный контекст. Подключенные сервисы читают или изменяют данные. Система наблюдения сохраняет результат, ошибку, время и расход.
Критичные правила нельзя оставлять только в инструкции для нейросети. Модель может предложить создать встречу, но проверять аккаунт, параметры, доступ к календарю и подтверждение должен обычный программный код. Если сервис вернул странный ответ, код не должен без проверки передавать его дальше.
Ключи от нейросети и внешних систем нельзя хранить внутри установленного приложения. Их размещают на сервере, где можно ограничить число запросов, убрать лишние данные и заменить поставщика без выпуска новой версии. Подробнее этот слой разобран в статье о стоимости интеграции API в мобильное приложение.
Память должна быть видна пользователю
Ассистент становится удобнее, когда помнит продолжительность обычной встречи, пищевые ограничения или привычный формат отчета. Но нельзя без разбора превращать всю переписку в постоянный профиль. Случайная фраза может оказаться устаревшей, неверной или слишком личной.
Лучше разделить четыре вида информации: контекст текущего разговора, подтвержденные предпочтения, свежие данные из другого сервиса и временное состояние незавершенной задачи. Для каждого вида нужен срок хранения, способ исправления и удаление.
В приложении полезно сделать отдельный экран «Что помнит ассистент». Человек должен самостоятельно удалить старое предпочтение или исправить ошибку. Если ответ получен из документа, урока или заказа, стоит показать источник. Тогда пользователь понимает, где именно нужно обновить информацию.
Практикум Google по персонализированным агентам с памятью показывает несколько уровней памяти вместо бесконечной истории сообщений. Microsoft в материале Guarding AI memory объясняет, почему накопленные сведения становятся отдельной целью для атак.
Для первой версии разумно хранить как можно меньше. Особенно важные сведения лучше сохранять только после явного согласия, а не выводить автоматически из каждой беседы.
Для каждой интеграции нужны четыре границы
Перед подключением календаря, почты, магазина или системы учета клиентов ответьте на четыре вопроса. Что ассистент может читать? Что может предложить? Что может выполнить? Что обязательно должен подтвердить человек?
Так «интеграция с календарем» превращается в конкретный объем работ. Возможно, приложению достаточно читать свободные промежутки и готовить встречу. Доступ к удалению событий и рассылке приглашений тогда не нужен.
Не менее важна обработка сбоев. Внешний сервис может долго отвечать, вернуть старые данные или успеть выполнить операцию после того, как приложение показало ошибку. Каждому изменению нужен уникальный номер, проверка результата и, по возможности, отмена или понятный способ исправления.
В перечне рисков приложений с генеративным ИИ от OWASP есть подмена инструкций, раскрытие конфиденциальных данных, избыточные полномочия и неограниченный расход ресурсов. На практике это означает, что текст с сайта не может расширить права ассистента, ответ модели нужно проверять, а у каждого аккаунта должны быть ограничения.
Оплату, публикацию от имени пользователя, изменение прав и удаление данных не стоит выполнять незаметно. Перед действием приложение должно показать, что именно произойдет, и запросить подтверждение.
Голосовой ввод заметно расширяет проект
Голосовой помощник требует не только кнопки микрофона. Нужны разрешение, запись, распознавание, воспроизведение, возможность перебить ответ и исправить ошибку. Придется проверять работу на улице, в машине, при долгих паузах и плохом интернете.
Голос увеличивает задержку и ежемесячный расход, потому что в задаче участвует больше сервисов. Если общение голосом является главным преимуществом, его нужно проверять уже на прототипе. Быстрый текстовый чат ничего не говорит об удобстве голосового сценария.
Отдельной функцией являются инициативные подсказки. Напоминание, которое пользователь настроил сам, понятно. Ассистенту, который самостоятельно решает прислать уведомление, нужны тихие часы, ограничение частоты и объяснение причины. Для начала лучше использовать конкретные события: приближение встречи, задержку доставки или отклоненную оплату.
Есть идея приложения и нужен трезвый следующий шаг?
Разобрать идею приложенияСколько стоит приложение с ИИ-ассистентом
Appfyl использует ориентиры для полностью разработанного продукта. Это наши ориентиры планирования, а не средняя цена по всему рынку.
Сравнительно компактным остаётся ассистент с одной задачей, готовой моделью, небольшой базой знаний и без опасных самостоятельных действий. Постоянная память, голос, несколько ролей, подписка, админ-панель, календарь и рабочие системы заметно увеличивают объём. Чувствительные данные, множество интеграций, сложные цепочки подтверждений или собственная модель расширяют проект ещё сильнее.
Статья PapAI Soft о стоимости разработки ИИ-ассистента отдельно рассматривает сценарий, интеграции и постоянные расходы. В обзоре Applications.kz о стоимости приложений с ИИ также хорошо видно, что одна ИИ-функция и продукт с собственным контуром данных относятся к разным уровням.
Указанные выше диапазоны относятся к созданию приложения. Использование модели, распознавание речи, поиск, хранение документов, серверы и наблюдение оплачиваются постоянно. Их нельзя прятать в одну условную сумму «нейросеть в месяц».
Как оценить ежемесячные расходы
Сначала посчитайте активных пользователей ассистента, количество задач на человека, число обращений к модели внутри одной задачи и среднюю цену обращения. Затем добавьте голос, изображения, поиск, хранение, сервер, журналы и платные интеграции.
расход в месяц = активные пользователи x задачи x обращения к модели x средняя цена
Нужны три сценария: небольшой, ожидаемый и высокий. Включайте ошибки и повторные попытки. Неудачная задача может несколько раз обратиться к модели и внешним системам, прежде чем предложить написать в поддержку.
Ограничения стоит сделать сразу: число задач на аккаунт, максимальный объем контекста, длина ответа и количество шагов. Для простых проверок можно использовать более дешевую модель. Повторяющиеся ответы из утвержденных материалов можно сохранять, а при необычном росте расхода отправлять предупреждение команде.
Как подготовить первую версию
Соберите от двадцати до пятидесяти настоящих запросов будущих пользователей. Для каждого укажите разрешенные данные, хороший результат, недопустимый результат и момент подтверждения. Это станет набором проверок, который нужно запускать после смены модели, инструкции или источника.
Подключите один источник и одно полезное действие. В образовательном приложении ассистент может отвечать по опубликованным урокам и открывать нужное место. В сервисе записи он может искать время и готовить встречу. Не стоит сразу добавлять почту, покупки и карты только потому, что это возможно.
Измеряйте, сколько предложений приняли, сколько пришлось исправить, сколько действий завершилось, сколько отменили и сколько обращений передали человеку. Большое число сообщений само по себе не говорит о пользе. Иногда оно означает, что ассистент не может понять задачу.
Конструкторы и средства автоматизации ускоряют проверку идеи, но не отменяют учетные записи, права, журнал и восстановление. В практическом материале Anthropic Building effective agents советуют начинать с самого простого надежного решения и не заменять предсказуемый процесс автономным агентом без необходимости.
Персональные данные и доверие
Ассистент может получать сообщения, голос, местоположение, контакты, документы и историю аккаунта. Для каждого вида данных нужно определить цель, передачу поставщику модели, срок хранения и способ удаления. Разрешение на микрофон не означает согласие на постоянное хранение записи.
Проработайте политику конфиденциальности мобильного приложения и проверку безопасности одновременно с устройством сервера. Если продукт рассчитан на российский рынок и обрабатывает персональные данные, отдельно проверьте требования законодательства с профильным юристом. Эта статья не заменяет юридическую консультацию.
Доверие зависит и от интерфейса. Пользователь должен отличать предложение от уже выполненного действия. Для ответа по данным аккаунта полезно показывать источник. Если результат нельзя проверить, ассистент должен честно сказать об этом и открыть обычный поиск, форму или связь с поддержкой.
Как Appfyl оценивает такой проект
Мы начинаем с одной задачи, разрешенных данных и последствий ошибки. В оценке отдельно показываем мобильную часть, сервер, память, источники, интеграции, подтверждения, набор проверок, аналитику и постоянные сервисы. Также записываем, чего ассистент не имеет права делать в MVP.
Опишите задачу в калькуляторе и брифе Appfyl. Укажите, откуда ассистент получает информацию и какое действие должен подготовить. Этого достаточно, чтобы обсуждать реальную первую версию, а не неопределенного помощника «для всего».
Посмотрите, как Appfyl превращает объем работ в запущенные продукты. Смотреть кейсы Appfyl.
Превратите исследование в план запуска
Appfyl поможет превратить идею в понятный план приложения, список функций первой версии и план первых работ.
Обсудить план приложенияГлавные выводы
- Начинайте с одной законченной задачи, которую можно проверить.
- Память, интеграции и права на действия влияют на стоимость сильнее, чем окно чата.
- Важные операции должны проходить проверку и подтверждение человеком.
- Разработку и ежемесячное использование нейросетей нужно считать отдельно.
- Пользователь должен видеть, исправлять и удалять сохраненную о нем информацию.
Полезные ссылки
Частые вопросы
Ежемесячная эксплуатация считается отдельно.
Чаще всего для первой версии не нужна. Готовая модель, сервер с четкими правилами, проверенные данные и набор тестовых задач подходят для большинства ассистентов. Собственную или работающую на устройстве модель стоит рассматривать при доказанной необходимости работы без интернета, особой скорости или контроля.
Только сведения, которые улучшают выбранную задачу и которые пользователь может увидеть, исправить и удалить. Контекст текущего разговора, подтвержденные предпочтения и свежие данные из внешней системы нужно хранить раздельно.
Да, если есть четкие права, проверка на сервере, подтверждение важных действий, защита от повторов, журнал и способ исправления. В MVP обычно безопаснее сначала подготовить действие.
От числа пользователей и задач, обращений к модели, длины контекста и ответа, голоса, файлов, поиска, хранения, серверов, наблюдения и повторных попыток после ошибок.