Отвечает за то, чтобы решение пережило смену модели. Восемнадцать лет в разработке, последние пять в системах, где языковая модель одна из деталей, а не вся конструкция. Ввёл в студии правило: слой моделей всегда отдельно от логики.
Модель в приложении живёт не так, как на сайте: у неё жёсткий лимит по времени ответа, счёт за каждое обращение платит владелец продукта, а сторы задают свои правила на всё, что связано с генерацией. Мы встраиваем ИИ так, чтобы функция окупалась и проходила ревью, а не только красиво выглядела на демо.
Не «добавим ИИ», а конкретная функция с измеримым эффектом: меньше отказов в поиске, короче путь до покупки, меньше обращений в поддержку.
Пользователь пишет «что-нибудь тёплое на осень до пяти тысяч» и получает выдачу. Обычный поиск по словам на такой запрос отдаёт пустоту, и это самая частая причина отказа в каталоге.
Отвечает по вашим данным и по состоянию аккаунта: где заказ, что с подпиской, почему списали. Половина обращений в поддержку закрывается прямо в приложении.
Снял чек, документ, счётчик или товар на полке, и приложение само разобрало данные в поля. Убирает ручной ввод там, где он и убивает конверсию.
Диктовка вместо набора и чтение вслух там, где руки заняты: доставка, склад, поле, за рулём. Распознавание работает на русском и на устройстве, без отправки звука наружу.
Подборка под конкретного человека по его истории, а не общий топ продаж. Считаем прирост в целевом действии на контрольной группе, а не на глаз.
Описания карточек, ответы на отзывы, черновики сообщений. Полезно там, где контент делают сами пользователи или где карточек тысячи и руками их не наполнить.
Главное техническое решение, от которого зависят цена обращения, скорость ответа и то, что вы пишете в политике конфиденциальности. Выбираем на первом этапе, а не в конце.
Работает без интернета, обращения бесплатны, данные не покидают телефон. Взамен меньше модель и выше расход батареи. Годится для распознавания речи, фото и коротких подсказок.
Большая модель, качество ответа выше, обновляется без релиза приложения. Взамен платите за каждое обращение и зависите от связи. Годится для ассистента и сложного поиска.
Простое считается на устройстве, сложное уходит в облако, кэш закрывает повторы. Так стоимость обращения падает в разы, и приложение остаётся живым в метро.
Работаем от одной функции. Пять функций сразу это не быстрее, а дороже и с большим шансом, что не взлетит ни одна.
Смотрим на воронку и на обращения в поддержку: где люди отваливаются и что они спрашивают чаще всего. Выбираем ту функцию, где эффект считается в деньгах, а не в вау.
Работающий контур без интерфейса: ваш каталог, ваши документы, ваши запросы. Здесь же считаем стоимость обращения и время ответа на реальном объёме.
Экраны, состояния загрузки и ошибки, поведение без сети, кэш, лимиты на пользователя. Отдельно закрываем случай, когда модель отвечает не то: пользователь всегда может позвать человека.
Правила App Store, Google Play и RuStore на генеративные функции: возрастной рейтинг, жалоба на контент, описание обработки данных. Отправляем на ревью с готовым пакетом, а не после отказа.
Панель: стоимость обращения, доля ответов без человека, время отклика, жалобы. Раз в месяц разбор и подкрутка. Обычно за два месяца цена обращения падает на треть за счёт кэша и маршрутизации.
Сквозной пример на 60 секунд: снимок накладной вместо ручного ввода, работа без сети в подвале склада, цена одного обращения к модели и чек-лист ревью для трёх магазинов. Анимация идёт прямо на странице, без видеофайла и без звука.
Ручной ввод накладной занимает от четырёх до семи минут. Снимок и проверка двух строк укладываются в минуту.
Лимит времени задаётся до разработки. Функция, которая думает четыре секунды, не используется, какой бы умной она ни была.
Функция на модели запускается явным действием пользователя, показывает экран согласия и даёт способ пожаловаться на ответ. Возрастной рейтинг поднимается, если человек видит сгенерированный текст.
Цена обращения и время ответа считаются до разработки. Иначе функция выходит красивой и убыточной.
В демонстрации показана одна функция мобильного приложения от снимка до отчёта за месяц. Кладовщик фотографирует накладную, приложение разбирает четырнадцать строк и честно подсвечивает две, где дописано от руки, вместо того чтобы угадать. Когда на складе пропадает связь, распознавание продолжается на устройстве, а отправка встаёт в очередь. Стоимость обращения к модели считается до разработки: тяжёлое остаётся на телефоне, в облако уходит одна сверка, повторы берутся из кэша. Отдельным шагом показан чек-лист ревью для App Store, Google Play и RuStore: явное действие пользователя, экран согласия и способ пожаловаться на ответ. В конце месяц работы в цифрах: сколько накладных, за сколько отвечает функция и насколько сократился ручной ввод.
Разработка отдельно, обращения к модели отдельно: второе платится провайдеру по факту, и мы показываем эту цифру до старта.
Верх вилки это типичный максимум, а не потолок: точная цифра появляется после диагностики, вместе с расчётом окупаемости.
Те же люди, что и на всём узле «ИИ для разработки». Мобильную часть пишет ваша команда или наши подрядчики, мы отвечаем за модель, серверную часть и за то, чтобы функция прошла ревью.
Отвечает за то, чтобы решение пережило смену модели. Восемнадцать лет в разработке, последние пять в системах, где языковая модель одна из деталей, а не вся конструкция. Ввёл в студии правило: слой моделей всегда отдельно от логики.
Дообучает и оценивает модели, считает, когда своя выгоднее покупной. До студии четыре года в исследовательской группе по обработке текста, две публикации по извлечению фактов из документов.
Ставит модели туда, где они должны жить: в закрытый контур клиента или в российское облако. Семь лет в эксплуатации высоконагруженных сервисов, из них три с GPU-нагрузкой.
Скептически относился к таким компаниям: обычно это демо на пустом репозитории. Здесь агент разбирает наши пул-реквесты по нашим же правилам. Ревью стало приходить за минуты, а не на следующий день. Спорные места он помечает, а не правит молча.
ревью за минуты вместо суток
Документация и тесты по существующему коду, до чего у нас годами не доходили руки. Сделали. Снимаю балл за сроки: сдвинулись на две недели из-за доступов на нашей стороне, но предупредили заранее и план пересобрали.
покрытие тестами legacy-кода
Брали их как подрядчика на кусок, где сами не тянули по срокам. Прототип показали на четырнадцатый день, как и было в договоре. Слой моделей вынесли отдельно. Через два месяца меняли поставщика, логику не трогали вообще.
прототип на 14-й деньПлатит владелец приложения, провайдеру модели, по факту. Порядок цифр такой: короткий ответ ассистента обходится в единицы копеек, длинный разбор документа в рубли. На аудитории в сто тысяч активных пользователей это от нескольких тысяч до нескольких десятков тысяч рублей в месяц. Точную цифру называем после прототипа, потому что она зависит от длины запроса и от доли попаданий в кэш.
Частично. Распознавание речи, разбор фото и короткие подсказки уносим на устройство, они работают в самолёте и в метро. Ассистент и сложный поиск требуют сети: без неё показываем понятное состояние и обычный поиск как запасной путь, а не пустой экран.
Да, если подготовиться. У App Store и Google Play есть требования к генеративным функциям: возрастной рейтинг, механизм жалобы на сгенерированный контент, честное описание обработки данных. RuStore проще, но там свои правила по хранению данных в России. Мы собираем этот пакет до отправки на ревью, а не переделываем после отказа.
Модель на устройстве добавляет от 30 до 300 МБ к весу сборки и заметно греет телефон при долгой работе. Поэтому на устройство уносим только то, что реально требует офлайна и скорости, остальное считается в облаке. Это как раз та развилка, которую разбираем на первом этапе.
Только если вы этого захотите. По умолчанию работаем на российских моделях или на своей, развёрнутой в российском облаке либо в вашем контуре. Персональные данные пользователей до модели вообще не доходят: обезличиваем на своей стороне. Требования 152-ФЗ к хранению закрываем до релиза.
Нет. Функция подключается к существующему приложению: серверная часть наша, в приложении появляются экраны и вызовы. Переписывать имеет смысл, только если приложению много лет и там нет ни модульности, ни тестов, но это отдельный разговор и отдельная смета.
Отвечает только по вашим данным и показывает, откуда взяла. Если уверенности нет, честно говорит, что не знает, и предлагает человека. Плюс на каждом ответе кнопка жалобы, и жалобы попадают в панель качества. Полностью исключить ошибку нельзя, но можно сделать так, чтобы она стоила дёшево.
От 6 до 8 недель от первой встречи до сборки, готовой к ревью. Из них неделя на выбор функции и замер, две до трёх на прототип, три до четырёх на встраивание. Само ревью в сторах занимает ещё от одного до семи дней и от нас не зависит.
Пять направлений и всё, что внутри каждого. Любой узел открывается своей страницей с ценами, сроками и составом работ.
агенты, которые отвечают и действуют вместо человека
смотреть узел→
процессы компании без ручного труда
ИИ внутри вашей разработки и разработка на ИИ
изображения, текст, видео, музыка и дизайн потоком
смотреть узел→
доступ к моделям, надзор, дообучение, свой контур
смотреть узел→
Одна задача обычно идёт через несколько узлов: бот принял обращение, агент разобрал, документ ушёл в 1С. На карте видно, где чей участок и что передаётся дальше.
открыть карту→Расскажите про продукт и аудиторию. Вернём оценку: какая функция даст эффект первой, во что обойдётся обращение к модели на вашем объёме и когда это окупится. Бесплатно, до начала работ.