модуль 7 из 7 · Акт VI · ~35 мин · 7 решений
сцена
Читаю запросы клиентов: «аналитик тратит час на сводку по молочке — хочу спросить словами и получить ответ». Соня, мы же умеем в языковые модели. Ассистента поддержки вон какого построили.
Умеем. Поэтому я принесла две вещи: прототип и причину, по которой его нельзя выпускать.
Она открывает экран. Прототип собран за вечер: LLM получает схему витрин — все три тысячи двести колонок — и вопрос пользователя, пишет SQL, выполняет, отвечает красивым абзацем.
Спрашиваю: «средний чек по молочной категории на юге за квартал». (жмёт Enter) Ответ мгновенный, читается прекрасно. Одна деталь: чек — семь тысяч двести рублей.
Семь тысяч?! За молочку? Там средний чек рублей шестьсот.
Модель сджойнила витрину заказов с витриной B2B-тендеров — колонки называются похоже. Сумма тендера попала в чеки. SQL синтаксически идеальный, семантически — бред. А вот второй запуск того же вопроса: тут она джойнит правильно, но период взяла календарный квартал вместо скользящего. Шестьсот сорок рублей — почти правда. Какому из двух ответов должен верить клиент?
…Оба выглядят одинаково уверенно.
В том и жанр. На учебных базах такие системы отвечают правильно в девяти случаях из десяти — я проверяла на демо-стенде, всё летало. На нашей живой схеме — дай бог один-два из десяти. Разница называется «три тысячи колонок, пять смыслов слова „выручка“ и джойны, которые знает только Аркадий». Продавать это в терминале, который мы год учили честности, я не буду. Но запрос Леры настоящий, и решение у него есть.