теория
Почему нельзя «просто спросить модель»? Потому что у чисел — худшая статистика отказов во всём жанре генерации.
Замеры на финансовых вопросах отрезвляют: флагманская LLM с доступом к нужным документам неверно ответила или отказалась на 81% несложных вопросов по отчётности; среди ошибок финансового вопрос-ответа больше 65% — числовые: не та величина, не тот порядок, «7222 рубля» вместо «7,22 в тысячах». Модель, пишущая число в свободном тексте, — генератор правдоподобных чисел; правдоподобие и правильность в числах не совпадают почти никогда — у правильного числа нет «почти».
Отсюда первый принцип языкового интерфейса: LLM не считает — LLM вызывает того, кто считает. Знакомая механика пятого акта работает без изменений: инструменты со схемами, структурированный вывод, выбиратель-исполнитель. Новое — что именно считается контрактом (об этом следующий разбор) и куда попадают числа.
Второй принцип: каждое число приходит с паспортом. Ответ ассистента — не абзац с числами внутри, а документ, собранный из проверяемых блоков: число → из какого ряда → какой срез → какой . Тот же паспорт, что у отчётов из тридцать четвёртого модуля, — языковой интерфейс не создаёт новый тип документа, он собирает старый добрый производный документ по устному заказу. Клиент, кликнув на цифру, проваливается в ряд-источник; аудитор через год воспроизводит ответ по винтажу. — это не «попросили модель не выдумывать», это архитектура, в которой выдумке некуда встать.
И третий принцип, самый недооценённый: текст вокруг чисел — законная территория модели. Сформулировать вывод, сгладить формулировки, подобрать сравнение — здесь генерация уместна и хороша. Разделение то же, что во всей платформе: детерминированное ядро, гибкая оболочка. Числа — ядро. Слова — оболочка.