Что модели разрешено
Наверху публичной страницы статистики здесь может стоять два-три предложения о том, что счётчик делал в этом месяце. Их написала языковая модель. Модель при этом ничего не выдумывает, и устройство, которое делает это правдой, стоит описать — потому что очевидный способ построить эту возможность таким свойством не обладает.
Pi выполняет SQL, решает, какое число достойно упоминания, и пишет запрос. Модель превращает один факт в одно предложение на нужном языке. Затем Pi перечитывает ответ и выбрасывает его, если какая-то цифра в нём не пришла из запроса.
Единственная свобода модели — формулировка. Она не выбирает, не считает, не округляет. Вносит она ровно то, чего не умеют шаблоны: одиннадцать языков, которые при чтении звучат как язык.
Три проверки, и сбой, ради которого существует каждая
Ни одна не родилась из осторожности. Каждая есть потому, что 17 августа 2026 года пошло не так нечто конкретное. Маленькой модели дали два факта об одном счётчике — самый сильный день недели понедельник с 46 %, и 76 % посетителей из Польши при 5 странах — и она написала предложение, в котором самым сильным была среда, а 46 % посетителей приходили из Польши.
Две разные ошибки в одном предложении, и ни одна из них не выдуманное число.
- Каждая цифра должна встречаться в запросе. Это ловит выдуманные числа. Отсюда следствие, которое потом легко сломать: в части с указаниями нет ни одной цифры. Там написано «one or two sentences», никогда «1-2», иначе 1 и 2 стали бы разрешёнными числами в ответе.
- Один запрос на факт. Это ловит перепутанные числа. Те 46 были настоящими — они просто принадлежали другому факту, а проверка по множеству чисел этого не видит. Если модель всегда видит только один факт, путать нечего.
- Имена тоже проверяются. Это ловит понедельник, ставший средой. Имя стоит в факте на языке ответа, оно должно появиться дословно, а его собратья появиться не должны.
Чего они не ловят
Это надо сказать на одном дыхании с остальным. Две вещи проходят.
Предложение, которое без цифр утверждает нечто ложное — «большинство посетителей», когда было 46 % — не ловит ни одна из трёх. Это поглощает сама постройка: оценка уже сидит в том факте, который выбрал Pi, а не в свободе модели.
И предложение совсем о другом, нежели его факт, проходит, пока цифры сходятся. Против этого помогает только модель, которая выполняет указания. Для признаков с именем — день недели, устройство, бот, страница — это дополнительно покрывает третья проверка.
Проверка, ловящая одни лишь выдуманные числа, пропустила бы предложение выше без изменений. Это были настоящие числа не на своих местах, а такой род сбоя виден только тогда, когда смотришь на вывод, а не на замысел.