Жёсткие ограничения работают только, если их проверяет код после ответа

Когда в промпте написано «ответ должен быть лаконичным» или «начни с глагола», модель часто это не соблюдает. Попытка вместить жёсткое правило в текст инструкции чаще не срабатывает, чем срабатывает.

Причина проста: модель не может подсчитать слова в процессе генерации и не может проверить свой ответ на соответствие форме. Она может только старться помнить о правиле, но это отвлекает от главной задачи.

Проверка вместо просьбы

Выход — переложить проверку на код. Если нужна ровно одна фраза, можно попросить JSON с массивом вариантов, а потом оставить только первый. Если нужен текст определённой длины, сгенерировать можно длиннее, а потом обрезать или запросить переписку.

Тогда промпт становится проще: модель не зажата в рамки и отвечает качественнее. Финальная проверка гарантирует формат, независимо от того, помнила ли модель о правилах.

Отделение формальных проверок от содержательных инструкций улучшает результат на сложных задачах, где модель должна сосредоточиться на идее.