Жёсткие ограничения работают только, если их проверяет код после ответа
Когда в промпте написано «ответ должен быть лаконичным» или «начни с глагола», модель часто это не соблюдает. Попытка вместить жёсткое правило в текст инструкции чаще не срабатывает, чем срабатывает.
Причина проста: модель не может подсчитать слова в процессе генерации и не может проверить свой ответ на соответствие форме. Она может только старться помнить о правиле, но это отвлекает от главной задачи.
Проверка вместо просьбы
Выход — переложить проверку на код. Если нужна ровно одна фраза, можно попросить JSON с массивом вариантов, а потом оставить только первый. Если нужен текст определённой длины, сгенерировать можно длиннее, а потом обрезать или запросить переписку.
Тогда промпт становится проще: модель не зажата в рамки и отвечает качественнее. Финальная проверка гарантирует формат, независимо от того, помнила ли модель о правилах.
Отделение формальных проверок от содержательных инструкций улучшает результат на сложных задачах, где модель должна сосредоточиться на идее.