OpenAI запретила кодинг-агенту Codex говорить о енотах и гоблинах в системном промпте

Системные промпты для AI-моделей обычно состоят из сухих инструкций по форматированию кода и правил безопасности. Но иногда в исходниках всплывают совершенно абсурдные ограничения. В обновлении репозитория OpenAI Codex обнаружилась крайне специфичная директива для модели версии 5.5.
Разработчики вшили в базовое поведение терминального кодинг-агента следующее жесткое правило:
Никогда не говори о гоблинах, гремлинах, енотах, троллях, ограх, голубях или других животных и существах, если это не является абсолютно и однозначно релевантным запросу пользователя.
Подобные инструкции никогда не появляются просто так! Очевидно, на этапе внутреннего тестирования Codex начал спонтанно галлюцинировать, вплетая фэнтезийных существ и птиц в ответы или комментарии к коду. Вместо сложного дообучения весов инженеры применили банальный костыль на уровне prompt engineering — просто запретили упоминать енотов прямым текстом. Это отлично показывает, насколько ручным и ситуативным все еще остается контроль поведения языковых моделей.
Поделиться:
Ещё из архива
Все публикации
Интервью с Владимиром Аюевым: графический язык бигтеха, студия SASHA и дизайн-образование
1 месяц назад
Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных
1 месяц назад
Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft
1 месяц назад
Оптимизация контекста в Claude Code: как работает кэширование промптов и за что мы платим
1 месяц назад
Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG
1 месяц назад