OpenAI снизила цену GPT-5.6 Luna на 80% после автономной оптимизации серверов самой нейросетью

В последнем обновлении прайсинга GPT-5.6 кроется прецедент, меняющий экономику разработки агентов. OpenAI поручила старшей модели Sol автономно переписать production-ядра собственных серверов. Нейросеть самостоятельно ставила эксперименты по генерации токенов, что снизило стоимость обслуживания инфраструктуры на 20% и ускорило инференс на 15%. Полученную вычислительную экономию компания напрямую конвертировала в агрессивный демпинг на младшие модели.
Базовая gpt-5.6-luna подешевела сразу на 80%. Теперь миллион токенов на вход стоит $0.20, а на выход — $1.20. По данным разработчиков, в специализированных бенчмарках Luna обходит Fable 5, снижая итоговую стоимость выполнения профессиональной задачи на 99%. Сбалансированная версия Terra скинула 20% цены — до $2 на вход и $12 на выход.
Флагманская Sol сохранила базовую цену, но получила режим Fast mode. За двойную плату API ускоряет выдачу в 2.5 раза без потери качества — опция работает обратно совместимо для запросов со старым тегом priority. Такой экстремальный разброс цен между Luna и Sol окончательно закрепляет паттерн многоуровневого роутинга в приложениях: тяжелая модель формирует архитектуру решения и разрешает логические конфликты, а сверхдешевая Luna за копейки пишет код, прогоняет тесты и выполняет рутинную обработку массивов данных.
Поделиться:
Ещё из архива
Все публикации
Интервью с Владимиром Аюевым: графический язык бигтеха, студия SASHA и дизайн-образование
1 месяц назад
Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных
1 месяц назад
Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft
1 месяц назад
Оптимизация контекста в Claude Code: как работает кэширование промптов и за что мы платим
1 месяц назад
Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG
1 месяц назад