Новые бенчмарки DeepSeek V4 Pro 0813: конец эпохи экстремального демпинга

Аналитики Artificial Analysis опубликовали свежие метрики DeepSeek V4 Pro 0813. Главный инсайт кроется не в скорости выдачи первого токена или объеме контекстного окна, а в радикальном изменении экономики API. Модель подорожала, и теперь математика против OpenAI выглядит совершенно иначе.
Базовые тарифы выросли примерно в 1.5–2.5 раза. Сильнее всего разработчики скорректировали стоимость кэширования — раньше его отдавали почти даром, а теперь это заметная статья расходов при сложных RAG-сценариях. Дополнительную нагрузку создает динамическое ценообразование: в часы высокой активности в Китае прайс умножается на два. Для европейских и московских часовых поясов этот пик выпадает на промежутки с 4:00 до 7:00 и с 9:00 до 13:00. Делать тяжелые запросы к API до обеда стало экономически нецелесообразно.
В сводном индексе интеллекта модель все еще показывает отличные результаты в логике и агентских задачах. Проблема в другом: при новых ценах DeepSeek вплотную приближается к GPT-5.6 Luna по соотношению стоимости и качества. Учитывая, что инфраструктура OpenAI интегрирована в большинство фреймворков по умолчанию, смысл переходить на альтернативное API теряется вместе с исчезновением сверхнизких цен.
Поделиться:
Ещё из архива
Все публикации
Интервью с Владимиром Аюевым: графический язык бигтеха, студия SASHA и дизайн-образование
1 месяц назад
Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных
1 месяц назад
Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft
1 месяц назад
Оптимизация контекста в Claude Code: как работает кэширование промптов и за что мы платим
1 месяц назад
Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG
1 месяц назад