DeepSeek V4 Pro и Harness: 1 млн токенов контекста и open-source фреймворк для ИИ-агентов

В OpenRouter стала доступна модель DeepSeek V4 Pro 0813. Это Mixture-of-Experts архитектура с окном контекста на 1 048 576 токенов. Лимит генерации увеличен до 384 000 токенов на один ответ. Стоимость API держится на уровне $0.43 за миллион входящих и $0.87 за миллион исходящих токенов. Скорость выдачи через балансировщики достигает 67 токенов в секунду.
Релиз модели совпал с выходом DeepSeek Harness. Это open-source среда для разработки автономных ИИ-агентов. Архитектура построена на плагинах. Разработчик подключает модели, инструменты, песочницу и политики доступа как независимые модули. Фреймворк работает как инфраструктурный слой. Он напрямую конкурирует с решениями вроде Claude Code. В документации указана нативная интеграция Harness с семейством моделей V4.
Модель V4 Pro поддерживает потоковую передачу reasoning-токенов. В API можно управлять этим процессом через параметр reasoning. Ответ возвращает массив reasoning_details, показывая цепочку рассуждений до генерации финального текста. При многошаговых сессиях агента этот массив передается обратно в модель. Вызовы идут через стандартный OpenAI-совместимый формат, требуя только замены базового URL.
Поделиться:
Ещё из архива
Все публикации
Интервью с Владимиром Аюевым: графический язык бигтеха, студия SASHA и дизайн-образование
1 месяц назад
Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных
1 месяц назад
Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft
1 месяц назад
Оптимизация контекста в Claude Code: как работает кэширование промптов и за что мы платим
1 месяц назад
Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG
1 месяц назад