ЗДЕСЬ медиа
openrouter.ai

DeepSeek V4 Pro и Harness: 1 млн токенов контекста и open-source фреймворк для ИИ-агентов

В OpenRouter стала доступна модель DeepSeek V4 Pro 0813. Это Mixture-of-Experts архитектура с окном контекста на 1 048 576 токенов. Лимит генерации увеличен до 384 000 токенов на один ответ. Стоимость API держится на уровне $0.43 за миллион входящих и $0.87 за миллион исходящих токенов. Скорость выдачи через балансировщики достигает 67 токенов в секунду.

Релиз модели совпал с выходом DeepSeek Harness. Это open-source среда для разработки автономных ИИ-агентов. Архитектура построена на плагинах. Разработчик подключает модели, инструменты, песочницу и политики доступа как независимые модули. Фреймворк работает как инфраструктурный слой. Он напрямую конкурирует с решениями вроде Claude Code. В документации указана нативная интеграция Harness с семейством моделей V4.

Модель V4 Pro поддерживает потоковую передачу reasoning-токенов. В API можно управлять этим процессом через параметр reasoning. Ответ возвращает массив reasoning_details, показывая цепочку рассуждений до генерации финального текста. При многошаговых сессиях агента этот массив передается обратно в модель. Вызовы идут через стандартный OpenAI-совместимый формат, требуя только замены базового URL.

Поделиться:

Telegram

Ещё из архива

Все публикации