Ставка на 10 триллионов параметров: ByteDance отказывается от ИИ-дистилляции ради мирового лидерства

Китайские бигтехи пошли ва-банк в битве за ИИ-лидерство. По данным инсайдеров, ByteDance готовится к обучению нейросети с объёмом от 5 до 10 триллионов параметров. Это в два-три раза превосходит текущих локальных рекордсменов вроде Qwen 3.8-Max от Alibaba или Kimi K3. Разрыв между американскими и китайскими моделями практически исчез, и теперь азиатские корпорации переходят к стратегии экстремального масштабирования.
Самая сильная деталь в этой утечке — принципиальный отказ от коротких путей. Основатель компании Чжан Имин прямо запретил команде использовать дистилляцию данных из западных моделей вроде Claude. Обучение на чужих ответах даёт быстрый рост метрик, но математически ограничивает саму разработку — вы лишь приближаетесь к оригиналу, но никогда его не обгоните. Проект отдали главным архитекторам знаменитых рекомендательных алгоритмов ByteDance, дав установку на честное развитие собственной базы знаний и упор на навыки программирования.
Этот масштабный шаг ставит крест на идее глобальной паузы в развитии нейросетей. Пока некоторые западные исследователи обсуждают замедление прогресса из-за нехватки качественных данных, конкуренты продолжают агрессивно давить на газ. В таких условиях любая попытка притормозить будет стоить американским лабораториям технологического доминирования.
Поделиться:
Ещё из архива
Все публикации
Интервью с Владимиром Аюевым: графический язык бигтеха, студия SASHA и дизайн-образование
1 месяц назад
Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных
1 месяц назад
Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft
1 месяц назад
Оптимизация контекста в Claude Code: как работает кэширование промптов и за что мы платим
1 месяц назад
Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG
1 месяц назад