Tencent представила WorldClaw: генерация редактируемых 3D-сцен из текста с помощью ИИ-агентов

Tencent показала WorldClaw — фреймворк, который собирает полноценные 3D-сцены по текстовому запросу. В отличие от генераторов видео или 3D Gaussian Splatting, на выходе получается редактируемая геометрия. Ландшафт, материалы и объекты существуют как независимые меши. Их можно сразу импортировать в игровые движки или редакторы.
Архитектура работает на базе ИИ-агентов. Планировщик переводит промпт в строгую спецификацию: размечает регионы, типы рельефа и плотность ассетов. Затем система генерирует карту высот через процедурные шумы и семантическую разметку. Для сложных зон отдельные агенты создают текстурированные 3D-модели и расставляют их с учетом ландшафта.
Ключевая деталь пайплайна — цикл визуальной проверки. Агенты рендерят сцену с разных ракурсов, анализируют кадры и корректируют ошибки. Система автоматически исправляет масштаб объектов и приземляет висящие в воздухе модели. Такой подход исключает пересечение геометрии и делает генерацию миров прикладным инструментом для левел-дизайна.
Поделиться:
Ещё из архива
Все публикации
Интервью с Владимиром Аюевым: графический язык бигтеха, студия SASHA и дизайн-образование
1 месяц назад
Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных
1 месяц назад
Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft
1 месяц назад
Оптимизация контекста в Claude Code: как работает кэширование промптов и за что мы платим
1 месяц назад
Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG
1 месяц назад