
Интерфейсы из воздуха и терминал с человеческим лицом
Шесть свежих релизов недели: от генеративных панелей Runway и агентов в Unity до звукорежиссуры промптами.
Привычный софт постепенно избавляется от перегруженных панелей управления. Сегодня проще объяснить системе задачу парой фраз, чем выискивать нужный переключатель: Runway генерирует рабочие интерфейсы без единой строчки кода, аудиоредактор правит дорожку по текстовой ремарке, а живой стрим трансформируется прямо на лету от обычных подсказок.
Мы собрали инструменты, которые стоит потрогать руками уже сегодня — от графической оболочки для вечно сурового Homebrew до Unity, обучающей сторонних агентов собственным правилам разработки. Кажется, рабочая рутина снова сокращается в пользу чистого действия.
Интерфейсы без единой строчки кода от Runway

Клик, перетаскивание карточки — и экран перерисовывается на лету, не обращаясь к верстке или скриптам. Runway показала Solaris: семейство систем Interface World Models, где интерактивные веб-страницы и приложения рождаются кадр за кадром прямо во время взаимодействия. Всю визуальную часть с разрешением 720p строят на базе видеогенератора Gen-4.5 и концепта моделей мира GWM-1. Любое действие пользователя здесь служит сигналом для создания следующего кадра. Чтобы рендерить картинку в реальном времени, инженеры применили дистилляцию шумоподавления, авторегенеративную генерацию и дообучили систему на ее же собственных результатах.
Задачу разделили на два звена: языковая модель понимает намерения человека и задает изменения сцены, а world model берет на себя отрисовку. Привычные компьютерные агенты обучаются на жестко заданном коде и моментально теряются, стоит макету поплыть. Solaris этот костыль отбрасывает. Если верить демо, софт теперь можно просто транслировать как интерактивное видео.
Unity учит сторонних агентов кодить по своим правилам

Дрожащий пиксель-арт, поплывшие глифы TextMeshPro и бесконечная возня с рекламными интеграциями — типичные мелочи, на которые независимый разработчик убивает часы перед релизом. Теперь эту рутину можно сгрузить на внешних AI-ассистентов прямо в терминале: Unity Technologies выкатила официальное расширение для Claude Code и Codex. Инструмент обучает агентов контексту проектов на Unity 6 и выше, опираясь на задокументированные практики самого движка. Модели перестают гадать на кофейной гуще и точечно закрывают задачи по коду: от сборки тайловых палитр и UI до проверки ScriptableRendererFeature и настройки внутриигровых покупок.
Поставить плагин можно консольной командой из каталога подходящей среды или простым клонированием репозитория в папку с пользовательскими навыками; распространяют его под лицензией Unity Companion License. Нас подкупило, что движок наконец-то перестал притворяться вещью в себе и разрешил популярным ассистентам лезть под капот без костылей. Если агент умеет сам чинить графические артефакты и прикручивать рекламу с наградой, то руки у команды наконец дойдут до самого геймплея.
Аудиоредактор на текстовых инструкциях

Вырезать случайный кашель, убрать эхо или переписать слова в припеве, сохранив тембр и мелодию, — теперь это просто текстовая команда. Tencent выкатила в открытый доступ модель AuK на полтора миллиарда параметров. Её обучали на миллионах часов аудиоданных. Вместо разрозненных утилит здесь работает единый интерфейс инструкций: нейросеть правит высоту тона, счищает шум, переводит речь в шепот или генерирует голос с нуля вообще без референсного файла.
Код и веса выложили на Hugging Face под свободной лицензией MIT. Релиз разбили на две версии: базовую для чистового звука и облегченную AuK-Flash с выводом за четыре шага. Нас подкупило внимание к железу — модель запустится через фреймворк MLX на чипах Apple Silicon и поддерживает разгрузку на CPU. Пожалуй, это редкий открытый инструмент, готовый забрать на себя всю черновую работу со звуковыми дорожками.
Живой стрим на поводке у текста

Представьте режиссерский пульт, где вместо микшера и склеек — строка ввода, меняющая происходящее в кадре прямо на лету. Облачная fal.ai добавила в свой каталог модель MiniMax H3 Max Director. Инструмент позволяет управлять непрерывным видеопотоком живыми текстовыми командами в реальном времени. Главная инженерная удача здесь — в цепкости: модель сохраняет внешность героев, декорации и общую сюжетную логику, даже когда автор на ходу переписывает правила игры.
Команда метит в интерактивные трансляции, ситкомы, сатирические новостные выпуски, аниме и игровые симуляции. Всё готово к коммерческому продакшену и подключается через OpenAPI и AsyncAPI. Мы бы попробовали скормить системе генеративный телеканал — пожалуй, это редкий шанс смонтировать эфир до того, как зритель успеет моргнуть.
Черное окно терминала больше не обязательно: Homebrew получил родной интерфейс для macOS

Черный экран терминала годами оставался неизбежным ритуалом для каждого, кто настраивал рабочий Mac под дизайн-код или разработку. В версии 7.0.0 авторы менеджера наконец упаковали консоль в нативное графическое приложение BrewUI. Внутри под капотом тоже перестроили механику: пакеты, зависимости и списки бандлов теперь подтягиваются параллельно, избавляя от унылого разглядывания бегущих строчек прогресса. Заодно утилита научилась проверять софт на уязвимости по свежей базе рекомендаций и строже следить за песочницей macOS — случайный скрипт систему больше не скомпрометирует.
За визуальное удобство и скорость, впрочем, придется заплатить старым железом. Поддержку macOS Catalina похоронили окончательно, а компьютеры на чипах Intel сослали в третий эшелон: готовые бинарные сборки для них больше не держат, заставляя процессор компилировать все вручную до полного отключения в сентябре 2027 года. Нас подкупает смелость этого шага — утилита окончательно признала Apple Silicon единственным будущим платформы.
Миллион токенов на голодном пайке

Восемьсот девяносто байт быстрой памяти HBM на токен — во столько команда DeepSeek-AI уложила аппетиты новой мультимодальной модели DeepSeek-V4.1-Flash. Новинку заточили под агентские сценарии и разбор длинных контекстов вплоть до одного миллиона токенов. Общий вес архитектуры Mixture-of-Experts внушительный — 552 миллиарда параметров. В работе всё устроено тоньше: схема Causal Encoder-Decoder на этапе префилла включает всего 8 миллиардов параметров, а во время генерации задействует 16 миллиардов.
Нас подкупила злая оптимизация железа. Связка квантования KV-кеша в FP4 и технологии сжатия CSA2 с повторным использованием данных между слоями срезала кеш в HBM в четыре раза по сравнению с DeepSeek-V4-Flash. Решение SWA Bounded Replay заодно уменьшило постоянный объем кеша на SSD или в системной памяти примерно в восемь раз. Пожалуй, так работа с гигантскими массивами данных наконец перестает требовать под свои нужды половину серверной стойки.


