Google стучится в Голливуд
В конце августа Los Angeles Times сообщила: представители Google ведут переговоры с Disney, Universal и Warner Bros. Discovery о лицензиях на каталоги и героев для своих моделей. Формальных контрактов нет. Ту же линию подтвердил The Verge. Оценка с рынка, которую приводит AI Weekly, — около 40 млн долларов за одного персонажа; пакет на сотню героев уходит в миллиарды. Студии могли бы ещё делить рекламную выручку с роликов на YouTube.
Universal публично заявила, что «активных переговоров нет». Главные тормоза — авторское право и профсоюзы: ни одна крупная студия не уведомила SAG-AFTRA (американский профсоюз, представляющий интересы работников медиаиндустрии, прим. Ред.) о такой лицензии, хотя контракт этого требует. Без «живого» голливудского материала, говорят отраслевые источники, инструменты Google не потянут полный производственный цикл — от предварительной визуализации до показа в зале.
Контекст понятен. Сделка Disney с OpenAI на персонажей для Sora развалилась вместе с самим сервисом, пишет Times of India: приложение закрыли 26 апреля, программный доступ к модели отключают 24 сентября. Тот же график закрытия фиксирует Pictory. Google пытается занять пустоту и заодно переучить видеомодели на материале, которого нет в открытой сети. В колонке The Verge это сформулировали жёстче: корпорации лицензии нужны больше, чем студиям — её модели.
Минута видео и камера как инструмент
Компания World Labs Ли Фэйфэй представила Atlas — единую модель «мира»: текст, картинка, видео и объём в одном контуре. Не лотерея по текстовому запросу, а траектория камеры как геометрический вход. Русскоязычный разбор дало издание «Квантовый бит», технический — The Decoder.
Что обещают на практике: ролик до минуты в разрешении 1440p с точным движением камеры; сборка сцены в объёме из одной или нескольких фотографий, перекомпоновка уже снятого материала и сценарии «из реальности в симуляцию» — для визуальных эффектов и для роботов. В одном из роликов команда задала путь камеры вручную и получила минутный клип из семи опорных кадров. По данным AlphaSignal, в слепых сравнениях люди чаще выбирали Atlas, чем MiniMax H3, Gemini Omni Flash и Seedance 2.5 — особенно на сложных пролётах.
Бумаги, цены и список партнёров при запуске не опубликовали. Ранний доступ — по заявке. Для площадки это важнее «ещё одной красивой картинки»: операторский контроль вместо угадывания формулировки. Эффект «пулевого времени» из нескольких кадров — про превиз, виртуальные декорации и досъемку без повторного выезда группы.
Почти одновременно вышел открытый контур SolarWM: 1,43 млн клипов, десятки терабайт данных, рецепты обучения и веса моделей от 5 до 33 млрд параметров на базах Wan 2.2, LTX-2.5 и MiniMax H3. Сводка — у AI Weekly, статья — на Hugging Face. Обучали на пятисекундных кусках, раскатать обещают минуты и часы с управлением камерой в реальном времени. H3-World при поддержке Tencent ту же 33-миллиардную H3 превращает в интерактивный мир с командами на обычном языке. Смысл для производства один: сцена перестаёт быть коротким клипом и становится пространством, по которому можно вести камеру.
Черновик в мгновение ока
Платформа fal вывела в работу H3 Max — дообученную версию открытой MiniMax H3. Пять секунд ролика в 768p считаются примерно за 2,5–3 секунды, то есть быстрее, чем их смотрят. По оценке компании в официальном сообщении, это примерно в 35 раз быстрее официального доступа к той же базовой модели. Звук пишется вместе с картинкой.
На этой скорости появился режим непрерывной ленты: сцены меняются командой в чате, персонажи и локация держатся от кадра к кадру. Разбор режима дал Latent Space, рабочие параметры — в руководстве fal. Это уже не «заказал клип — подождал», а черновик в прямом эфире: раскадровка, рекламный тест, интерактивный сюжет. После стартовой скидки секунда обходится примерно в 5–8 центов в зависимости от разрешения. Полные 2K и 4K остаются у базовой H3.
Google чуть раньше отдал разработчикам обновление Gemini Omni 1.1 Flash, пишет 3DNews: первый и последний кадр, продление сцены кусками по 10 секунд до 40 секунд суммарно, вывод в 4K. Обычным пользователям в приложении пока обещают только удлинение сцены. Похоже, рынок сходится к одному требованию: не «сделай красиво», а «держи начало, конец и движение камеры».
Звук больше не второй заход
Команда DreamX выложила на GitHub рамку совместной генерации звука и видео в 2K: картинка и дорожка считаются вместе, затем отдельный блок поднимает разрешение за один проход. Для монтажа это убирает привычную процедуру «сначала ролик, потом озвучка».
Отдельный прикладной замер — DramaChain: по сводке AI Weekly прогнали 60 коротких драм, сделанных с помощью моделей, и показали, что брак на ранних этапах (сценарий, персонаж, первый кадр) бьёт по оценке сильнее, чем «красивый» финальный рендер. Вывод скучный, но полезный: экономить нужно на последнем проходе, а не на постановке.
Конвейер, а не эксперимент
На этом фоне Китай закрывает петлю от клипа до полнометража. В конце августа Alibaba вывела Wan 3.0, сообщает NDTV Profit: до 30 секунд из презентации, таблицы или страницы сайта — готовый черновик для рекламы и короткой драмы. На Douyin, по данным Financial Times, которые приводит тот же AI Weekly, в мае 89 из 100 топ-анимационных драм были сделаны с участием ИИ.
36Kr фиксирует следующий шаг: Tencent Video уже показывает полнометражный фильм, собранный в этом контуре, студии вроде Dreamina ищут проекты от 90 минут. Команды из пяти человек закрывают двухчасовой фильм за полтора месяца и сотни тысяч юаней.
Итого — ИИ в видео уже не «вау» на восемь секунд. Это спор за каталоги Голливуда, управляемая камера и конвейер, который считает быстрее, чем зритель моргает. Следующий вопрос уже не технический: кто поставит подпись под лицом на экране и кто заплатит за минуту экранного времени.
Мнение автора может не совпадать с мнением редакции
Фото: 123RF


_6aa028b889887.jpg)




