Катценберг и человек из Sora: Голливуд хочет свою нейросеть
9 сентября The Information сообщила: Джеффри Катценберг запускает стартап по генерации видео вместе с Биллом Пиблзом и Суджаем Джасвой. Достаточно трёх ориентиров. Катценберг — основатель DreamWorks, человек «Шрека» и «Кунг-фу Панды», бывший глава студии Disney. Пиблз руководил Sora в OpenAI и был одним из авторов архитектуры Diffusion Transformer, на которой выросло целое поколение видеомоделей. Джасва — бывший финансовый директор Dropbox. Компания ещё без имени. Цель заявлена жёстко: не клипы для соцсетей, а модели для профессиональных кинематографистов. Обучать их будут сами. Идут переговоры о крупном раунде, среди возможных инвесторов — Andreessen Horowitz. Ту же историю пересказали Seoul Economic Daily и WebProNews.
Контекст здесь важнее названия. Потребительское приложение Sora закрыли 26 апреля, API доживает до 24 сентября — это уже фиксирует даже Wikipedia. OpenAI свернула «побочный квест» и ушла в код и корпоративные продукты. Пиблз ушёл в апреле и прямо сказал: исследовательским проектам нужно пространство вне основной линейки компании. Теперь это пространство он строит сам — и делает это с человеком, который знает, как устроены студии, гильдии и голливудский страх перед фразой «актёра заменит промпт».
Индустрия до сих пор сопротивлялась: авторские права, дипфейки, цифровые актёры, титры вроде «этот фильм сделали люди». Вход Катценберга — не капитуляция гильдий, а попытка перехватить технологию изнутри. Логика простая: если инструмент делает «свой», его проще вписать в контракты, клиранс и пайплайн. Часть перепечаток путает Пиблза с Тимом Бруксом; исходный репорт и Techmeme называют именно Bill Peebles.
Риск знакомый. У Катценберга уже был Quibi — короткометражный стриминг, который сжёг огромные деньги и закрылся. Сейчас ставка другая: не новая платформа для зрителя, а инфраструктура генерации для тех, кто снимает. Если раунд закроют быстро, это будет самый громкий американский ответ китайским Seedance и Kling после ухода Sora.
Adobe: пять нейросетей прямо в Premiere
8 сентября, накануне выставки IBC 2026 в Амстердаме, Adobe показала то, чего монтажёры ждали два года. В Premiere появился инструмент Generative Media: выделяете дыру на видео- или аудиотроке, описываете, чего не хватает, выбираете модель — и получаете клип уже в разрешении и частоте проекта. Не нужно уходить в браузер, качать ролик не того формата и вставлять его обратно.
На одном тулбаре живут Adobe Firefly, Google Veo, Kling, Runway и Luma. Стоимость в кредитах видно до генерации. Можно собрать недостающий кадр, звуковой эффект, а в бете — музыку и атмосферу. В After Effects вышел публичный ИИ-ассистент: обычным языком можно разгребать проекты с тысячами слоёв и писать выражения, не открывая справочник. Отдельно Adobe обещает разделение наложившихся диалогов, чистку реверба и вырезание чужой музыки. Официальная рамка компании — в этом посте.
Два года нейровидео существовало рядом с монтажом, но не внутри него. Теперь это такая же операция, как переход или цветокор. Adobe при этом не ставит всё на свой Firefly: компания играет роль платформы. Для студий это часто важнее таблиц «кто красивее рисует». Юридический след, привычный софт и скорость правки решают больше, чем лишний балл на зарубежном лидерборде.
Для рынка деталь практическая. Kling и китайский стек и так сидят во многих пайплайнах через агрегаторы. Если выбор модели оказывается внутри Premiere, порог входа для монтажёра падает: не надо собирать зоопарк сервисов вручную. Вопрос только в ценах, лимитах и том, какие модели реально доедут до конкретных регионов.
ByteDance: Чжан Имин personally сел за «мир», а не за ролик
7 сентября Bloomberg написал: Чжан Имин, основатель ByteDance — компании за TikTok и «Дуинь» — лично курирует модель пространственного видео в реальном времени. База — Seedance, уже знакомый многим генератор «киношных» роликов. Возможный запуск — октябрь, сроки могут съехать. Целевые сценарии: гарнитуры Pico, прямые эфиры, короткие драмы и игры. Заявленные цифры — около 20 кадров в секунду и задержка порядка 50 миллисекунд. Считает не гарнитура, а облако.
Это уже другой жанр. Обычная генерация выдаёт готовый кусок: «вот 8 секунд девушки на улице». World model должна держать сцену живой: повернул голову, сказал реплику — мир ответил. Облачный рендер здесь не слабость, а стратегия. Если тяжёлую картинку считает сервер, шлем может быть дешевле и проще. Для ByteDance это стык железа, коротких форматов и облака.
«Миры» у компании — первый из четырёх ИИ-приоритетов на 2026 год. По китайским утечкам, на данные для таких моделей ByteDance тратит в несколько раз больше внутренних лабораторий. Ориентир — не отстать от Google Genie и выпустить хотя бы одну версию до конца года. Чжан с 2021-го не ведёт повседневную операционку. Его возвращение на конкретный продукт — сигнал, что ставка считается почти экзистенциальной.
Для зрителя это может обернуться интерактивными эфирами и «живыми» декорациями. Для производства — новым видом превиза и виртуальных павильонов. Для рынка железа — гонкой, кто дешевле отдаст кадр за 50 миллисекунд.
Disney, камера и привычный зоопарк моделей
7 сентября Marketing Dive снова разобрал рекламный контур Disney: вертикальный формат в духе TikTok для Disney+ и новостей плюс генератор роликов из бренд-материалов и гайдлайнов. Инструмент умеет собирать версии под аудиторию, площадку и контекст. Бета для рекламодателей шла с лета, на этой неделе тема вернулась в отраслевых обзорах. Это не «нейросеть сняла кино». Это фабрика креатива: маленький бренд без бюджета на продакшен собирает ролик для Connected TV из логотипа и старых ассетов.
10 сентября University of Surrey и NVIDIA описали метод обучения, при котором покадровая генерация лучше слушается команд камеры. На коротких и сложных тестах — меньше ошибки в позиции камеры; на роликах около 30 секунд — меньше «уплывания» и больше движения, чем у систем, которые стабильны только потому, что почти не двигаются. Для игр, виртуального продакшена и симуляторов роботов это важнее красивой картинки. Сцена должна ехать туда, куда её послал оператор, а не жить своей жизнью.
В тот же день на vc.ru вышло практическое сравнение текущего стека: Google Omni Flash 1.1, Seedance 2.5, Kling 3.0 и Grok Imagine 1.5. Вывод уже знаком тем, кто собирает ролики каждый день. Omni Flash — черновики, продление сцен, быстрые итерации. Kling — люди, товар, смена ракурсов, речь. Seedance — длинные реалистичные куски и физика. Grok Imagine — оживление фото и короткие вертикальные ролики. «Лучшей модели» нет. Есть слои пайплайна.
Что из этого следует
Главные новости недели описывают одну траекторию. Генерация уходит из чата в цех. Катценберг пытается дать студиям «свою» модель с голливудским лицом. Adobe даёт монтажёру пять движков, не выгоняя его из привычной программы. ByteDance строит не ролик, а мир, который можно крутить в реальном времени. Disney упаковывает то же самое в рекламный кабинет. Исследователи чинят самое слабое место текущих систем — камеру и накопление ошибки со временем.
Иллюстрация: 123RF
Для русскоязычного рынка это читается ещё проще. Рабочая связка и так уже китайско-облачная: Kling, Seedance, Veo через посредников, CapCut, агрегаторы. Новость Adobe важна тем, кто сидит в Premiere. Новость ByteDance — тем, кто смотрит на короткие драмы, стримы и VR. Новость Катценберга — тем, кто ждёт, появится ли на Западе студийная альтернатива после смерти Sora.
Практический вопрос: кто окажется между текстом и готовым кадром — монтажная программа, китайское облако или редкий голливудский стартап с правильной родословной? Ближайшие недели покажут, станет ли проект Катценберга реальным игроком или ещё одним громким раундом и успеет ли ByteDance превратить 50 миллисекунд задержки в продукт, а не в презентацию.
Ранее мы рассказывали о том, что студии начали торговаться за персонажей, модели научились вести камеру как оператор, а скорость расчёта впервые обогнала просмотр.


 (1)_6aabbd347cab3.jpg)

_6a8da160660d0.jpg)


