Render.ru
Поддержать
10.1 KЗаписей
68.3 KСледят
32.2 MЗаходов
Журналист RENDER.RU

Исчезающие сервисы, шестизначные счета и H.264 вместо EXR: почему студии переносят генеративные модели на своё железо

Интересное из сети

Отраслевое письмо «Open-Weights and American AI Leadership», которое подписали 35 участников, включая Nvidia, Microsoft, Meta, IBM и Hugging Face, вернуло в повестку спор об открытых весах. Авторы говорят о доступности, конкуренции и безопасности через открытую проверку моделей сообществом. На площадке кино- и VFX-производства этот спор выглядит иначе: там модель оценивают по тому, доживёт ли она до сдачи проекта, во что обойдётся её итеративное использование и в каком формате она отдаёт кадры.

Издание fxguide разобрало практическую сторону вопроса вместе с консультантом по генеративным пайплайнам и цветовой науке JD Vandenberg, работавшим ранее в Disney и Netflix. Вывод сводится к тому, что открытые веса дают студиям стабильность версий, контроль над материалом, ограниченную сверху стоимость и возможность встроить генерацию в уже существующий пайплайн — ценой технической экспертизы и собственной инфраструктуры.

Исчезающие сервисы, шестизначные счета и H.264 вместо EXR: почему студии переносят генеративные модели на своё железо
Изображение, сгенерированное локально открытой моделью Z-Image-turbo (открытый Diffusion Transformer). Изображение: Jack Higgins / fxguide

Модель может исчезнуть посреди производства

В продакшене софт не обновляют без необходимости — предсказуемость важнее свежих функций. Генеративные модели живут по другим правилам: их обновляют часто, без предупреждений и без полного списка изменений. Кадр, видео или звук, полученные с тем же входом и тем же сидом, могут измениться, если провайдер не даёт версионированных снапшотов и вы не закрепили конкретный.

Худший сценарий — сервис закрывается за ночь. Именно это произошло с проектом Critterz после того, как OpenAI в марте свернула приложение и веб-сервис Sora: проект пропустил запланированную премьеру в Каннах, сопродюсерам пришлось искать нового партнёра по ИИ, релиз перенесли на начало 2027 года. Тем же объявлением закончилась история анонсированной инвестиции Disney в OpenAI на 1 миллиард долларов и связанного с ней трёхлетнего соглашения о лицензировании персонажей — сделка была публичной три месяца и так и не была финализирована.

Отправить исходники в чужое облако мешает контентная безопасность

Продакшен-сети сегментированы, исходящий трафик жёстко контролируется требованиями MPA и TPN. Отправка исходников в хостируемую модель и загрузка результатов обратно пробивает канал ровно через те барьеры, ради которых контентная безопасность и существует. По этому каналу идут предрелизные материалы, а юридические соглашения работают как компенсация постфактум, а не как контроль. В какой-то момент кто-то должен подтвердить, что инфраструктура провайдера способна удержать такой материал: либо оплатить аудит, либо поверить вендору, который его никогда не проходил. Механизм у студий есть — но оценку TPN прошли лишь единицы поставщиков генеративных сервисов. Локальная модель работает даже в полностью изолированной сети, без передачи данных третьей стороне.

Обратная сторона у локального варианта тоже есть, и fxguide её не скрывает. ComfyUI при всех достоинствах остаётся источником риска: злоумышленник может протащить вирус или червя и в код самой программы, и через открытую экосистему плагинов, а объём кода слишком велик для аудита силами внутренней IT-службы. Специалисты по безопасности в VFX по умолчанию считают открытые генеративные сборки враждебными — особенно когда художники используют собственные устройства и скачанные ими инструменты. Альтернатива — собирать доверенное решение самим, из проверенных открытых библиотек.

Счёт за итерации невозможно посчитать заранее

Генеративное производство итеративно, и предсказать, за сколько попыток модель попадёт в задачу, пока не получается. Показателен короткометражный Air Head, сделанный в 2024 году торонтским коллективом Shy Kids на Sora: супервайзер постпродакшена Patrick Cederberg оценивал, что примерно 90 секунд финального хронометража выросли из «сотен генераций по 10–20 секунд», и называл соотношение исходника к монтажу около 300:1. Он сам отмечал приблизительность подсчёта, и цифры между собой сходятся неточно, но даже по консервативной оценке это больше 80:1. Для игрового кино нормой считается 10:1–30:1, и это соотношение опытная группа умеет прикинуть заранее.

По состоянию на август 2026 года тарифы API держатся в диапазоне примерно 0,05–0,75 доллара за секунду выдачи. Стоимость готовой минуты — это цена секунды, умноженная на плохо прогнозируемый коэффициент. Софтверная индустрия с этим уже столкнулась: в июне один сотрудник финтех-компании из Сан-Франциско за неделю сжёг токенов на 81 267 долларов, разрабатывая игру. В генеративном медиа тот же цикл крутится при заметно более высокой цене итерации. Лимит расходов проблему только перемещает: счётчик остановится посреди эпизода в день сдачи, и вместо доводки шота команда будет ночью согласовывать увеличение бюджета. Локальное железо стоит столько, сколько стоит, независимо от того, сделали вы десять дублей или десять тысяч.

H.264 против EXR: форматы не сходятся

Разрыв между тем, что отдают генеративные сервисы, и тем, что принимает пост-пайплайн, упирается прежде всего в формат. Большинство видеомоделей выдают H.264: 8 бит, 4:2:0, display-referred, чаще всего sRGB. Нет альфы, глубины, криптоматов, scene-linear данных, зато остаётся бандинг, который переживает любую последующую цветокоррекцию. Cederberg отмечал, что Sora вообще не позволял рендерить дополнительные проходы вроде матов или глубины, а Shy Kids генерировали всё в 480p и апскейлили сторонними средствами.

VFX-сдача — это, как правило, EXR: один 4K-кадр half-float на три канала весит около 53 МБ без сжатия, многослойные EXR по 200 МБ на кадр обычное дело, то есть 576 ГБ на двухминутный шот при 24 кадрах в секунду. При таких объёмах облачное хранение и исходящий трафик превращаются в статью расходов, а время передачи — в ограничение расписания. Модель в чужом облаке отдаёт тот формат, который дешевле обслуживать провайдеру; модель на своём железе можно поставить внутрь собственного цветового конвейера и заставить писать то, что пайплайн действительно читает. Проблему в индустрии решают, но разрыв пока большой.

Исчезающие сервисы, шестизначные счета и H.264 вместо EXR: почему студии переносят генеративные модели на своё железо
Изображение, сгенерированное локально открытой моделью Z-Image-turbo (открытый Diffusion Transformer). Изображение: Jack Higgins / fxguide

Железо у студий уже есть — его нужно направить на другую задачу

Большинство видеомоделей выходят в дистиллированных или квантованных вариантах, работающих на одной рабочей станции. Тренд играет в пользу студий: квантизация и дистилляция снижают требования к VRAM быстрее, чем рост числа параметров их поднимает. Vandenberg запускает квантованные и дистиллированные версии большинства актуальных открытых видеомоделей на одной RTX 5090 — потребительской карте с 32 ГБ видеопамяти. В верхнем сегменте RTX PRO 6000 Blackwell с 96 ГБ стоит в рознице около 13 250 долларов, на старте она была ощутимо дешевле.

Главное, что студии, VFX-хаусы и пост-площадки уже владеют значительными GPU-мощностями. Рендер-фермы и парки GPU-станций уже куплены — их остаётся перенаправить на другую нагрузку. Станция колориста с несколькими картами под FilmLight Baselight или Blackmagic DaVinci Resolve вне рабочих часов простаивает, хотя подходит для инференса.

Отсюда вытекает и самый труднодемонстрируемый выигрыш — интеграция. Свою модель можно вызывать из ноды Nuke или плагина Resolve, отправлять задачи в тот же менеджер рендера с той же очередью, приоритетами и логами, что и остальные рендеры шоу, описывать цвет один раз в конфиге OCIO или пайплайне ACES вместо угадывания по каждому клипу, вести версии в той же системе управления ассетами. Хостируемый API можно скриптовать, но он остаётся снаружи пайплайна.

Открытые веса — ещё не открытый код

Перед тем как строить на этом производство, нужно разобраться с лицензиями. Открытые веса означают, что параметры можно скачать, но не гарантируют права дообучать модель, распространять её или использовать результат в коммерческой сдаче. Открытый код в привычном смысле — это лицензия OSI-типа, разрешающая изучать, изменять и распространять исходники. Актуальные открытые модели для видео и звука разбросаны по этому спектру: часть под Apache 2.0, часть под community-лицензиями с ограничениями использования, как минимум одна требует отдельного коммерческого соглашения, некоторые разрешены только для некоммерческого применения. Модель, которая даёт отличную картинку под лицензией, запрещающей коммерческое использование, нельзя положить в сдачу, а конформ — дорогое место для такого открытия.

Большинство ведущих открытых моделей в этой области сделаны за пределами США, а регулирование открытых весов сейчас меняется. Отсюда практический совет: архивировать те веса, которые вы реально используете, а не тянуть их с хаба в момент запуска задачи.

Почему это обсуждение началось именно сейчас

Спор об открытых весах в медиапроизводстве, вероятно, вызрел по совокупности причин, и письмо — лишь его верхний слой. Закрытые модели по API никуда не денутся: локальный запуск нетривиален, и далеко не каждой команде имеет смысл брать на себя собственную инфраструктуру. Но у студий совпало сразу несколько факторов: дефицит GPU и подорожавшая память, из-за которых часть средних компаний всё равно уходит в облако, накопленный опыт проектов, остановленных закрытием сервиса, и разница между тем, как устроен продакшен, и тем, как устроен потребительский ИИ-сервис.

На этом фоне вероятен рост гибридных схем, знакомых по миру открытого софта: веса доступны свободно, а деньги берут за поддержку, коммерческую лицензию и сервис. Для небольших команд это означало бы более доступный вход, для крупных площадок — возможность вернуть генерацию под собственный контроль качества и безопасности. Сложнее всего пришлось бы поставщикам закрытых сервисов, которые не готовы ни проходить отраслевые аудиты, ни гарантировать неизменность версий.

0
Ещё по теме:
MBC открыла игровую студию и ввела в ней запрет на генеративный ИИ
ИИ-дайджест недели
Соло-разработчик строит фехтование от первого лица целиком на физике: меч ведут мышью
Китайские мастера удвоили память старых RTX 3080 для геймеров
ИИ-дайджест недели
Комментарии:0
по поступлению