Apsara 2026 · Контент · октябрь 2026
Нейросеть для видео: куда движется генерация роликов по данным Alibaba
Здесь нет рейтинга бесплатных сервисов. Это разбор того, как в Китае уже делают ролики, сериалы и карточки товаров потоком, и что из этого можно забрать в российский маркетинг.
Артём Борисов - бизнес-консультант, внедрение AI-сотрудников ·
Коротко
Нейросеть для видео в 2026 году - уже производственная линия: модель генерирует кадры, агент планирует раскадровку, а человек утверждает результат. Так это выглядело на Apsara 2026, конференции Alibaba Cloud в Ханчжоу. Ниже разбор пяти секций: модели Qwen-Image и Wan, видеоконвейер WonderClip, генерация видео в реальном времени, модели мира и AI в СМИ. В конце - что из этого применимо к рекламе, роликам для соцсетей и карточкам товаров в России.
Какие нейросети для генерации видео показала Alibaba
Сразу оговорка. Рейтинга «лучших нейросетей для видео» в материалах конференции нет, и я его не составляю. Alibaba показывала свои модели и модели партнёров, сравнений с конкурентами почти не было. Все цифры ниже - заявления спикеров, независимо их никто не проверял.
Qwen-Image-2.1: картинки и правка в одной модели
Открытая модель на 7 млрд параметров, лежит на Hugging Face, ModelScope и GitHub. Генерирует и редактирует, картинку в 2K делает за 1,59 секунды.
ПодробнееСвернуть
Для маркетинга полезнее всего то, что модель умеет без дополнительных сервисов: прозрачный фон, правку по маске и выделению, сохранение товара и лица при редактировании, текст на постерах и интерфейсах, инфографику и раскадровки. Для карточек товаров это ровно тот набор, который сейчас делают руками в фотошопе.
Скорость 1,59 секунды назвал У Чэньфэй из Alibaba, но условия теста (железо, размер пакета) не раскрыты. Лицензию модели в материалах не указали. Следующую версию, Qwen-Image 3.1, пообещали до конца года, на слайдах была только надпись «Coming Soon».
Wan: от пятисекундных роликов к историям
Линейка видеомоделей Alibaba дошла до Wan3.0: синхронный звук, генерация по образцу, 15 секунд многокадрового видео, правка видео по инструкции.
ПодробнееСвернуть
Цзян Вэньтао из Alibaba описал сдвиг так: отрасль уходит от роликов около 5 секунд с одним планом к длинным историям из многих кадров и к рекламе телевизионного уровня. И сразу предупредил: длинный промпт задачу не решает. Модели нужны дополнительные условия - картинка, звук, раскладка кадра, 3D-болванка, траектория камеры, поза героя.
Wan3.0 помечена «релиз 2026.8», но открыта ли она и как получить доступ, в материалах не сказано. Это стоит держать в голове: анонс модели и доступный продукт - разные вещи.
Агент, который готовит задание для модели
Между замыслом и генерацией Alibaba ставит отдельный слой - «агентную подготовку промпта». Он разбирает сюжет, планирует раскадровку и переиспользует персонажей и сцены.
ПодробнееСвернуть
Главная беда генерации видео - персонаж в каждом кадре выглядит по-разному, а сцены не стыкуются. Агентный слой решает это так же, как режиссёр со сценарием: сначала раскадровка, потом список героев и локаций, потом генерация по кадрам с одними и теми же образцами. Человек пишет замысел, агент превращает его в набор точных заданий для модели.
Музыка: Happy Shrimp 1.1
Сервис генерации песен и инструменталов: больше 100 стилей и 10 языков, текст свой или от AI. Канал запуска и статус в материалах не указаны.
«Никакая технология не сделает из плохой истории хорошую.»
Модель задаёт потолок, конвейер - нижнюю планку
Самая полезная мысль про видео на всей конференции прозвучала на секции WonderClip. Цзоу Цзюань, технический эксперт Alibaba, сказал, что генерация видео превратилась из задачи модели в задачу системы. Модель определяет потолок качества кадра, а производственная система - нижнюю границу готового ролика. Иначе говоря, без процесса вокруг даже сильная модель выдаёт лотерею.
WonderClip - платформа AI-видео Alibaba, которая выросла в конвейер: агент, рабочее пространство, раскадровка, «бесконечный холст» и онлайн-монтаж. Роли внутри разделены: один агент планирует, другой исполняет, третий проверяет. У проекта единое состояние - таймлайн, материалы, версии. Платформа открыта через API, CLI и MCP, то есть к ней можно подключить своих агентов. Международная версия вышла из публичного теста, ей пользуются авторы из 30 с лишним стран.
- Skill Studio: удачный процесс на холсте одной кнопкой превращается в навык, а навык публикуется как API. Типовые сценарии - копирование успешного товарного видео, ролик «говорящая голова», переделка сериала для экспорта.
- Отраслевые ограничения зашиты в обвязку агента: бренд в маркетинге, длинный сюжет в сериалах, факты о товаре в e-commerce. Метрики по этим сценариям в материалах помечены «ожидает подтверждения».
- Четыре готовых пакета в офисной платформе на Qwen: AIGC-видео, мини-сериалы, товарные обзоры, новостные ролики. Обещание «с недель до минут» - это заявление компании, замеров не показали.
Мне эта схема знакома по работе с текстовыми агентами: планировщик, исполнитель и проверка - та же мультиагентная система, только на выходе ролик вместо документа.
Сколько стоит AI-видео: ролики и сериалы потоком
Цифры клиентов из трёх секций я свёл в таблицу. Это данные самих компаний, а в одном случае они ещё и расходятся между собой.
| Кто | Что сделали | Результат по их данным |
|---|---|---|
| Сеть почти из 200 ресторанов хого (платформа Kuaizi) | Пакетная нарезка и сборка роликов, 1 фотограф и 1 монтажёр | С 20 до 500+ роликов в день, 500+ аккаунтов. В том же материале «рост производительности 240%», цифры не сходятся |
| Бренд уходовой косметики (Kuaizi) | Единая контент-стратегия, разбор роликов блогеров | Объём контента +52%, 4000+ единиц контента за год |
| Студия AI-сериалов Тяньгун Хуацзин (WonderClip) | Сериалы на экспорт | Серия дешевле с 1 млн до менее 100 тыс. юаней (≈13 млн и 1,3 млн ₽), срок с 2-3 месяцев до 2-3 недель |
| COL с киногородком Хэнцинь | Свой AI-движок для сериалов | Срок производства -80%, стоимость -90%, 50+ AI-аниме-сериалов в 2025 году |
| Xiaoxu Music | Сеть AI-певцов и 50+ аккаунтов | 200 млн+ просмотров за 4 месяца; 90% затрат на вычисления уходит на видео |
На конкурсе компаний из одного человека показали фабрику AI-комиксных драм: больше 10 агентов от сценария до озвучки и правила-«ворота», которые держат единый стиль кадров. Модели там заменяемые, а процесс стабильный. Подробнее про такой формат - в статье о компании из одного человека.
Теперь холодный душ. По данным Сюй Цзинхуэя (Pole Interactive), за полгода в Китае вышло больше 221,9 тыс. AI-сериалов, и только 0,47% из них набрали 100 млн просмотров. Производство подешевело, а попадание в зрителя осталось той же редкостью. Тут спикеры с конвейерами, по-моему, немного увлеклись: дешёвый ролик ничего не стоит, если его никто не смотрит.
Видео в реальном времени, 3D товара и модели мира
Генерация прямо во время показа
Vidu S2 от Shengshu генерирует и показывает видео одновременно, вмешиваться можно на лету: заменить персонажа, примерить одежду, сменить фон. Цена - «от 1 юаня (≈13 ₽) в минуту».
ПодробнееСвернуть
Модель отвечает за сотни миллисекунд, аватар работает без предварительного обучения на конкретном человеке, держит долгий диалог и меняет одежду и фон в процессе. API, демо и технический отчёт открыли сразу при анонсе. Ограничения авторы назвали сами: долгие сложные взаимодействия пока нестабильны.
Для бизнеса это прежде всего виртуальная примерка и живые аватары-консультанты. Готовым массовым продуктом я бы это пока не считал.
3D-модель товара за 15 минут
Сервис Zhenxiang сократил создание 3D-модели товара с 1-5 дней до 15 минут. 3D-обзор товара, по данным Alibaba, поднял конверсию в покупку на 67%.
ПодробнееСвернуть
Там же другие цифры: 3D-«взрыв» товара на детали дал +64% к добавлению в корзину и избранное и +18% к оплате. Размер выборки не раскрыт, так что я читаю это как сигнал, а не как прогноз для своей карточки.
Дешевле генерировать в низком разрешении
Платформа коротких сериалов Dianzhong генерирует видео в 720p и доводит до 1080p AI-апскейлом, вместо дорогой генерации сразу в высоком разрешении.
Модели мира: Happy Oyster 2.0
AI, который отвечает на действия пользователя и помнит состояние мира. Alibaba выпустила только превью, остальная секция - исследования для игр и роботов.
ПодробнееСвернуть
Модель мира работает в цикле «действие - состояние - наблюдение»: вы поворачиваете камеру или двигаете героя, а мир реагирует и не забывает, что было раньше. В бенчмарке HappyWorld-Bench универсального лидера нет, превью Happy Oyster идёт вровень с Genie3. Для бизнеса это горизонт нескольких лет, сегодня здесь покупать нечего.
СМИ и кино: агент исполняет, человек утверждает
На медийном форуме государственные СМИ Китая и кинокомпании описали одну и ту же схему. В CCTV центральный агент раздаёт задачи цифровым сотрудникам: выбор темы, текст, монтаж, вёрстка, проверка, публикация. За человеком остаются замысел, проверка и финальное решение. Учёт ведут по задачам: частота, стоимость токенов, качество.
Самый предметный доклад сделала South China Morning Post: собственный AI-поиск, запущенный 3 августа, дал +120% к использованию поиска. Материал под разные форматы переупаковывает AI, но перед публикацией его проверяет редактор. Киношники сформулировали свои требования к AI: непрерывность кадра, постоянство персонажей, прослеживаемость процесса и чистые права на контент.
Про права стоит прочитать внимательно. Музыкальный лейбл Taihe Music напомнил, что суды по авторскому праву на AI идут в Германии, Дании, Канаде и США, правила не устоялись. Платформа Kuaizi встроила проверку прав прямо в свой видеоконвейер. Для российского бренда вывод тот же: прежде чем лить AI-ролики в рекламу, решите, чьё лицо, чей голос и чья музыка в кадре.
Нейросеть для видео в маркетинге: что забрать российскому бизнесу
Доступ российских компаний к продуктам Alibaba Cloud не подтверждён, поэтому забираем схемы, а не сервисы. Схемы при этом переносятся почти без изменений.
Считайте стоимость пригодного ролика
Формула CreatiSignal: бюджет делим на число роликов, которые реально приняли в работу. 6 000 юаней (≈78 000 ₽) на 15 принятых - 400 (≈5 200 ₽) за ролик, на 30 принятых - 200 (≈2 600 ₽).
ПодробнееСвернуть
Пример учебный, не данные клиента, но формула полезна сама по себе. Генерация дешёвая, а брак дорогой: половина роликов не проходит по бренду, по фактам о товаре или по качеству. Метрика «сколько сгенерировали» ничего не говорит, «сколько приняли» - говорит. Это та же логика, что и стоимость успешной задачи агента.
Карточки товаров - самый быстрый эффект
Прозрачный фон, сохранение товара при правке, инфографика и 3D-обзор - задачи, которые сегодня занимают дизайнера на дни. Начинать я бы стал с них.
Ролики для соцсетей - пакетом, а не поштучно
Ресторанная сеть выросла до 500+ роликов в день с двумя людьми, потому что режет и собирает пакетами по шаблонам. Шаблон и правила бренда важнее модели.
AI-ролик добавляют к своим, а не вместо
По данным TikTok, бренд кружек Meoky добавил AI-ролики к двум своим и получил в 1,8 раза больше покупок, чем контрольная группа, и +13% к окупаемости рекламы.
Если собрать всё в один план: выберите один формат (карточка, товарный ролик или «говорящая голова»), опишите правила бренда текстом, поставьте человека на приёмку и считайте долю принятых роликов. Агент-конвейер вокруг модели собирают так же, как ИИ-агента для любого другого процесса: сначала метрика приёмки, потом инструменты.
Вывод
Нейросеть для генерации видео перестала быть игрушкой для пятисекундных клипов: в Китае на ней делают сериалы на экспорт в 10 раз дешевле съёмок и сотни роликов в день силами двух человек. Но выигрывает не тот, у кого модель лучше, а тот, у кого вокруг модели есть конвейер: раскадровка, правила бренда, проверка человеком и учёт принятых роликов. Для бизнеса в России самый короткий путь - карточки товаров и пакетные ролики для соцсетей. Отдельно решите вопрос прав на лица, голоса и музыку до запуска, а не после первой претензии.
Что сделать
- 1Посчитайте, во что вам сейчас обходится один принятый ролик или одна карточка товара: бюджет делите на число единиц, которые реально пошли в работу.
- 2Выберите один формат контента и запишите правила бренда текстом: цвета, тон, что нельзя показывать в кадре.
- 3Сгенерируйте пробную партию из 10-20 единиц и отметьте, сколько из них человек принял без правок.
- 4Проверьте права на всё, что попадает в AI-ролик: лица, голоса, музыку и чужие видео-референсы.
Частые вопросы
Какая нейросеть для видео лучше?+
Единого лидера на Apsara 2026 не назвали, и рейтинга в материалах конференции нет. Alibaba показала свою линейку Wan до версии 3.0, но доступ к ней не уточнила. Важнее выбора модели процесс вокруг неё: раскадровка, правила бренда и проверка человеком.
Можно ли сделать рекламный ролик нейросетью?+
Да, и в Китае это уже делают потоком: ресторанная сеть выпускает больше 500 роликов в день силами фотографа и монтажёра. Но длинный промпт не спасает, модели нужны образцы, раскадровка и условия по кадру. Готовый ролик перед публикацией проверяет человек.
Сколько стоит сделать видео с помощью ИИ?+
По данным студии Тяньгун Хуацзин, серия AI-сериала на экспорт обходится меньше чем в 100 тысяч юаней (≈1,3 млн ₽) против миллиона (≈13 млн ₽) при съёмке с актёрами. Генерация видео в реальном времени у Shengshu стоит от 1 юаня (≈13 ₽) в минуту. Правильнее считать стоимость одного принятого ролика, а не одной генерации.
Что такое модель мира в нейросетях?+
Это AI, который в реальном времени отвечает на действия пользователя и помнит состояние сцены. Alibaba показала превью Happy Oyster 2.0. Пока это исследования для игр и роботов, а не продукт для бизнеса.
Нужны ли права на контент, созданный нейросетью?+
Правила ещё не устоялись: по словам лейбла Taihe Music, суды по авторскому праву на AI идут в нескольких странах. Китайские видеоплатформы встраивают проверку прав прямо в конвейер. Перед запуском рекламы стоит проверить, чьи лица, голоса и музыка попали в ролик.
Источники
- Apsara Conference 2026, Ханчжоу, 22-24 сентября 2026: секция «Audiovisual Generation: Multimodal Creation and Entertainment» (Qwen-Image, Wan, Kuaizi, Taihe Music, Magnific)
- Apsara Conference 2026: секция «WonderClip: Next-Generation Video Productivity, Powered by Agentic AI»
- Apsara Conference 2026: секция «AI-Native Video Cloud» (Vidu S2, Zhenxiang, Dianzhong)
- Apsara Conference 2026: секция «World Models: AI's Evolution from Digital Worlds to Physical Reality» (Happy Oyster 2.0)
- Apsara Conference 2026: форум «AI + Culture and Media» Technology Development Forum (CCTV, South China Morning Post)
- Apsara Conference 2026: OPC Special Track конкурса «Straight to Wuzhen» (фабрика AI-комиксных драм)
- Пресс-релиз Alibaba о стратегии full-stack AI, 22.09.2026
Об авторе. Артём Борисов - бизнес-консультант, внедряет AI-сотрудников в малом и среднем бизнесе: продажи, документы, учёт, мониторинг. Кейсы с цифрами - на главной странице.
Читайте также
Apsara 2026 · Главное
Apsara 2026: 10 выводов главной ИИ-конференции Китая для бизнеса
Читать →
Apsara 2026 · Соло-бизнес
Компания из одного человека: как основатель работает с ИИ-агентами вместо команды
Читать →
Apsara 2026 · Экономика
Сколько стоит ИИ-агент и как посчитать его эффект
Читать →
Курс Google × Kaggle · Архитектура
Мультиагентная система: когда одного ИИ-агента мало
Читать →
Хотите применить это в своей компании?
Опишите процесс, который съедает больше всего ручного времени. Я покажу, как выглядело бы решение на ИИ-агенте и какие метрики оно изменит.