Как создать видео в Wan 3.0

Wan 3.0 — флагманская видеомодель Alibaba и единственная в студии, кроме Seedance 2.5, которая держит сцену до тридцати секунд одним проходом, без склеек. Она сама озвучивает ролик и произносит реплику героя по-русски — достаточно написать фразу в промпте в кавычках. При этом секунда черновика в 480p стоит восемь токенов, то есть эксперименты обходятся дешевле, чем почти у всех соседей. В уроке разбираю форму со слайдером длительности, три режима генерации и показываю три живые генерации: ночной город со звуком дождя, говорящего пекаря и вертикальную рекламу для ленты. Урок 52 бесплатного видеокурса по нейросетям Genosai, 4:34 минут записи в живом кабинете.

Содержание

Видеоурок целиком

Как создать видео в Wan 3.0 — пошаговый гайд, промты и референсы — 4:34

Урок открыт без регистрации. Ниже — то же самое текстом: что разбирается, какие настройки нажимаются и сколько стоит каждый шаг.

Тайм-коды урока

Обзор урока

Герой сделал два шага, камера начала движение — и ролик оборвался: у большинства моделей потолок восемь, максимум пятнадцать секунд. Дальше склейки, а швы между кусками видно всегда. Сегодня — модель, которая держит сцену полминуты без единой склейки.

Ван три ноль — флагманская видеомодель Алибабы, вышла в конце августа. Делает от двух до тридцати секунд одним проходом, звук и речь генерирует вместе с картинкой, держит героя и товар по референсам. И при этом секунда черновика стоит восемь токенов — дешевле почти всех соседей по студии. Разберём форму, цены и три живых результата.

Урок снят в живом кабинете Genosai: на экране те же кнопки и те же цены, которые вы увидите у себя после входа. Ничего не смонтировано задним числом — все результаты в кадре получены прямо во время записи.

Возможности и что вы научитесь делать

Как это выглядит по шагам

В форме три режима генерации: текст в видео, первый и последний кадр, референсы. Разрешения — четыреста восемьдесят пэ, семьсот двадцать пэ и тысяча восемьдесят. Соотношений сторон шесть, включая Авто — модель сама подберёт пропорции под сцену. Длительность задаётся слайдером от двух до тридцати секунд. И отдельный тумблер — генерация аудио.

Цены посекундные и очень честные. Черновик: пять секунд в четыреста восемьдесят пэ — сорок токенов. Тот же ролик в семьсот двадцать пэ — восемьдесят, в Full HD — сто шестьдесят. Полные тридцать секунд в максимальном качестве — девятьсот шестьдесят. Для сравнения: официальный API Алибабы стоит на двадцать процентов дороже за те же секунды.

Первый результат, и обязательно со звуком. Запрос: ночной мегаполис под дождём, неон отражается в мокром асфальте, мимо камеры проезжает жёлтое такси, брызги в замедленной съёмке. Звук я попросил отдельной фразой — шум дождя и далёкий гул города. Слушайте: дорожка пришла вместе с картинкой, за те же шестьдесят четыре токена.

Теперь самое интересное — речь. Реплику героя пишете прямо в промпте, в кавычках, и указываете язык. Модель не только произнесёт её по-русски, но и совместит с артикуляцией. Никакой отдельной озвучки, никакого монтажа дорожек — говорящая сцена приходит готовой за одну генерацию.

Здесь доказательство. Запрос: уютная кухня, пожилой пекарь достаёт из печи противень с круассанами, смотрит в камеру и говорит: «Свежее — только из печи!». И пекарь действительно это говорит — голосом, который придумала сама модель, под потрескивание печи. Это первый дубль, без пересъёмок.

Про контроль. В режиме референсов модель берёт до десяти изображений: герой, товар, стиль — и держит их узнаваемыми всю сцену, у Алибабы эта технология называется Омни-референс. Плюс до пяти аудиофайлов как образец звука. А режим первого и последнего кадра оживляет ваши картинки: пропорции в нём оставляйте на Авто — их задаст сама фотография.

И третий результат — вертикальная реклама для ленты. Капля мёда стекает по стопке панкейков, макросъёмка, мягкий утренний свет, под лёгкую фоновую музыку. Шесть секунд, сорок восемь токенов — столько стоит готовый продуктовый ролик для Рилс в черновом качестве.

Собираем правило. Берите Ван три ноль, когда сцене нужно время — обзор, сторителлинг, промо на двадцать-тридцать секунд. Когда ролик должен прийти сразу со звуком или с русской репликой. И когда важна цена итераций — восемь токенов за секунду черновика прощают много экспериментов. Тридцать секунд одним проходом умеет ещё только Сидэнс два и пять — но её черновая секунда почти втрое дороже.

Пример запроса

Самая частая ошибка — описание из двух слов. Сравните. Так делать не стоит:

красивая картинка

А так модель понимает задачу и повторяет её из раза в раз:

Портрет молодой женщины у окна кафе, мягкий дневной свет, естественная кожа, неглубокая резкость, фотореализм

Порядок слов внутри описания почти не влияет, а вот конкретика влияет сильно: объект, обстановка, время суток, свет, ракурс и стиль. Удачное описание стоит сохранить кнопкой рядом с полем ввода — потом его можно подставить одним кликом и поменять только детали.

Сколько это стоит

И арифметика напоследок. Проба идеи — пять секунд в четыреста восемьдесят пэ, сорок токенов. Ролик со звуком для соцсетей — восемь секунд, шестьдесят четыре. Полуминутный финал в Full HD — девятьсот шестьдесят. Правило студии прежнее: сначала дешёвый дубль, потом один дорогой финал.

В уроке валюта названа кредитами — это то же самое, что токены в кабинете. Один токен равен одному рублю. Цена конкретной работы всегда написана прямо на кнопке запуска, до того как вы её нажали, а неизрасходованный баланс не сгорает.

Сравнение студий и агентов

Разница между студией и агентом — ключевая мысль всего курса. Студия даёт инструмент: вы сами придумываете идею, сами пишете описание и сами собираете куски в целое. Это дешевле и полностью под вашим контролем. Агент даёт готовый продукт: описываете задачу словами, он задаёт вопросы, показывает план и смету, а потом выполняет всю цепочку сам.

Практическое правило простое. Нужен один элемент — идите в студию. Нужен готовый материал под задачу — идите к агенту. Разница в цене есть, но она заметно меньше разницы в сэкономленном времени.

Кому пригодится

Урок для тех, кто выбирает модель под задачу и не хочет платить за перебор. После него понятно, чем эта нейросеть отличается от соседних в списке, на чём она сильна и где её брать не стоит. Это экономит больше всего токенов: самая частая трата новичка — не дорогая генерация, а десять дешёвых, запущенных не на той модели.

Отдельно урок полезен тем, кто делает картинки на поток: карточки товара, обложки, иллюстрации к постам и статьям. Там разница в цене между моделями складывается в заметные суммы за месяц, а качество на однотипных задачах отличается меньше, чем кажется по обзорам.

Ограничения и советы новичку

Описание из двух слов. Нейросеть не угадывает контекст: чем конкретнее задача, тем ближе результат. Работающая формула для картинки — что в кадре, где и когда происходит, какой свет, какой стиль, какие детали. Слова «качественно» и «красиво» можно смело выбрасывать, они не добавляют ничего.

Проверка текста на глаз. Любые надписи, которые нейросеть рисует внутри картинки, нужно перечитывать: даже сильные модели путают буквы в русских словах. Это разобрано в уроке про ChatGPT Image 2 — пока это единственная модель, которой можно доверить точный текст на макете.

Дорогой первый заход. Черновик всегда дешевле гонять на облегчённой модели и в невысоком разрешении, а хорошее качество включать, когда composition уже устраивает.

Как повторить у себя

Порядок для первого раза такой. Зарегистрируйтесь по почте или войдите одной кнопкой через Яндекс либо ВКонтакте — второй способ быстрее, пароль придумывать не нужно. Стартовые токены начислятся автоматически, их хватает, чтобы попробовать несколько генераций и ничего не платить.

Откройте нужную вкладку и повторяйте за уроком шаг в шаг, не меняя настроек. Когда результат совпадёт с тем, что в видео, начинайте подставлять свою задачу — так сразу видно, какая именно правка на что влияет. Готовые файлы никуда не денутся: всё, что вы создали, лежит в истории генераций с поиском по описанию и стоимостью каждой работы.

Ждать у экрана не нужно. Всё считается на сервере: вкладку можно закрыть и заняться другими делами, готовый файл придёт в историю и в уведомления.

Что смотреть дальше

Курс собран по порядку, от простого к сложному, но каждый урок самодостаточен.

Полное оглавление всех уроков — на странице бесплатного курса по нейросетям. Там же текстовая инструкция по кабинету и разбор того, чем студии отличаются от ИИ-агентов.

Если по этой теме нужен не разовый результат, а поток, начните с двух вещей. Первое — урок про фото-студию: там разобрана формула описания, которая работает во всех студиях сервиса. Второе — урок про ИИ-агентов: он объясняет, когда задачу выгоднее отдать агенту целиком, а когда собрать руками в студии и заплатить меньше.

И общий совет по курсу: не смотрите всё подряд. Возьмите блок, который нужен сейчас — фото-модели, видео, тексты, музыку или агентов, — пройдите его с повторением в своём кабинете, и только потом переходите к следующему. Так уроки складываются в навык, а не в список просмотренного.

FAQ

Сколько стоит урок?

Нисколько. Весь курс бесплатный: уроки открыты во ВКонтакте и продублированы текстом на сайте, смотреть можно без регистрации. Платить нужно только за собственные генерации в сервисе, и то после того, как закончатся стартовые токены.

Нужен ли опыт работы с нейросетями?

Нет. Уроки рассчитаны на человека, который открывает сервис впервые: показано, куда нажимать, что писать в описании и где смотреть цену до запуска.

Обязательно ли смотреть курс по порядку?

Не обязательно. Каждый урок самодостаточен, но первые уроки объясняют устройство кабинета и токены — с ними дальше проще.

Сколько идёт этот урок?

4:34 минут. Если повторять за ним в своём кабинете, закладывайте вдвое больше: генерации считаются на сервере от нескольких секунд до минуты.

Нужен ли VPN или зарубежная карта?

Нет. Genosai работает из России напрямую, интерфейс на русском, оплата обычной российской картой, отдельная подписка на каждую нейросеть не нужна.

Урок не устареет после обновления сервиса?

Интерфейс меняется постепенно, а логика остаётся: выбрать модель, описать задачу, проверить цену на кнопке, запустить. Когда изменения заметные, урок переснимается.

Попробовать Genosai в Genosai