Короткие ролики
WAN соберёт клип на пять или десять секунд по описанию сцены, сразу со звуком и в разрешении вплоть до 1080p, в горизонтальном или вертикальном формате.
Создавайте короткие видео из текста или фотографии сразу со звуком и синхронной речью. Через SpeShu.AI нейросеть WAN работает на русском языке без VPN и оплачивается в рублях.
WAN соберёт клип на пять или десять секунд по описанию сцены, сразу со звуком и в разрешении вплоть до 1080p, в горизонтальном или вертикальном формате.
Предмет демонстрируется в динамике: поворот, распаковка или работа устройства, и для этого не нужны съёмочная группа, студия и оборудование.
Замысел будущего ролика проверяется на дешёвых итерациях: ритм, ракурсы и настроение видно ещё до выезда на площадку и найма подрядчиков.
Персонаж произносит заданный текст, и артикуляция совпадает с речью, потому что звук генерируется вместе с картинкой, а не накладывается отдельно.
Загрузите два изображения: с чего ролик начинается и чем заканчивается. WAN строит движение между ними сам, но приходит именно в тот кадр, который вы задали. Так снимают трансформации, превращения «до и после» и переходы между сценами, где важен точный финал.

Передайте ролик-образец и своё изображение. Модель считывает характер движения и камеры из образца и переносит его на ваш кадр. Это способ получить нужную динамику, когда описать её словами сложно, а пример под рукой есть.

Опишите сцену и передайте текст, который персонаж произносит. WAN генерирует видео вместе с речью и попадает в артикуляцию, а фоновые шумы подбирает под обстановку. На выходе готовый клип, который не нужно сводить со звуком в монтажной программе.

SpeShu.AI позволяет пользоваться WAN из России без отдельной зарубежной подписки, VPN и поиска иностранного способа оплаты.
WAN — семейство моделей генерации видео от команды Wan AI компании Alibaba. Оно создаёт короткие ролики из текстового описания или фотографии и делает это вместе со звуком: речью, шумами и музыкой. Веса моделей открыты, поэтому WAN разошёлся по десяткам сторонних платформ и стал самым доступным способом получать видео приличного качества.
Главное отличие — контроль. WAN позволяет задать не только стартовый кадр, но и финальный, а также перенести движение из готового ролика-образца. Второе отличие — цена: генерация обходится в разы дешевле закрытых конкурентов, поэтому вариантов можно перебрать больше. Третье — открытые веса под лицензией Apache 2.0.
Веса модели скачиваются свободно, а площадки с WAN из России обычно открываются. Сложность в другом: интерфейсы не переведены на русский, оплата генераций проходит зарубежной картой, а для локального запуска нужна мощная видеокарта. Через SpeShu.AI нейросеть WAN доступна на русском с оплатой в рублях.
Для работы через SpeShu.AI VPN не нужен: сервис открывается с российского IP в собственном интерфейсе. Сторонние площадки с WAN тоже чаще всего доступны без VPN, но упираются в оплату кредитов иностранной картой.
Стандартная длительность ролика в WAN — пять или десять секунд, разрешение до 1080p, пропорции горизонтальные, вертикальные или квадратные. Для длинного сюжета клипы собирают последовательно, задавая финальный кадр предыдущего фрагмента стартовым для следующего.
Да. Звук генерируется вместе с изображением в одном проходе, поэтому движение губ совпадает с репликами без отдельной синхронизации. Помимо речи модель добавляет фоновые шумы и музыкальные подложки под характер сцены.
Пользователь пополняет баланс SpeShu.AI в рублях, в том числе через СБП. Затем средства списываются в зависимости от фактического использования нейросети.
Не нужно оформлять отдельную подписку WAN или искать зарубежную банковскую карту
Откройте WAN через SpeShu.AI без VPN и оплачивайте только фактическое использование в рублях. Для первого запроса достаточно выбрать нейросеть и описать свою задачу.
WAN — семейство моделей генерации видео от команды Wan AI компании Alibaba. Оно собирает короткие ролики из текстового описания или фотографии, причём звук рождается вместе с картинкой: речь, шумы и музыка в одном проходе. Веса выложены под лицензией Apache 2.0, поэтому модель разошлась по десяткам сторонних платформ и стала самым доступным способом получать видео приличного качества.
Главное отличие WAN от других видеомоделей — возможность задать не только стартовый кадр, но и финальный. Движение между ними модель строит сама, но приходит именно в тот кадр, который вы указали. Дополнительно можно передать ролик-образец, и характер камеры перенесётся на ваш материал. Так снимают трансформации, переходы и сюжеты «до и после», где важен точный результат, а не случайная траектория.
Стандартный ролик длится пять или десять секунд, разрешение доходит до 1080p, пропорции горизонтальные, вертикальные или квадратные. Для длинной сцены фрагменты собирают последовательно, задавая финальный кадр предыдущего стартовым для следующего. Стоимость генерации у WAN одна из самых низких на рынке, поэтому идею можно проверить в десятках вариантов, а не беречь каждую попытку.
Площадки с моделью обычно открываются, а веса скачиваются свободно, но интерфейсы не переведены, оплата идёт зарубежной картой, а локальный запуск требует мощной видеокарты. Через SpeShu.AI нейросеть WAN работает на русском без VPN и без своего оборудования. Описание сцены задаётся по-русски, а движение камеры полезно оговаривать отдельно от сюжета.
Под разные видеозадачи подходят разные модели: WAN берут за контроль кадров и цену итераций, Veo — за качество картинки, Sora — за сложные сюжетные сцены, Grok Imagine — за скорость. В SpeShu.AI они доступны в одном интерфейсе с общим балансом, поэтому один и тот же замысел можно проверить на нескольких моделях.