Wan 3.0 · новая модель Alibaba
Wan 3.0 из России в 2026: видео 30 секунд со звуком из PDF
6 августа 2026 Alibaba Tongyi Lab открыла публичную бету видеомодели Wan 3.0, а 24 августа объявила о полном запуске. Модель собирает ролик до 30 секунд со звуком за один проход и умеет строить видео из документа - PDF, презентации или веб-страницы, а не только из текста и фото
К концу статьи ты будешь знать: что Wan 3.0 реально умеет по официальным данным, а что раздувают пересказы, откуда в ролике звук, как модель работает с PDF и презентацией, сколько это стоит по официальному прайсу и что мешает оплатить это из России. Официальную документацию Alibaba Cloud Model Studio и главную страницу модели я проверил живым запросом 05.09.2026 - обе открылись без VPN. Если тебе нужен сервис для генерации видео из простого текстового описания без документа на входе - подборка шести сервисов с ценами есть в отдельном гайде нейросети для видео: 6 сервисов и цены
Открой официальную страницу wan.video и карточку модели в документации Alibaba Cloud Model Studio - там прямо написано, за что платишь: секунды видео и разрешение, а не абстрактная подписка, и дальше в статье разобрано, что нужно для оплаты из России
Что такое Wan 3.0 и чем он отличается от прошлой версии
Wan - линейка видеомоделей китайской Alibaba, а тройка - это её новое поколение, объявленное официально 24 августа 2026 после публичной беты с 6 августа
Официальная карточка модели на портале Alibaba Cloud Model Studio (документация обновлена по метке на странице 1 сентября 2026) описывает Wan 3.0 одной фразой: модель принимает на входе текст, картинку, видео, звук, файл и ссылку, а на выходе всегда отдаёт видео. Раньше нейросети для видео умели что-то одно - либо текст в ролик, либо фото в ролик. Wan 3.0 собирает все эти входы в одной модели и добавляет то, чего у прежних версий не было: файл и ссылка как самостоятельный источник для видео
Видео до 30 секунд - что это значит на практике
Максимальная длина одного ролика выросла до 30 секунд за один проход - в два раза больше, чем у предыдущей версии Wan
Раньше нейросети для видео отдавали ролик на 4-8 секунд, и чтобы собрать что-то длиннее, приходилось клеить несколько коротких клипов вручную в видеоредакторе. Wan 3.0 удерживает персонажа, обстановку и движение цельными на всём протяжении 30 секунд без склейки - по крайней мере так заявляет сама модель на плашке «Native 30s: more complete storytelling». Разрешение при этом можно выбрать - 480P, 720P или 1080P, и чем оно выше, тем дороже стоит секунда (раздел про цену ниже)
30-секундный ролик - это уже не короткая заставка, а полноценная сцена с завязкой и развязкой. Для рекламного ролика или обучающего видео этого может хватить целиком, без склейки нескольких генераций
Звук в том же проходе, а не наложен отдельно
Слово «со звуком» в заявлениях про Wan 3.0 означает не отдельную звуковую дорожку, добавленную поверх готового видео, а звук, который модель придумывает вместе с картинкой за один и тот же проход
Официальная страница модели описывает это как «Immersive Experience: elevated realism, texture, and sound design» - улучшенный реализм, текстура и звуковой дизайн идут одним пунктом, не двумя разными функциями. Это отличает Wan 3.0 от сервисов, где видео рождается немым и озвучка добавляется отдельным шагом в другом инструменте: здесь шум, музыка или реплики уже встроены в результат, когда он готов
Это не значит, что звук всегда идеально попадает в смысл сцены - модель всё ещё генеративная, и результат стоит проверять на слух, а не принимать на веру по одной фразе с сайта разработчика
Видео из PDF и презентации: как это работает
Функция называется Omni-Reference, а на самой странице модели подписана как Omni-Creation - именно она отвечает за сборку видео из документа
Официальная страница wan.video описывает её дословно: «Omni-Creation - up to 20 reference assets, with document and webpage parsing» - до 20 файлов-подсказок одновременно, включая разбор документов и веб-страниц. По независимым техническим разборам запуска (не с сайта самой Alibaba, а из отраслевых изданий, читавших релиз параллельно со мной) модель принимает документы форматов doc, xls, ppt, pdf, txt и md, а также ссылку на веб-страницу, с ограничением по размеру - до 100 мегабайт или 50 страниц на один файл
Этот кусок вынесен в отдельный гайд LTX Studio: видео из фото за 6 шагов маршрута
Если у тебя уже готова презентация с текстом и картинками для питча или урока, её можно скормить модели целиком, и она сама решит, какую сцену показать под каждый смысловой блок документа - без того, чтобы вручную переписывать содержимое в текстовый промпт кадр за кадром
Какие форматы документов понимает модель
Функция Omni-Creation не берёт любой файл подряд - у неё свой список форматов и ограничение по размеру:
| Формат документа | Понимает Wan 3.0 | Что это на практике |
|---|---|---|
| да | презентация, инструкция, брошюра в готовом виде | |
| PPT (презентация) | да | слайды с текстом и картинками для питча или урока |
| DOC | да | текстовый документ с описанием сценария |
| XLS (таблица) | да | данные и цифры, которые нужно превратить в наглядную сцену |
| MD (markdown) | да | текстовые заметки в простом формате без вёрстки |
| Веб-страница по ссылке | да | лендинг или статья вместо файла на диске |
Таблица прокручивается вбок →
Официальный лимит на один файл - до 100 мегабайт или 50 страниц (независимые технические разборы запуска, раздел «Источники»). Одновременно модель принимает до 20 файлов-подсказок сразу, а не по одному
Сколько стоит Wan 3.0 по официальному прайсу
Готовой бесплатной версии у Wan 3.0 нет - по документации Alibaba Cloud Model Studio оплата идёт за каждую секунду сгенерированного видео, и цена растёт вместе с разрешением
Официальный тариф для международных регионов (Сингапур, Япония, Германия, США): 480P стоит 0,05 доллара за секунду, 720P - 0,10 доллара, 1080P - 0,20 доллара. Считать легко: 30-секундный ролик в максимальном качестве 1080P обойдётся в 6 долларов по официальному прайсу. Для региона Китая (Пекин) цена ниже - 0,041256, 0,082513 и 0,165025 доллара за секунду соответственно на тех же трёх разрешениях
Постоянного безлимитного бесплатного доступа официально не заявлено - встречаются только ограниченные бесплатные лимиты и временные промо-периоды, и рассчитывать на них как на постоянный бесплатный вариант не стоит
Разрешение и цена: сводная таблица
Три параметра решают, сколько будет стоить ролик - разрешение, длина и регион аккаунта. Свожу их в одну таблицу по официальным данным Alibaba Cloud Model Studio:
| Разрешение | Цена за секунду (международный регион) | Цена 30-секундного ролика |
|---|---|---|
| 480P | $0,05 | $1,50 |
| 720P | $0,10 | $3 |
| 1080P | $0,20 | $6 |
Таблица прокручивается вбок →
Для региона Китая (Пекин) официальная цена ниже примерно на 17-18%, но регистрация там рассчитана на китайский номер телефона (раздел выше), поэтому для читателя из России ориентир - именно международный регион
Что мешает оплатить Wan 3.0 из России
Сама страница модели и документация открываются без VPN - я проверил обе живым запросом дважды 05.09.2026, с обычной сети и с московского сервера, обе отдались одинаково. Преграда не в доступе к странице, а в оплате
Международный биллинг Alibaba Cloud принимает карты Visa и Mastercard, но карта обязана поддерживать международные онлайн-платежи и проходить проверку - предоплаченные, подарочные и часть виртуальных карт биллинг отклоняет. Российская банковская карта международный биллинг может не пройти по той же причине, что и у большинства зарубежных сервисов: дело не в VPN, а в самой карте. Рабочие пути такие же, как у остальных платных нейросетей - способы оплаты из России без иностранной карты разобраны отдельно в гайде как оплатить нейросети из России, если карта не проходит, здесь этот разбор не пересказывается заново
Отдельная деталь про регистрацию: китайские площадки Alibaba исторически ждут китайский номер телефона на входе, а международный доступ к Wan 3.0 идёт через англоязычную консоль Alibaba Cloud Model Studio и через Qwen Cloud API - там китайский номер не требуется
Чем Wan 3.0 отличается от соседних видеонейросетей
Wan 3.0 - не единственная модель, которая за последний год научилась удерживать длинный ролик и принимать нестандартный вход. По задаче они расходятся заметнее, чем по общей идее «видео нейросетью»:
| Сервис | Главная фича | Максимум за проход |
|---|---|---|
| Wan 3.0 | видео из документа (PDF, презентация, веб-страница) со звуком в одном проходе | 30 секунд |
| Kling AI | регистрация, бесплатные кредиты, текст и фото в видео | обычно короткие клипы, наращивается вручную |
| LTX Studio | тарифная сетка и кредиты под разные модели видео | зависит от плана |
| Seedance 2.0 (в Picsart Flow) | текстовые промпты под мультяшный Pixar-стиль | одна сцена на промпт |
Таблица прокручивается вбок →
Если тебе нужен именно первый ролик из текста или фото с понятной регистрацией по шагам - это разобрано в отдельном гайде Kling AI: регистрация и первый ролик. Если ближе готовые тарифы и кредиты под разные модели - сравнение в LTX Studio: цены и 4 плана. Если задача - мультяшный ролик в духе Pixar без камеры и аниматора - там другой инструмент и другие промпты, Seedance 2.0: Pixar-видео текстом. А если ты пишешь запрос для видео в Gemini и не понимаешь, из каких частей он должен состоять - структура запроса разобрана в промт для видео в Gemini: 6 частей
Кому это подходит уже сегодня
Дальше всего Wan 3.0 продвигает тех, у кого уже есть готовый документ - презентация к продукту, PDF с описанием курса, лендинг в виде веб-страницы - и кому нужно превратить его в видео, а не собирать сцену с нуля из текстового описания
Если готового документа нет, а есть только идея и текстовое описание сцены - вход через документ не даст преимущества, и проще начать с обычного текстового промпта в любом из соседних сервисов из таблицы выше
Частые ошибки при первом знакомстве с Wan 3.0
Четыре вещи, которые путают чаще всего при первом чтении новостей о Wan 3.0
- Спутали Wan 3.0 с open-source версией веса модели закрыты, скачать и запустить у себя нельзя - это платный API, а не файл для локального запуска, как было у более ранней версии Wan 2.1
- Приняли «со звуком» за наложенную дорожку звук рождается вместе с картинкой за тот же проход, а не добавляется отдельным шагом в другом редакторе
- Решили, что раз страница открылась без VPN, значит и оплата пройдёт доступ к странице и международный биллинг - разные вещи, карта должна отдельно поддерживать международные платежи
- Спутали функцию с генерацией «из головы» Omni-Creation разбирает содержимое РЕАЛЬНОГО документа, который ты загрузил, а не сочиняет сюжет по одному слову «презентация»
Что ещё почитать про нейросети для видео
- Нейросети для видео: 6 сервисов и сколько стоят в 2026 году - живой замер доступности и цены Kling, Runway, Pika и других
- Kling AI: как зарегистрироваться и снять первый ролик - пошаговая регистрация и первая генерация
- LTX Studio: цены и что дают 4 плана и 800 кредитов - тарифная сетка другого видеосервиса
- Промпты для Seedance 2.0: Pixar-видео текстом - мультяшный стиль без камеры и аниматора
- Промт для видео в Gemini: 6 частей и доступ в 2026 году - как собрать текстовый запрос для видео
- Как сделать видео с помощью ИИ - маршрут новичка с нуля, без документа на входе
- Видео из фото нейросетью: 2 бесплатных способа - если на входе только фото, а не документ
- Как оживить фото нейросетью: 7 сервисов - если нужен один снимок с лёгким движением
- Нарезать и смонтировать длинное видео - если готовый ролик уже есть и его нужно доработать
- Улучшить готовое видео - апскейл и чистка уже смонтированного ролика
- Музыка к видео без прав на чужой трек - если звук из модели не подошёл и нужен отдельный трек
- Как оплатить нейросети из России, если карта не проходит - рабочие пути оплаты зарубежных сервисов
- Двенадцать ценников нейросетей в рублях - для сравнения с другими сервисами по деньгам
- Бесплатные нейросети без карты - подборка того, что работает без единой оплаты
- Генерация визуала: все разборы темы - полный список гайдов по картинкам и видео на сайте
Источники
Все страницы проверены прямым запросом 5 сентября 2026 года; официальная документация и главная страница модели дополнительно сняты кадром живым Playwright headless и подтверждён доступ из России с двух точек
- Wan 3.0: официальная страница модели - функции Native 30s, Omni-Creation, Immersive Experience прямо с сайта разработчика
- Alibaba Cloud Model Studio: карточка модели wan3.0-video - официальные входные модальности, разрешения, максимальная длительность и цены
- TechNode: запуск Wan 3.0 с генерацией 30 секунд и вводом документов - независимый технологический разбор запуска
- Dataconomy: Alibaba запускает Wan3.0 - независимое издание, дата и контекст запуска
- Habr (study_ai): устройство Wan 3.0 и доступ из России - разбор биллинга и барьеров оплаты для российского пользователя
- AgentUpdate.ai: публичная бета Wan 3.0 и ввод документов - лимиты по размеру файла (100 МБ, 50 страниц)
- Morphic: технические характеристики Wan 3.0 - механика звука, генерируемого в одном проходе с видео
Памятка: Wan 3.0 за 5 минут
Семь строк, которые закрывают вопрос «что это и стоит ли пробовать»
Сохрани себе
- Wan 3.0 - видеомодель Alibaba, публичная бета с 6 августа 2026, полный запуск 24 августа
- Максимум 30 секунд видео за один проход, разрешение 480P, 720P или 1080P на выбор
- Звук создаётся вместе с картинкой в одном проходе, а не накладывается отдельно
- Функция Omni-Creation строит видео из документа - PDF, презентации, веб-страницы, до 20 файлов сразу
- Постоянного бесплатного тарифа нет, цена считается за секунду видео и растёт с разрешением
- Оплата из России упирается в международный биллинг карты, а не в блокировку страницы
- Веса модели закрыты - это платный API, а не файл для запуска на своём компьютере
Порог входа
Разбор новой модели занял пять минут чтения, следующий шаг - тоже бесплатный
Ты только что бесплатно узнал больше про Wan 3.0, чем даёт большинство новостных заметок: что реально умеет модель, сколько это стоит и что мешает оплатить из России. Дальше - три дня разбора твоих же инструментов, тоже без оплаты
Заявка в закрытый канал, одобряю сразу. Бот сам напишет первым и покажет, как забрать три дня Лагеря. Бесплатно
Частые вопросы
Wan 3.0 бесплатный?
Нет, постоянного безлимитного бесплатного тарифа у Wan 3.0 официально не заявлено. Оплата идёт за секунду сгенерированного видео: от 0,05 доллара за секунду в 480P до 0,20 доллара за секунду в 1080P по официальному прайсу международного региона. Встречаются только ограниченные бесплатные лимиты и временные промо-периоды, не постоянный бесплатный доступ
Можно ли собрать видео прямо из PDF или презентации в Wan 3.0?
Да, это официальная функция модели - Omni-Creation (в технических источниках называется Omni-Reference). Она принимает до 20 файлов-подсказок одновременно, включая документы и веб-страницы по ссылке, и строит видео из их содержимого, а не только из текстового описания
Работает ли Wan 3.0 из России без VPN?
Сама страница модели и официальная документация открылись без VPN при проверке 05.09.2026 - и с обычной сети, и с московского сервера. Преграда не в доступе к странице, а в оплате: международный биллинг Alibaba Cloud требует карту, которая поддерживает международные онлайн-платежи, а обычная российская банковская карта такую проверку может не пройти
Чем звук Wan 3.0 отличается от озвучки, добавленной отдельно?
Звук создаётся вместе с картинкой за тот же проход генерации, а не накладывается отдельным шагом в видеоредакторе после того, как ролик уже готов. Это официально описано на странице модели как единая функция «Immersive Experience: elevated realism, texture, and sound design»
Можно ли скачать Wan 3.0 и запустить у себя на компьютере?
Нет, веса модели Wan 3.0 закрыты - это платный API, доступный через Alibaba Cloud Model Studio и Qwen Cloud, а не файл для локального запуска. Более ранняя версия, Wan 2.1, публиковалась с открытыми весами и кодом, но тройка на этот путь не пошла
Сколько будет стоить 30-секундный ролик в максимальном качестве?
По официальному прайсу международного региона 1080P стоит 0,20 доллара за секунду, значит 30 секунд обойдутся в 6 долларов. Для региона Китая (Пекин) официальная цена ниже - 0,165025 доллара за секунду, то есть около 4,95 доллара за тот же ролик