Всё рядом
Описание, параметры и результат находятся на одной странице.
Получаем доступные модели от API Valtron.
Единоразово. Без подписки и ежемесячного автопродления.
Загружаем пакеты кредитов…
Описание, параметры и результат находятся на одной странице.
Все созданные работы доступны в Студии и разделе «Мои результаты».
Перед запуском вы видите стоимость выбранных параметров в кредитах.
Введите запрос и добавьте исходные материалы, если они нужны выбранной операции.
Проверьте настройки и стоимость, затем нажмите «Начать».
Дождитесь завершения. Готовую работу можно скачать или открыть в Студии.
Да. Image-to-Video в Wan 2.7 поддерживает video continuation: существующий видеоклип используется как начало, после которого нейросеть генерирует продолжение сцены.
Да. Wan 2.7 поддерживает генерацию между первым и последним изображением. Модель создаёт промежуточное движение, связывающее заданные состояния сцены.
Да. Text-to-Video поддерживает синхронизированное аудио, а в Image-to-Video предусмотрены автоматическая озвучка и использование пользовательского аудио.
Да. Wan 2.7 Reference-to-Video поддерживает смешанные изображения и видео в качестве референсов. Официальная документация указывает возможность использовать до пяти исходных материалов.
Да. Reference-to-Video ориентирован в том числе на multi-character-сценарии и сохранение согласованности персонажей. Разным героям можно предоставить собственные визуальные референсы.
Одно из главных отличий связано с Image-to-Video. Wan 2.7 объединяет генерацию от первого кадра, работу с первым и последним кадром и продолжение готового видео, тогда как более ранний API Wan 2.6 поддерживал только сценарий генерации от первого изображения.
Wan 2.7 — поколение видеомоделей Alibaba, которое объединяет несколько способов создания контента: генерацию по текстовому описанию, анимацию изображений и работу с референсами. В зависимости от выбранного режима исходными данными могут выступать текст, изображение, аудио и видео.
Одно из главных отличий поколения 2.7 связано с расширенным управлением развитием сцены. Помимо обычного Image-to-Video, модель умеет строить видео между заданным первым и последним кадром, продолжать уже существующий ролик и учитывать собственную аудиодорожку пользователя. Для сюжетных задач также поддерживается многоэпизодное повествование.
Wan 2.7 Text-to-Video создаёт видеоряд на основе промта. Пользователь может описать героя, место действия, события, визуальную атмосферу и характер съёмки. Модель поддерживает создание видео со звуком и multi-shot narrative — последовательность нескольких кадров или сцен внутри одного ролика.
Такой формат подходит для небольших сюжетов, рекламных концепций и сцен, в которых требуется не один непрерывный кадр, а развитие действия через несколько планов.
В режиме Image-to-Video исходная картинка становится визуальной основой ролика. Она определяет персонажа, объект, композицию или окружение, а промт описывает дальнейшее действие.
Wan 2.7 использует мультимодальный ввод и позволяет дополнять изображение текстовыми и аудиоданными. Это удобно, когда внешний вид сцены уже создан и необходимо сосредоточиться на движении, поведении героя и последующем развитии видео.
Заметным расширением Image-to-Video в Wan 2.7 стала поддержка первого и последнего кадра. Пользователь может определить начальное состояние сцены и изображение, к которому она должна прийти, а нейросеть создаёт промежуточное движение.
Этот режим даёт больше контроля над результатом, чем генерация только от первого изображения. Он подходит, например, когда заранее известны начало и финал трансформации, перемещения объекта или изменения композиции.
Wan 2.7 умеет использовать существующий видеоклип как начало новой генерации. Модель продолжает его, формируя последующие кадры с учётом исходного материала. При необходимости в сценарии продолжения можно дополнительно задать финальное изображение.
Это позволяет развивать уже созданную сцену вместо запуска нового ролика с нуля. Возможность полезна для последовательного сторителлинга, расширения удачной генерации и создания более длинной композиции из связанных фрагментов.
Wan 2.7 продолжает развитие нативной аудиовизуальной генерации семейства Wan. Text-to-Video поддерживает создание видео со звуком и синхронизацию аудио с изображением, а Image-to-Video позволяет использовать автоматическую озвучку или загруженное пользователем аудио.
Поэтому звук можно учитывать уже на этапе постановки сцены. Это подходит для роликов с речью, музыкальным сопровождением и другими аудиособытиями, которые должны соответствовать происходящему в кадре.
Отдельный режим Wan 2.7 Reference-to-Video предназначен для генерации по референсам. Он поддерживает смешанное использование изображений и видео, позволяя задавать персонажей, объекты и другие элементы будущей сцены через исходные материалы.
Модель ориентирована на сохранение согласованности героев, объектов и сцены. Это особенно важно для контента, где один и тот же персонаж должен оставаться узнаваемым при изменении окружения, ракурса или действия.
Wan 2.7 R2V поддерживает смешанные референсы из изображений и видеороликов. В официальной документации указана возможность использовать до пяти таких материалов в одном запросе.
Благодаря этому можно отдельно задать нескольких персонажей или визуальные элементы и затем объединить их в новой сцене. Такой подход полезен для сюжетов с взаимодействием нескольких героев и более точного контроля визуальной идентичности.
Reference-to-Video также поддерживает клонирование тембра голоса из референсного материала. В сочетании с сохранением внешности это позволяет использовать исходного персонажа более последовательно: в новых сценах учитывается не только его визуальный образ, но и характер звучания голоса.
Функция особенно полезна для серийных AI-роликов, виртуальных персонажей и сюжетов, где герой должен оставаться узнаваемым между разными сценами.
Поколение 2.7 особенно удобно для проектов, где требуется управлять не только исходной идеей, но и развитием видеоряда.
Wan 2.6 уже поддерживает синхронизированный звук, multi-shot и Reference-to-Video. В поколении 2.7 заметно расширен именно Image-to-Video: кроме генерации от первого кадра появились первый и последний кадр, продолжение существующего видео и аудиоуправляемые сценарии. Официальная документация прямо отмечает, что API Wan 2.7 объединяет эти три задачи, тогда как более ранний Image-to-Video API Wan 2.6 ограничивался генерацией от первого кадра.
Reference-to-Video поколения 2.7 также развивает работу со смешанными референсами, несколькими персонажами и сохранением голосовой идентичности. Поэтому модель особенно интересна для проектов, где требуется продолжать уже созданный материал или точно связывать несколько исходных элементов в новой видеосцене.