Vidu Q3 API
Vidu Q3 от Shengshu — text-to-video, image-to-video, reference-to-video (1–4 референсных изображения для согласованности нескольких героев) и start-end-to-video. Три уровня: Standard, Pro, Turbo. В некоторых вариантах результаты до 16 секунд.
Уровни Standard, Pro (результаты 1–16 с) и Turbo (быстрее). Reference-to-video принимает 1–4 референсных изображения для видео с согласованными героями в 360p–1080p длиной до 16 секунд. Start-end-to-video соединяет два ключевых кадра (1–16 с на Pro). Вариант image-to-video-pro поддерживает 720p/1080p/2K/4K.
Обзор
О модели Vidu Q3 API
Что делает Vidu Q3, какое место занимает в линейке моделей Shengshu и почему её выбирают команды.
Vidu Q3 — модель генерации видео от Shengshu, доступная через REST API WaveSpeedAI. Vidu Q3 от Shengshu — text-to-video, image-to-video, reference-to-video (1–4 референсных изображения для согласованности нескольких героев) и start-end-to-video. Три уровня: Standard, Pro, Turbo. В некоторых вариантах результаты до 16 секунд.
Уровни Standard, Pro (результаты 1–16 с) и Turbo (быстрее). Reference-to-video принимает 1–4 референсных изображения для видео с согласованными героями в 360p–1080p длиной до 16 секунд. Start-end-to-video соединяет два ключевых кадра (1–16 с на Pro). Вариант image-to-video-pro поддерживает 720p/1080p/2K/4K.
Семейство Vidu Q3 в WaveSpeedAI включает 13 REST-эндпоинтов для сценариев: Text-To-Video, Image-To-Video, Reference-To-Video. У каждого варианта свои цены, параметры и примеры результатов — выберите тот, что подходит под ваш тип входных данных и требования продакшена, или вызывайте несколько с одним API-ключом и собирайте многошаговые пайплайны.
Запускайте Vidu Q3 с тем же API-ключом, платёжным аккаунтом и лимитами, что и остальные 1000+ ИИ-моделей WaveSpeedAI. Без отдельной регистрации у вендора, без SDK для каждого провайдера, без разных лимитов у каждого поставщика — одна интеграция охватывает всё: от текста в изображение и текста в видео до синтеза аудио, 3D-генерации, апскейлинга и редактирования.
Эндпоинты
Все эндпоинты API Vidu Q3
Сейчас в WaveSpeedAI доступно эндпоинтов Vidu Q3: 13 — выберите вариант под ваш сценарий.
/filters:quality(82)/media/images/1778682596980020194_WE2bktCL.webp)
Q3 Pro Text To Video
Vidu Q3 Pro Text to Video is a fast AI video generation model that creates high-quality, audio-capable videos from text prompts with support for 1–16 second outputs. Ready-to-use REST inference API for cinematic clips, advertising creatives, social media videos, product visuals, storytelling, and professional text-to-video workflows with simple integration, no coldstarts, and affordable pricing.
/filters:quality(82)/media/images/1778642810217109913_lPenxFPY.webp)
Q3 Pro Start End To Video
Vidu Q3 Pro Start-End-to-Video creates smooth transitions between two keyframes with viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105234_f2z15q17.webp)
Q3 Turbo Start End To Video
Vidu Q3 Turbo Start-End-to-Video creates smooth transitions between two images with faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105138_ppp4gly8.webp)
Q3 Start End To Video
Vidu Q3 Start End Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1783683828943385893_6nuh5TGv.webp)
Q3 Reference To Video
Vidu Q3 Reference-to-Video Mix generates multi-entity consistent videos from 1-4 reference images with text prompt guidance. Supports 360p to 1080p resolutions, up to 16 seconds duration, multiple aspect ratios, and optional audio generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105132_z9o7hzdv.webp)
Q3 Image To Video Pro
Vidu Q3 Image-to-Video Pro generates high-resolution videos (720p/1080p/2K/4K) from images with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1778642590678181581_rTjsBLV5.webp)
Q3 Pro Image To Video
Vidu Q3 Pro Image-to-Video animates still images with high-quality motion via viduq3-pro (1–16s). Billing follows Vidu's published Q3-pro per-second rates by resolution. Ready-to-use REST inference API on WaveSpeed.
/filters:quality(82)/media/images/20260408105229_yjachyfs.webp)
Q3 Turbo Image To Video
Vidu Q3 Turbo Image-to-Video animates static images with high-quality motion and faster processing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105141_ud2162ut.webp)
Q3 Text To Video
Vidu Q3 Text-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782498276203721773_heCfpzIR.webp)
Q3 Drama
Vidu Q3 Drama generates complete script-driven drama videos from scripts and structured assets, including characters, scenes, tools, and references. It plans the narrative structure, scene pacing, and transitions to create a story-driven drama in one request, supporting up to 180 seconds. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408105128_fw6o586f.webp)
Q3 Image To Video
Vidu Q3 Image-to-Video turns text prompts into high-quality videos with exceptional visual fidelity and diverse motion. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782880699830272243_SRdcBUgG.webp)
Q3 Ad
Vidu Q3 Ad Video generates commercial ad videos from 1 to 7 reference images with prompt guidance, supporting 720P / 1080P output and synchronized audio for product ads, brand campaigns, marketing creatives, and promotional videos. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1782715804387581475_DcHQ19js.webp)
Q3 Drama Clip
Vidu Q3 Drama Clip generates 8-12 second script-driven drama videos from structured assets, including characters, scenes, and tools. It is ideal for compact story scenes, storyboard shots, and focused narrative moments. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Примеры
Vidu Q3 в деле
Реальные результаты, созданные через API Vidu Q3. Наведите курсор на видео для предпросмотра, нажмите, чтобы открыть в полном размере.
Как использовать
Как использовать API Vidu Q3
Четыре шага от регистрации до готовой генерации. Полные примеры на Python, Node.js и cURL — в разделе API ниже.
- 01
Получите API-ключ
Создайте аккаунт WaveSpeedAI и скопируйте API-ключ на панели управления. Новые аккаунты получают бесплатные стартовые кредиты — их хватит, чтобы несколько десятков раз запустить playground до начала списаний.
- 02
Отправьте предсказание
Отправьте входные данные в формате JSON методом POST на https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video. Эндпоинт сразу возвращает id предсказания — генерация асинхронная, поэтому соединение не нужно держать открытым на время инференса.
- 03
Опрашивайте до завершения
Выполняйте GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. При статусе completed забирайте результат; при failed, cancelled, timeout или deleted остановитесь с ошибкой; при любом другом статусе продолжайте опрос.
- 04
Получите URL результата
Когда статус станет "completed", возьмите URL из data.outputs[0]. Он указывает на созданный файл в CDN WaveSpeedAI — изображение, видео, аудио или 3D-файл, в зависимости от вызванного варианта Vidu Q3.
Сценарии применения
Что можно создать с Vidu Q3
Типичные сценарии, для которых разработчики и авторы используют API Vidu Q3.
Reference-to-video с 1–4 референсами
vidu/q3/reference-to-video создаёт видео с согласованными несколькими героями по 1–4 референсным изображениям с текстовой подсказкой. Поддерживает 360p–1080p, до 16 секунд, несколько соотношений сторон. Полезно для групповых сцен, где несколько героев по референсам должны оставаться согласованными.
Интерполяция между начальным и конечным ключевым кадром
vidu/q3/start-end-to-video создаёт видео, интерполируя между двумя ключевыми кадрами. Уровни Pro и Turbo также поддерживают start-end с длительностью 1–16 с. Полезно для раскадровок в стиле аниматика, когда у вас есть начальный и конечный кадры.
Результаты до 16 секунд
Заявление из каталога для вариантов Pro и reference-to-video: длительность 1–16 секунд. Дольше, чем окно в 5–8 с у многих конкурирующих видеомоделей — полезно, чтобы уместить целый сюжетный эпизод в одной генерации.
Image-to-video в высоком разрешении
vidu/q3/image-to-video-pro поддерживает 720p / 1080p / 2K / 4K из изображений. Полезно для результата, готового к выдаче, без прохода апскейла, если вы начинаете с готового кадра.
Уровень Pro (самый дешёвый)
vidu/q3-pro/* — самый дешёвый уровень Vidu Q3, полезный для больших объёмов. Охватывает image-to-video, text-to-video и start-end-to-video с результатами 1–16 секунд.
Советы
Советы по написанию запросов для Vidu Q3
Практические советы, как получать лучшие результаты от Vidu Q3, — на основе приёмов, которые работают в продакшен-пайплайнах для моделей видео.
- 01
Используйте поддержку 1–4 референсных изображений для сцен с несколькими героями
vidu/q3/reference-to-video принимает 1–4 референсных изображения для видео с согласованными несколькими героями и текстовой подсказкой. Полезно для групповых сцен с актёрским составом, групповых презентаций продуктов и раскадровок с несколькими героями.
- 02
Интерполяция между начальным и конечным кадром для процессов с ключевыми кадрами
vidu/q3/start-end-to-video соединяет два кадра сгенерированным движением. Особенно полезно для работы в стиле аниматика, раскадровки по ключевым позам и превращения концепт-арта в движение без повторного промпта для каждого сегмента.
- 03
Выбирайте уровень осознанно
Standard — уровень выдачи по умолчанию; Pro (результаты 1–16 секунд) позиционируется для больших объёмов; Turbo делает упор на скорость. Актуальную цену каждого уровня смотрите в таблице цен на этой странице — уровень Pro у Vidu Q3 необычайно конкурентоспособен.
- 04
Результаты до 16 секунд в некоторых вариантах
Заявление из каталога для вариантов Pro и reference-to-video: длительность 1–16 секунд. Дольше, чем окно в 5–8 с у многих конкурирующих видеомоделей — полезно, чтобы уместить целый сюжетный эпизод в одной генерации.
- 05
image-to-video-pro для результата в высоком разрешении
vidu/q3/image-to-video-pro поддерживает разрешение 720p / 1080p / 2K / 4K из изображений. Полезно для результата, готового к выдаче, без прохода апскейла, если вы начинаете с готового кадра.
Цены
Цены на API Vidu Q3
Оплата — за каждый результат. Итоговая стоимость зависит от параметров, заданных в playground каждого варианта (разрешение, длительность, количество результатов, референсы).
| Эндпоинт | Тип | Цена от |
|---|---|---|
| vidu/ | text-to-video | $0.25 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | reference-to-video | $0.35 |
| vidu/ | image-to-video | $0.45 |
| vidu/ | image-to-video | $0.25 |
| vidu/ | image-to-video | $0.30 |
| vidu/ | text-to-video | $0.35 |
| vidu/ | image-to-video | $1.12 |
| vidu/ | image-to-video | $0.35 |
| vidu/ | image-to-video | $0.15 |
| vidu/ | image-to-video | $1.12 |
API
Вызов API Vidu Q3
Получите API-ключ на wavespeed.ai/accesskey, затем отправьте предсказание через REST. Playground генерирует готовые к вставке примеры для любой комбинации входных данных.
POSThttps://api.wavespeed.ai/api/v3/vidu/q3/text-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": true,
"bgm": true
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"style": "general",
"resolution": "720p",
"duration": 5,
"aspect_ratio": "4:3",
"movement_amplitude": "auto",
"generate_audio": True,
"bgm": True
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Сравнение
Vidu Q3 и альтернативы
Когда стоит выбрать Vidu Q3, а не похожие модели в WaveSpeedAI.
Vidu Q3 и Seedance 2.0
Seedance 2.0 даёт нативный синтез звука во всех вариантах и уровень Turbo. Vidu Q3 заметно дешевле и предлагает интерполяцию между начальным и конечным кадром как полноценную конечную точку, которой у Seedance нет.
Vidu Q3 и Kling 3.0
Kling 3.0 охватывает Standard, Pro и 4K с управлением движением как подчинённой конечной точкой. Vidu Q3 дешевле на большинстве уровней и включает start-end-to-video и reference-to-video (1–4 референса) как основные варианты.
Vidu Q3 и Wan 2.7
У Wan 2.7 в том же семействе есть reference-to-video, video-edit, video-extend, редактирование изображений и text-to-image. Vidu Q3 остаётся сфокусированным на генерации видео с более дешёвыми уровнями и процессом интерполяции между начальным и конечным кадром.
FAQ
Vidu Q3 API — часто задаваемые вопросы
Цены, лицензия, интеграция — частые вопросы о запуске Vidu Q3 в WaveSpeedAI.
Что такое API Vidu Q3?
Vidu Q3 — модель генерации видео от Shengshu, доступная как REST API в WaveSpeedAI. Vidu Q3 от Shengshu — text-to-video, image-to-video, reference-to-video (1–4 референсных изображения для согласованности нескольких героев) и start-end-to-video. Три уровня: Standard, Pro, Turbo. В некоторых вариантах результаты до 16 секунд. Её можно вызывать программно или попробовать в playground по ссылке выше.
Как вызывать API Vidu Q3?
Создайте аккаунт WaveSpeedAI, скопируйте API-ключ на странице /accesskey и отправьте POST на https://api.wavespeed.ai/api/v3/vidu/q3/text-to-video с входными данными в JSON. Эндпоинт вернёт id предсказания. Опрашивайте эндпоинт результата примерно раз в 2 секунды, для долгих задач увеличивайте интервал и останавливайтесь на любом финальном статусе. Примеры для продакшена на Python / Node.js / cURL — выше.
Сколько стоит API Vidu Q3?
Vidu Q3 стоит от $0.15 за запуск. Точная стоимость зависит от заданных параметров (разрешение, длительность, количество результатов, референсы). Предпросмотр стоимости рядом с кнопкой «Сгенерировать» в playground показывает точную цену для ваших текущих данных.
Какие варианты Vidu Q3 доступны?
В WaveSpeedAI доступно рабочих эндпоинтов Vidu Q3: 13 — vidu/q3-pro/text-to-video, vidu/q3-pro/start-end-to-video, vidu/q3-turbo/start-end-to-video, vidu/q3/start-end-to-video, vidu/q3/reference-to-video, vidu/q3/image-to-video-pro, vidu/q3-pro/image-to-video, vidu/q3-turbo/image-to-video, и другие. У каждого варианта своя страница playground и свои цены.
Можно ли использовать результаты Vidu Q3 в коммерческих целях?
Права на коммерческое использование определяются лицензией модели Shengshu. Большинство моделей Shengshu разрешают коммерческое использование результатов; краткое описание лицензии смотрите на странице playground каждой модели, а условия платформы — в Условиях использования WaveSpeedAI.
Зачем использовать Vidu Q3 в WaveSpeedAI, а не напрямую?
Один API-ключ и один платёжный аккаунт для Vidu Q3 И для 1000+ других ИИ-моделей от разных провайдеров. Без настройки SDK для каждого вендора, без отдельных лимитов, без переписывания интеграционного кода под каждого поставщика. Цены, как правило, на уровне прямого API Shengshu или ниже.
Разработчик
О Shengshu
Команда, стоящая за Vidu Q3 и всей линейкой моделей Shengshu в WaveSpeedAI.
Shengshu Technology — китайская ИИ-лаборатория, выросшая из Университета Цинхуа, создатель семейства моделей генерации видео Vidu. Vidu Q3 предлагает text-to-video, image-to-video, reference-to-video (1–4 референсных изображения для согласованности нескольких героев) и start-end-to-video (интерполяция ключевых кадров между двумя изображениями) на уровнях Standard, Pro и Turbo. Некоторые варианты поддерживают результаты до 16 секунд.
Начните создавать с Vidu Q3 в WaveSpeedAI
Бесплатные стартовые кредиты при регистрации. Один API-ключ для 1000+ ИИ-моделей от Shengshu и всех остальных провайдеров.