InfiniteTalk API
WaveSpeedAI InfiniteTalk — mengubah satu foto + audio menjadi video avatar berbicara ATAU bernyanyi, hingga 10 menit. Tingkat Standard dan Fast, plus varian Multi (satu gambar + dua input audio untuk output multi-karakter) dan varian Video-to-Video (gerakkan video yang ada dengan audio baru).
Tingkat Standard dan Fast, plus output 720p. Varian Multi menerima satu gambar + dua input audio untuk menghasilkan video multi-karakter yang berbicara/bernyanyi. Varian Video-to-Video menggerakkan video yang ada dengan audio baru untuk penggantian lip-sync. Output hingga 10 menit.
Ringkasan
Tentang InfiniteTalk API
Apa yang dilakukan InfiniteTalk, posisinya dalam jajaran model WaveSpeedAI, dan mengapa banyak tim memilihnya.
InfiniteTalk adalah model pembuatan video dari WaveSpeedAI, tersedia melalui REST API WaveSpeedAI. WaveSpeedAI InfiniteTalk — mengubah satu foto + audio menjadi video avatar berbicara ATAU bernyanyi, hingga 10 menit. Tingkat Standard dan Fast, plus varian Multi (satu gambar + dua input audio untuk output multi-karakter) dan varian Video-to-Video (gerakkan video yang ada dengan audio baru).
Tingkat Standard dan Fast, plus output 720p. Varian Multi menerima satu gambar + dua input audio untuk menghasilkan video multi-karakter yang berbicara/bernyanyi. Varian Video-to-Video menggerakkan video yang ada dengan audio baru untuk penggantian lip-sync. Output hingga 10 menit.
Keluarga InfiniteTalk di WaveSpeedAI menyediakan 8 endpoint REST yang mencakup alur kerja Digital-Human. Setiap varian memiliki harga, parameter, dan contoh output sendiri — pilih yang sesuai dengan modalitas input dan kebutuhan produksi Anda, atau panggil beberapa sekaligus dengan satu API key untuk menyusun pipeline multi-langkah.
Jalankan InfiniteTalk dengan API key, akun penagihan, dan batas laju yang sama dengan yang Anda pakai untuk 1.000+ model AI lainnya di WaveSpeedAI. Tanpa penyiapan vendor terpisah, tanpa SDK per penyedia, tanpa batas laju per vendor — satu integrasi mencakup semuanya, dari text-to-image dan text-to-video hingga sintesis audio, pembuatan 3D, upscaling, dan pengeditan.
Endpoint
Semua endpoint API InfiniteTalk
8 endpoint InfiniteTalk tersedia sekarang di WaveSpeedAI — pilih varian yang sesuai dengan alur kerja Anda.
/filters:quality(82)/media/images/20260408110527_g86tqkpw.webp)
Infinitetalk Fast Video To Video Multi
InfiniteTalk fast video-to-video multi converts a video and two audio inputs into multi-character talking or singing videos. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110532_2m95tzbp.webp)
Infinitetalk Fast Video To Video
Audio-driven infinitetalk-fast turns one video plus audio into realistic talking or singing videos with lip-sync. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111359_7pt74rzh.webp)
Infinitetalk Video To Video Multi
InfiniteTalk Video-to-Video Multi converts a video and two audio inputs into multi-character talking or singing videos at up to 720p. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110534_dl097qgv.webp)
Infinitetalk Fast Multi
InfiniteTalk fast multi converts a single image and two audio inputs into multi-character talking or singing videos. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408110525_m58v6n7u.webp)
Infinitetalk Fast
InfiniteTalk fast converts one photo + audio into audio-driven talking or singing avatar videos (Image-to-Video), up to 10 minutes. Ready-to-use REST API, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111403_q1ar1bex.webp)
Infinitetalk Video To Video
Audio-driven InfiniteTalk turns one video plus audio into realistic talking or singing videos with lip-sync in 480p or 720p. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1790561759067766019_QVeeWlOj.webp)
Infinitetalk
InfiniteTalk Image-to-Video converts a single photo and audio track into long-form audio-driven talking or singing avatar videos, supporting up to 10 minutes, 720P output, natural lip sync, expressive motion, and digital human video workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/20260408111406_upu4dbpi.webp)
Infinitetalk Multi
InfiniteTalk Multi converts a single image and two audio inputs into multi-character talking or singing videos at up to 720p. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Contoh
Lihat InfiniteTalk beraksi
Output nyata yang dihasilkan oleh API InfiniteTalk. Arahkan kursor ke video mana pun untuk pratinjau, klik untuk membuka penampil ukuran penuh.
Cara pakai
Cara menggunakan API InfiniteTalk
Empat langkah dari pendaftaran hingga hasil jadi. Contoh lengkap Python, Node.js, dan cURL ada di bagian API di bawah.
- 01
Dapatkan API key
Daftar akun WaveSpeedAI dan salin API key Anda dari dasbor. Akun baru mendapat kredit awal gratis — cukup untuk menjalankan playground beberapa puluh kali sebelum penagihan dimulai.
- 02
Kirim prediksi
POST input Anda sebagai JSON ke https://api.wavespeed.ai/api/v3/wavespeed-ai/infinitetalk. Endpoint langsung mengembalikan id prediksi — proses generasi bersifat asinkron sehingga Anda tidak perlu menahan koneksi terbuka selama inferensi.
- 03
Polling hingga selesai
GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Ambil output saat completed; hentikan dengan error saat failed, cancelled, timeout, atau deleted; lanjutkan polling untuk status lainnya.
- 04
Baca URL output
Setelah status "completed", baca URL dari data.outputs[0]. URL tersebut mengarah ke media hasil generasi Anda di CDN WaveSpeedAI — file gambar, video, audio, atau 3D tergantung varian InfiniteTalk yang Anda panggil.
Kasus penggunaan
Apa yang bisa Anda bangun dengan InfiniteTalk
Alur kerja umum yang dipakai pengembang dan kreator dengan API InfiniteTalk.
Avatar berbicara ATAU bernyanyi dari satu foto
wavespeed-ai/infinitetalk mengubah satu foto + audio menjadi video avatar berbicara atau bernyanyi. Pembingkaian katalog: "Gambar-ke-Video, hingga 10 menit, tingkat 720p." Dukungan bernyanyi adalah fitur pembeda.
Multi-karakter dengan dua input audio
wavespeed-ai/infinitetalk/multi menerima satu gambar + dua input audio untuk menghasilkan video multi-karakter yang berbicara/bernyanyi hingga 720p. Berguna untuk adegan dialog, duet, dan presentasi dua orang dari satu pengaturan.
Penggantian lip-sync video-ke-video
wavespeed-ai/infinitetalk/video-to-video menggerakkan video yang ada dengan audio baru, menghasilkan bicara atau nyanyian realistis dengan lip-sync (480p atau 720p). Berguna untuk dubbing ulang footage yang ada dengan voiceover baru.
Output hingga 10 menit
Klaim katalog pada varian dasar: hingga 10 menit. Jauh lebih panjang daripada kebanyakan model video — dapat dipakai untuk podcast, kuliah, narasi panjang, dan konten avatar berbicara sepanjang episode dalam satu pembuatan.
Tingkat Fast
wavespeed-ai/infinitetalk-fast. Alur gambar-ke-video yang sama dengan inferensi yang dioptimalkan — berguna untuk pekerjaan volume tinggi dan iterasi praproduksi. Multi dan video-to-video juga menyediakan varian Fast.
Video-ke-video multi-karakter
wavespeed-ai/infinitetalk/video-to-video-multi menerima satu video dan dua input audio untuk bicara/nyanyian multi-karakter hingga 720p. Kombinasi lengkap alur kerja multi-karakter + sumber video dalam satu panggilan.
Tips
Tips menulis prompt untuk InfiniteTalk
Saran praktis untuk mendapatkan output yang lebih baik dari InfiniteTalk — diambil dari pola yang berhasil pada model video di pipeline produksi.
- 01
Audio bersih dulu, sinkronisasi kemudian
Kualitas lip-sync dibatasi oleh kejernihan audio. Hilangkan noise latar, normalkan level, dan periksa clipping sebelum memasukkan audio. Audio yang bersih meningkatkan lip-sync lebih dari variabel lain mana pun.
- 02
Samakan gambar referensi dengan bahasa/budaya audio
Audio berbahasa Inggris yang dipasangkan dengan karakter yang jelas bernuansa Barat tampak lebih natural daripada yang tidak cocok. Begitu pula audio Jepang / Mandarin / Korea + referensi karakter yang sesuai.
- 03
Potret menghadap depan menghasilkan sinkronisasi terbersih
Referensi potret dari depan menghasilkan lip-sync paling natural. Sudut tiga perempat dan profil tetap bisa dipakai, tetapi dengan artefak halus. Jika Anda mengendalikan gambar karakter, sediakan pose yang hampir menghadap depan.
- 04
Bernyanyi didukung, bukan hanya berbicara
Fitur katalog: "video avatar berbicara atau bernyanyi." Gunakan untuk video musik, konten paduan suara / solois, dan video lirik dengan karakter unggulan — bukan hanya konten ucapan.
- 05
Varian Multi menerima dua input audio
wavespeed-ai/infinitetalk/multi menerima satu gambar + dua input audio untuk menghasilkan video multi-karakter yang berbicara/bernyanyi hingga 720p. Berguna untuk adegan dialog, duet, dan presentasi dua orang dari satu pengaturan.
- 06
Video-ke-video untuk dubbing ulang footage yang ada
wavespeed-ai/infinitetalk/video-to-video menggerakkan video yang ada dengan audio baru, menghasilkan bicara atau nyanyian realistis dengan lip-sync. Berguna untuk dubbing ulang klip dengan voiceover baru sambil mempertahankan visual aslinya.
Harga
Harga API InfiniteTalk
Harga dihitung per output. Biaya akhir menyesuaikan parameter yang Anda atur di playground setiap varian (resolusi, durasi, jumlah output, referensi).
| Endpoint | Jenis | Harga mulai dari |
|---|---|---|
| wavespeed-ai/ | digital-human | $0.075 |
| wavespeed-ai/ | digital-human | $0.075 |
| wavespeed-ai/ | digital-human | $0.15 |
| wavespeed-ai/ | digital-human | $0.075 |
| wavespeed-ai/ | digital-human | $0.075 |
| wavespeed-ai/ | digital-human | $0.15 |
| wavespeed-ai/ | digital-human | $0.15 |
| wavespeed-ai/ | digital-human | $0.15 |
API
Panggil API InfiniteTalk
Daftar untuk mendapatkan API key di wavespeed.ai/accesskey, lalu kirim prediksi melalui REST. Playground menghasilkan contoh siap tempel untuk kombinasi input apa pun.
POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/infinitetalk
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/infinitetalk" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"audio": "https://interactive-examples.mdn.mozilla.net/media/cc0-audio/t-rex-roar.mp3",
"resolution": "480p"
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/wavespeed-ai/infinitetalk";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"audio": "https://interactive-examples.mdn.mozilla.net/media/cc0-audio/t-rex-roar.mp3",
"resolution": "480p"
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg",
"audio": "https://interactive-examples.mdn.mozilla.net/media/cc0-audio/t-rex-roar.mp3",
"resolution": "480p"
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/wavespeed-ai/infinitetalk", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Perbandingan
InfiniteTalk vs alternatif
Kapan memilih InfiniteTalk dibanding model serupa di WaveSpeedAI.
InfiniteTalk vs Wan 2.2 Speech-to-Video
Wan 2.2 Speech-to-Video (wavespeed-ai/wan-2.2/speech-to-video) mendukung klip hingga 10 menit pada 480p — durasi maksimum yang sama dengan InfiniteTalk. InfiniteTalk menambahkan varian Multi (dua input audio), Video-to-Video, dan tingkat Fast yang tidak disediakan Wan 2.2 sebagai endpoint terpisah.
InfiniteTalk vs Stock avatar tools
Alat avatar stok (gaya HeyGen) membatasi Anda pada pustaka avatar terlatih yang sudah dikurasi. InfiniteTalk menerima gambar karakter apa pun — maskot merek, karakter buatan AI, pembawa acara ilustrasi — tanpa penyiapan per karakter, dan mendukung bernyanyi selain berbicara.
InfiniteTalk vs ElevenLabs voice tools
ElevenLabs menangani suara (pembuatan, kloning, TTS multibahasa). InfiniteTalk adalah lapisan video: pasangkan voiceover ElevenLabs dengan gambar karakter (atau video yang ada) untuk menghasilkan video lip-sync lengkap.
FAQ
InfiniteTalk API — Pertanyaan yang sering diajukan
Harga, lisensi, integrasi — pertanyaan umum tentang menjalankan InfiniteTalk di WaveSpeedAI.
Apa itu API InfiniteTalk?
InfiniteTalk adalah model pembuatan video dari WaveSpeedAI yang tersedia sebagai REST API di WaveSpeedAI. WaveSpeedAI InfiniteTalk — mengubah satu foto + audio menjadi video avatar berbicara ATAU bernyanyi, hingga 10 menit. Tingkat Standard dan Fast, plus varian Multi (satu gambar + dua input audio untuk output multi-karakter) dan varian Video-to-Video (gerakkan video yang ada dengan audio baru). Anda dapat memanggilnya secara terprogram atau mencobanya dari playground yang ditautkan di atas.
Bagaimana cara memanggil API InfiniteTalk?
Daftar akun WaveSpeedAI, salin API key Anda dari /accesskey, lalu POST ke https://api.wavespeed.ai/api/v3/wavespeed-ai/infinitetalk dengan input Anda sebagai JSON. Endpoint mengembalikan id prediksi. Lakukan polling pada endpoint hasil dengan interval sekitar 2 detik, perpanjang interval untuk tugas yang berjalan lama, dan berhenti pada status akhir apa pun. Contoh Python / Node.js / cURL untuk produksi ada di atas.
Berapa biaya API InfiniteTalk?
InfiniteTalk mulai dari $0.075 per run. Biaya pastinya menyesuaikan parameter yang Anda atur (resolusi, durasi, jumlah output, referensi). Pratinjau biaya langsung di samping tombol Generate di playground menampilkan harga pasti untuk input Anda saat ini.
Varian InfiniteTalk apa saja yang tersedia?
WaveSpeedAI menyediakan 8 endpoint InfiniteTalk aktif: wavespeed-ai/infinitetalk-fast/video-to-video-multi, wavespeed-ai/infinitetalk-fast/video-to-video, wavespeed-ai/infinitetalk/video-to-video-multi, wavespeed-ai/infinitetalk-fast/multi, wavespeed-ai/infinitetalk-fast, wavespeed-ai/infinitetalk/video-to-video, wavespeed-ai/infinitetalk, wavespeed-ai/infinitetalk/multi. Setiap varian memiliki halaman playground dan harga sendiri.
Bisakah output InfiniteTalk dipakai secara komersial?
Hak penggunaan komersial mengikuti lisensi model WaveSpeedAI. Sebagian besar model WaveSpeedAI mengizinkan penggunaan output secara komersial; lihat halaman playground tiap model untuk ringkasan lisensinya, dan Ketentuan Layanan WaveSpeedAI untuk ketentuan tingkat platform.
Mengapa memakai InfiniteTalk di WaveSpeedAI dan bukan langsung?
Satu API key + satu akun penagihan untuk InfiniteTalk DAN 1.000+ model AI lain dari penyedia lain. Tanpa penyiapan SDK per vendor, tanpa batas laju terpisah, tanpa menulis ulang kode integrasi untuk tiap vendor. Harganya umumnya setara atau di bawah API langsung dari WaveSpeedAI.
Penyedia
Tentang WaveSpeedAI
Tim di balik InfiniteTalk dan jajaran model WaveSpeedAI lainnya di WaveSpeedAI.
WaveSpeedAI menjalankan platform inferensi yang meng-host 1.000+ model AI dari setiap penyedia utama — ByteDance, Google, OpenAI, Alibaba, Kuaishou, ElevenLabs, dan puluhan lab independen — dengan satu API key, satu akun penagihan, dan satu batas rate-limit. WaveSpeedAI juga merilis model first-party (Image / Video Upscaler, Watermark Remover, Animate, InfiniteTalk) yang disetel untuk pipeline produksi.
Mulai membangun dengan InfiniteTalk di WaveSpeedAI
Kredit awal gratis saat mendaftar. Satu API key untuk 1.000+ model AI dari WaveSpeedAI dan semua penyedia lainnya.