Berita AI Video Generation: Model & Pembaruan Terbaru 2026

Tetap terkini tentang AI video generation di 2026. Rangkuman bulanan rilis model baru, perubahan ketersediaan API, pembaruan harga, dan pergeseran kemampuan.

By Dora 10 min read

Hai, saya Dora. Saya memulai kolom ini karena saya terus kehilangan jejak.

Ruang model video AI bergerak begitu cepat sehingga sesuatu yang saya catat di bulan Maret sudah salah pada bulan Mei. Setelah keempat kalinya saya mendapati diri mengutip harga yang sudah berubah, saya menyerah mencoba mengingat dan mulai menuliskannya. Sekali sebulan. Format yang sama. Ini adalah edisi pertama.

Saya bukan jurnalis. Saya bekerja dengan alat-alat ini, dan saya membaca postingan rilis dan diff changelog yang sama seperti orang lain. Yang saya tambahkan — jika saya menambahkan sesuatu — adalah penyaringan. Klaim mana yang sudah saya periksa. Mana yang hanya saya kutip. Mana yang saya ragukan secara terang-terangan. Itulah keseluruhan tugas kolom ini: penelusuran bulanan melalui tumpukan berita pembuatan video AI, dengan label saya di atasnya.

Apa yang Baru dalam Pembuatan Video AI Saat Ini

Cara roundup ini disusun

Enam bagian, urutan yang sama setiap bulan: peluncuran model, akses API, harga, pergeseran kemampuan, langkah industri, apa yang selanjutnya. Ditambah FAQ. Setiap item singkat. Setiap item diberi cap waktu. Saya menandai sumber sebagai resmi (dokumen perusahaan, kartu sistem, halaman rilis), dilaporkan (pers arus utama), atau komunitas (papan peringkat, tolok ukur independen). Ketika ketiganya tidak sepakat, saya mencatatnya. Ketika saya tidak dapat memverifikasi sesuatu secara independen, saya mengatakannya. Saya lebih suka menandai fakta sebagai “belum dikonfirmasi” daripada menyebarkan siaran pers begitu saja.

Cara membaca tanggal “per tanggal”

Saya belajar ini dengan cara yang sulit. Tingkat harga dari Februari tidak bertahan hingga Juni. Kemampuan yang diiklankan pada hari peluncuran dibatasi kecepatannya dalam beberapa minggu. Setiap klaim di sini membawa cap “per tanggal”. Setelah tanggal itu — asumsikan ada perubahan. Saya memeriksa sebelum membangun sesuatu berdasarkan angka mana pun dalam pekerjaan saya sendiri. Anda juga sebaiknya demikian.

Peluncuran Model Baru dan Pembaruan Versi Utama

Rilis terbaru periode ini

Februari hingga Mei adalah periode yang sangat padat untuk rilis model video AI 2026. Saya menghitung ulang dan menemukan empat rilis yang layak dilacak:

  • Kling 3.0 — Dirilis 5 Februari 2026 oleh Kuaishou. Output 4K native, audio multibahasa, arsitektur multi-modal. Dilaporkan menempati posisi teratas di papan peringkat Text-to-Video Artificial Analysis dalam beberapa hari setelah peluncuran. Posisi papan peringkat telah berputar sejak saat itu, jadi saya tidak akan mengutip peringkat itu pada saat Anda membaca ini.
  • Seedance 2.0 — Dirilis 12 Februari 2026 oleh ByteDance. Mencapai #1 di papan peringkat yang sama dengan 1213 Elo dengan audio, per halaman Seedance ByteDance. Rilis ini segera diikuti oleh klip viral yang menampilkan aktor nyata, yang memicu pengawasan hak cipta yang masih belum terselesaikan.
  • Veo 3.1 Lite — Dirilis 31 Maret 2026 oleh Google. Tingkat anggaran tersedia melalui Gemini API dan Google AI Studio. Harga dilaporkan $0,05 per detik untuk 720p. Veo 3.1 penuh tetap menjadi flagship.
  • LTX-2.3 — Dirilis 5 Maret 2026 oleh Lightricks. Rilis point dari lini LTX-2. Lini model open-source pertama yang hadir dengan 4K native, audio, dan bobot terbuka sekaligus.

Empat rilis dalam sekitar seratus hari. Sebagian besar bahasa pemasarannya tumpang tindih — setiap satu dari mereka mengklaim “lompatan” dalam sesuatu. Bagian yang saya pegang lebih sempit: audio native, 4K, dan durasi lebih dari 60 detik kini menjadi standar minimum. Bukan pembeda.

Peluncuran yang diantisipasi untuk dipantau

Dua thread yang saya pantau di peta jalan publik:

  • Wan 3.0 (Alibaba) — Ditargetkan untuk pertengahan 2026 per peta jalan publik Alibaba. Spesifikasi yang dilaporkan: 60B parameter, 4K native, generasi kontinu 30 detik dalam satu pass. Timeline belum dikonfirmasi. Saya tidak bertaruh pada tanggalnya.
  • Model video berikutnya dari OpenAI — Tidak ada tanggal rilis publik. Penurunan Sora (bagian berikutnya) meninggalkan kesenjangan yang jelas.

Ketersediaan API dan Perubahan Akses

Endpoint API baru dan pembaruan SDK

Ini adalah bagian yang menghabiskan uang nyata bagi para pembangun ketika mereka melewatkannya.

  • Penutupan API OpenAI Sora — OpenAI mengumumkan pada 24 Maret 2026 bahwa aplikasi konsumen dan API Sora akan dihentikan. Aplikasi tersebut dimatikan pada 26 April 2026. API dijadwalkan untuk dihentikan pada 24 September 2026, per halaman resmi Sora 2 OpenAI. Saya mengenal dua orang yang sedang dalam proses migrasi. Jendela waktunya lebih pendek dari yang terlihat jika Anda memiliki sesuatu dalam produksi.

  • Veo 3.1 Lite via Gemini APIHalaman model Veo Google mengkonfirmasi akses melalui Gemini API dan Google AI Studio. Pertama kalinya keluarga Veo memiliki tingkat anggaran sejati di balik API publik.

  • API pengembang resmi Seedance 2.0 — Belum dirilis per akhir Mei 2026. Platform pihak ketiga telah mengintegrasikan model di bawah ketentuan lisensi. ByteDance dilaporkan menunda API pengembang sementara sengketa hak cipta dengan studio Hollywood belum terselesaikan. Saya akan menandai ini sebagai layak dipantau — ketika endpoint resmi hadir, perhitungan biaya bagi siapa pun yang saat ini melakukan routing melalui agregator akan berubah.

Ketersediaan wilayah dan pergerakan daftar tunggu

Sora 2 diperluas ke Android di AS, Kanada, Jepang, Korea, Thailand, Vietnam, dan Taiwan selama masa aktifnya. Itu kini menjadi sejarah. Veo 3.1 masih dibatasi di balik autentikasi Google Cloud di beberapa wilayah. Kling terus menjalankan dua lapisan akses (kling.ai untuk internasional, klingai.com untuk China). Tidak ada penghapusan daftar tunggu besar yang saya perhatikan dalam periode ini.

Pembaruan Harga dan Batas Kecepatan

Perubahan harga per detik dan per klip

Semua hal dalam bagian ini memiliki tanggal kedaluwarsa. Saya memverifikasi setiap angka terhadap halaman platform sendiri saat saya menulisnya. Verifikasi ulang sebelum Anda menggunakan salah satunya:

  • Veo 3.1 Lite: $0,05/detik untuk 720p (resmi, Google).
  • Kling 3.0 via API pihak ketiga: sekitar $0,029/detik (dilaporkan, fal.ai).
  • Akses pihak ketiga Seedance 2.0: $0,10–$0,80 per menit tergantung resolusi dan tingkat (dilaporkan; tidak ada tarif resmi untuk dibandingkan).
  • API Sora 2: harga tidak berubah dari peluncuran, tetapi masa pakai fungsional berakhir 24 September 2026.

Pola di seluruh putaran pembaruan harga terbaru pembuatan video AI ini: biaya per detik turun di tingkat anggaran. Harga tingkat flagship tidak bergerak dengan cara yang sama. Untuk pekerjaan volume tinggi, kesenjangan itu lebih penting daripada klaim pemasaran seputar kualitas model.

Perubahan konkurensi dan throughput

Tidak ada peningkatan konkurensi besar yang dipublikasikan dalam periode ini. Beberapa platform secara diam-diam telah beralih dari penagihan credit-bucket ke penagihan per-tugas. Beban kerja yang sama, tagihan yang berbeda — layak dimodelkan jika Anda memperkirakan biaya batch.

Pergeseran Kemampuan yang Penting untuk Produksi

Pembuatan video dengan audio native

Pergeseran lintas-vendor terbesar di kuartal ini. Seedance 2.0, Veo 3.1, dan Kling 3.0 sekarang semuanya menghasilkan video dengan audio tersinkronisasi dalam satu pass. Veo adalah satu-satunya yang secara andal menghasilkan dialog 48kHz, per dokumentasi Google. Yang lain menangani SFX, ambient, dan sinkronisasi bibir kasar. Pipeline dua langkah (hasilkan video, kemudian lapisi audio) runtuh menjadi satu.

Output koheren yang lebih panjang

Sora 2 mendorong hingga 25 detik. Kling 3.0 diperluas hingga 60 detik. Keduanya mempertahankan kontinuitas identitas sepanjang durasi dengan hasil yang beragam — hasilnya bervariasi berdasarkan kompleksitas subjek. Makalah penelitian dari akhir Q1 merujuk “Long-Context Video Transformers” yang menargetkan segmen koheren 10–20 menit. Tidak satu pun dari itu yang sudah dirilis.

Konsistensi karakter dan adegan

“Ingredients to Video” Veo 3.1 menerima hingga tiga gambar referensi per generasi. Seedance 2.0 menggunakan penambatan ruang laten di seluruh klip 60 detik. Kling 3.0 mendukung hingga enam shot yang terhubung dalam mode multi-shot. Tidak ada yang sempurna. Semua lebih baik dari yang dirilis enam bulan lalu. Itulah yang dapat saya konfirmasi tanpa menjalankan perbandingan sendiri, yang belum saya lakukan bulan ini.

Langkah Industri yang Relevan bagi Pembangun

Kemitraan dan integrasi ekosistem

  • Kemitraan OpenAI–Disney — Dilaporkan kesepakatan $1 miliar untuk generasi karakter berlisensi. Kemitraan studio-AI pertama dalam skala ini. Apa artinya bagi alur kerja berlisensi IP masih berkembang; saya tidak akan menebak.
  • Penggalangan dana Runway $315 juta — Ditutup selama periode ini. Modal terus mengalir ke lapisan pipeline produksi (pre-vis, storyboarding, integrasi VFX) daripada hanya ke lapisan model.
  • Valuasi Luma di $4 miliar — Dilaporkan. Sinyal yang sama dengan penggalangan dana Runway — lapisan alat produksi adalah taruhan yang tahan lama yang dibuat investor siklus ini.

Kebijakan, keamanan, dan watermarking

Saya hampir melewati bagian ini. Kemudian saya teringat mengapa saya tidak seharusnya.

  • Pasal 50 Undang-Undang AI UE — Penegakan dimulai 2 Agustus 2026. Mengharuskan penandaan yang dapat dibaca mesin pada semua video yang dihasilkan AI yang didistribusikan ke audiens UE. Denda hingga €15 juta atau 3% dari omset tahunan worldwide.
  • California SB 942 — Berlaku 1 Januari 2026. Persyaratan pengungkapan untuk konten yang dihasilkan AI yang didistribusikan di California.
  • C2PA Content Credentials — Seedance 2.0 hadir dengan watermarking C2PA bawaan. TikTok telah memberi label lebih dari 1,3 miliar video yang dihasilkan AI menggunakan deteksi C2PA. Dokumen referensi adalah spesifikasi teknis C2PA. SynthID Google diluncurkan sebagai watermark tingkat piksel yang saling melengkapi.

Jika pipeline Anda menghasilkan video untuk distribusi UE atau California dan Anda belum memiliki rencana kepatuhan sebelum Agustus, itulah pekerjaan yang akan saya prioritaskan bulan ini. Ini adalah jenis hal yang ditemukan terlambat.

Apa yang Perlu Dipantau Selanjutnya

Tiga thread yang akan saya lacak sepanjang Q3:

  1. Apakah Wan 3.0 dirilis sesuai target pertengahan 2026, dan apakah cerita bobot terbuka bertahan pada 60B parameter.
  2. Apa yang mengisi kesenjangan yang ditinggalkan ketika API Sora berakhir pada 24 September.
  3. Bagaimana penegakan Pasal 50 UE berjalan dalam 60 hari pertama — khususnya apakah platform unggah menghapus metadata C2PA, dan di mana kewajiban jatuh ketika mereka melakukannya.

FAQ

Seberapa sering lanskap pembuatan video AI sebenarnya berubah?

Dalam pelacakan saya sendiri, siklus berita pembuatan video AI telah berkompres menjadi sekitar bulanan untuk rilis model utama dan mingguan untuk pembaruan kemampuan dan pembaruan generator video AI. Pergeseran harga terjadi di tengah kuartal. Sinyal yang paling saya percayai: pergerakan papan peringkat, diff dokumentasi API, pengeditan halaman harga. Pengumuman peluncuran saya beri bobot lebih rendah — terlalu banyak hal yang diumumkan tidak dirilis tepat waktu, atau dirilis di balik daftar tunggu.

Rilis model terbaru mana yang paling relevan bagi pembangun?

Saya tidak akan memberi tahu Anda model mana yang harus dipilih. Tetapi rilis model video AI 2026 yang layak dievaluasi saat ini, berdasarkan apa yang dirilis periode ini: Veo 3.1 untuk dialog audio-native, Kling 3.0 untuk volume iterasi yang seimbang biayanya, Seedance 2.0 untuk adegan berat gerakan ketika (dan jika) API resmi hadir. Sora 2 masuk dalam percakapan migrasi, bukan percakapan build-baru, mengingat sunset 24 September.

Bagaimana perubahan harga terbaru mempengaruhi perencanaan produksi?

Harga per detik di tingkat anggaran turun lebih cepat daripada di tingkat flagship. Jika Anda sebagian besar memproduksi pada 720p, tingkat Veo 3.1 Lite dan akses Kling pihak ketiga secara material menggeser model biaya. Periksa tarif saat ini terhadap pembaruan generator video AI terbaru sebelum mengunci anggaran — saya belum pernah melihat harga dalam kategori ini tetap stabil selama satu kuartal penuh di titik mana pun di tahun 2026.

Pergeseran kemampuan apa yang harus dipantau pembangun sepanjang 2026?

Tiga hal, dalam berita industri video AI yang lebih luas yang layak dilacak: generasi audio-native menjadi standar (berhenti menjadi pembeda pada akhir tahun, dalam bacaan saya), konsistensi karakter yang diperluas melewati 60 detik, dan penandaan provenance yang dapat dibaca mesin menjadi wajib untuk distribusi UE pada 2 Agustus. Yang ketiga tidak opsional. Yang pertama dan kedua mempengaruhi cara Anda memilih model. Yang ketiga mempengaruhi apakah Anda dapat merilis ke pasar tertentu sama sekali.

Postingan sebelumnya: