
Memperkenalkan Molmo2 Video Captioner di WaveSpeedAI
Molmo2-4B Video Captioner: Hasilkan keterangan video yang detail dan akurat dengan tingkat detail yang dapat disesuaikan (rendah, sedang, tinggi). Mode visi-bahasa sumber terbuka

Memperkenalkan Molmo2 Video Content Moderator di WaveSpeedAI
Molmo2-4B Video Content Moderator menganalisis konten video untuk keamanan, kesesuaian, dan kepatuhan kebijakan. Mendeteksi kekerasan, nuditas, gore, dan konten berbahaya lainnya

Memperkenalkan Molmo2 Video Qa di WaveSpeedAI
Molmo2-4B Video QA: Jawab pertanyaan tentang konten video dengan pemahaman temporal. Model visi-bahasa sumber terbuka. REST API siap pakai, tanpa cold starts,

Memperkenalkan Pemahaman Video Molmo2 di WaveSpeedAI
Molmo2-4B Pemahaman Video: Analisis video dengan tugas khusus (umum, ringkasan, analisis, penghitungan, deskripsi adegan). Model visi-bahasa sumber terbuka

Memperkenalkan Openai Whisper With Video on WaveSpeedAI
OpenAI Whisper Large v3 (Video-to-Text) memberikan transkripsi multibahasa dengan akurasi tinggi langsung dari file video, dengan deteksi bahasa otomatis dan opsi

Memperkenalkan Paddle OCR di WaveSpeedAI
PaddleOCR-VL adalah model visi-bahasa ultra-kompak dengan 0,9B parameter untuk parsing dokumen, mendukung 109 bahasa dengan pengenalan teks, tabel, formula, dan bagan

Memperkenalkan Qwen Image 2512 LoRA Trainer di WaveSpeedAI
Qwen-Image-2512 LoRA Trainer memungkinkan Anda melatih model LoRA khusus 10x lebih cepat dengan pelatihan gaya, karakter, dan objek. Dari konsep ke model dalam hitungan menit, bukan jam

Memperkenalkan Qwen Image Text-to-Image 2512 LoRA di WaveSpeedAI
Qwen-Image-2512 LoRA adalah model text-to-image MMDiT 20B yang ditingkatkan dengan dukungan LoRA untuk kustomisasi cepat dan pembuatan gambar yang disempurnakan. REST infer siap digunakan

Memperkenalkan Video Background Remover di WaveSpeedAI
WaveSpeed Video Background Remover mengganti atau menghapus latar belakang video dengan gambar kustom. Unggah atau tempel tautan video Anda, lalu sediakan gambar latar belakang

Memperkenalkan Z Image Turbo Controlnet di WaveSpeedAI
Z-Image-Turbo ControlNet menghasilkan gambar yang dipandu oleh sinyal kontrol struktural (kedalaman, canny edge, pose) untuk kontrol komposisi yang presisi. REST infe siap pakai

xAI Grok 2 Image Kini Tersedia di WaveSpeedAI
Grok 2 Image adalah model generasi gambar terbaru dari xAI yang mengubah prompt teks sederhana menjadi visual fotorealistis yang tajam dalam hitungan detik. Dari foto produk hingga media sosial

Z AI Glm Image Edit Kini Tersedia di WaveSpeedAI
GLM-Image Edit adalah model pengeditan gambar-ke-gambar yang powerful, mengubah gambar berdasarkan perintah teks. REST inference API siap pakai, performa terbaik, tanpa ko