WaveSpeedAI
Memperkenalkan Molmo2 Video Captioner di WaveSpeedAI

Memperkenalkan Molmo2 Video Captioner di WaveSpeedAI

Molmo2-4B Video Captioner: Hasilkan keterangan video yang detail dan akurat dengan tingkat detail yang dapat disesuaikan (rendah, sedang, tinggi). Mode visi-bahasa sumber terbuka

6 min read
Memperkenalkan Molmo2 Video Content Moderator di WaveSpeedAI

Memperkenalkan Molmo2 Video Content Moderator di WaveSpeedAI

Molmo2-4B Video Content Moderator menganalisis konten video untuk keamanan, kesesuaian, dan kepatuhan kebijakan. Mendeteksi kekerasan, nuditas, gore, dan konten berbahaya lainnya

6 min read
Memperkenalkan Molmo2 Video Qa di WaveSpeedAI

Memperkenalkan Molmo2 Video Qa di WaveSpeedAI

Molmo2-4B Video QA: Jawab pertanyaan tentang konten video dengan pemahaman temporal. Model visi-bahasa sumber terbuka. REST API siap pakai, tanpa cold starts,

6 min read
Memperkenalkan Pemahaman Video Molmo2 di WaveSpeedAI

Memperkenalkan Pemahaman Video Molmo2 di WaveSpeedAI

Molmo2-4B Pemahaman Video: Analisis video dengan tugas khusus (umum, ringkasan, analisis, penghitungan, deskripsi adegan). Model visi-bahasa sumber terbuka

6 min read
Memperkenalkan Openai Whisper With Video on WaveSpeedAI

Memperkenalkan Openai Whisper With Video on WaveSpeedAI

OpenAI Whisper Large v3 (Video-to-Text) memberikan transkripsi multibahasa dengan akurasi tinggi langsung dari file video, dengan deteksi bahasa otomatis dan opsi

5 min read
Memperkenalkan Paddle OCR di WaveSpeedAI

Memperkenalkan Paddle OCR di WaveSpeedAI

PaddleOCR-VL adalah model visi-bahasa ultra-kompak dengan 0,9B parameter untuk parsing dokumen, mendukung 109 bahasa dengan pengenalan teks, tabel, formula, dan bagan

5 min read
Memperkenalkan Qwen Image 2512 LoRA Trainer di WaveSpeedAI

Memperkenalkan Qwen Image 2512 LoRA Trainer di WaveSpeedAI

Qwen-Image-2512 LoRA Trainer memungkinkan Anda melatih model LoRA khusus 10x lebih cepat dengan pelatihan gaya, karakter, dan objek. Dari konsep ke model dalam hitungan menit, bukan jam

5 min read
Memperkenalkan Qwen Image Text-to-Image 2512 LoRA di WaveSpeedAI

Memperkenalkan Qwen Image Text-to-Image 2512 LoRA di WaveSpeedAI

Qwen-Image-2512 LoRA adalah model text-to-image MMDiT 20B yang ditingkatkan dengan dukungan LoRA untuk kustomisasi cepat dan pembuatan gambar yang disempurnakan. REST infer siap digunakan

5 min read
Memperkenalkan Video Background Remover di WaveSpeedAI

Memperkenalkan Video Background Remover di WaveSpeedAI

WaveSpeed Video Background Remover mengganti atau menghapus latar belakang video dengan gambar kustom. Unggah atau tempel tautan video Anda, lalu sediakan gambar latar belakang

5 min read
Memperkenalkan Z Image Turbo Controlnet di WaveSpeedAI

Memperkenalkan Z Image Turbo Controlnet di WaveSpeedAI

Z-Image-Turbo ControlNet menghasilkan gambar yang dipandu oleh sinyal kontrol struktural (kedalaman, canny edge, pose) untuk kontrol komposisi yang presisi. REST infe siap pakai

6 min read
xAI Grok 2 Image Kini Tersedia di WaveSpeedAI

xAI Grok 2 Image Kini Tersedia di WaveSpeedAI

Grok 2 Image adalah model generasi gambar terbaru dari xAI yang mengubah prompt teks sederhana menjadi visual fotorealistis yang tajam dalam hitungan detik. Dari foto produk hingga media sosial

5 min read
Z AI Glm Image Edit Kini Tersedia di WaveSpeedAI

Z AI Glm Image Edit Kini Tersedia di WaveSpeedAI

GLM-Image Edit adalah model pengeditan gambar-ke-gambar yang powerful, mengubah gambar berdasarkan perintah teks. REST inference API siap pakai, performa terbaik, tanpa ko

6 min read