#model-release
306 articles - Page 22

Runway Upscale V1 auf WaveSpeedAI verfügbar
RunwayML Upscale V1 skaliert Videos auf 4K durch einfaches Datei-Upload, abgerechnet mit $0,02/Sek. für schnelle, hochwertige Hochskalierung. Einsatzbereite REST-Inference-API, beste Leistung, keine Kaltstartverzögerungen, erschwingliche Preise.

Einführung von Ace Step Prompt To Audio auf WaveSpeedAI
ACE-Step Prompt-to-Audio erstellt Musik aus einfachen Eingaben und generiert automatisch Genre-Tags und Liedtexte für schnelle Songproduktion. Einsatzbereite REST-Inferenz-API, beste Leistung, keine Kaltstarts, günstige Preise.

Content Moderator Image auf WaveSpeedAI einführen
Image Content Moderator bietet automatisierte Bildmoderation zur Erkennung und Kennzeichnung von richtlinienverletzenden oder unangemessenen Bildern. Einsatzbereite REST-Inferenz-API, beste Leistung, keine Kaltstarts, erschwingliche Preise.

Einführung von Minicpm V Image auf WaveSpeedAI
MiniCPM-V 4.5 ist das neueste und leistungsfähigste MiniCPM-V-Bildmodell für genaues KI-Bildverständnis und -analyse über visuelle Aufgaben hinweg. REST-Inferenz-API einsatzbereit, beste Leistung, keine Kaltstarts, erschwingliche Preise.

Einführung von Minicpm V Video auf WaveSpeedAI
MiniCPM-V 4.5 ist das neueste und leistungsfähigste MiniCPM-V-Modell für KI-Videoverständnis und -Analyse. Sofort einsatzbereit REST-Inferenz-API, beste Leistung, keine Kaltstart-Zeiten, erschwingliche Preise.

Einführung von WAN 2.2 Image To Image auf WaveSpeedAI
WAN 2.2 (14B) ist ein Image-to-Image-Modell für hochauflösende fotorealistische Bildbearbeitung mit außergewöhnlicher Präzision und Treue. Einsatzbereite REST-Inference-API, beste Leistung, keine Kaltstart-Probleme, erschwingliche Preise.

Einführung von Alibaba Qwen3 TTS Flash auf WaveSpeedAI
Alibaba Qwen3 TTS Flash: Niedrig-Latenz-Text-zu-Sprache für Englisch und Chinesisch mit mehreren Stimmen, ideal für Echtzeit-Dialoge. Sofort einsetzbare REST-Inference-API, beste Leistung, keine Kaltstarts, erschwingliche Preisgestaltung.

ByteDance LatentSync jetzt auf WaveSpeedAI verfügbar
ByteDance LatentSync kombiniert Stable Diffusion und TREPA für hochauflösende End-to-End-Lippensynchronisation und liefert präzise, realistische Mundbewegungen in generierten Videos. Sofort einsetzbare REST-Inference-API, beste Leistung, keine Kaltstarts, erschwingliche Preise.

Einführung von Sam 3d Body auf WaveSpeedAI
Fortschrittliches SAM 3D-Körpergenerierungsmodell zur Erstellung detaillierter 3D-Menschenmodelle aus Bildern mit optionaler maskierter Segmentierung. Sofort einsetzbare REST-Inferenz-API, beste Leistung, keine Kaltstarts, erschwingliche Preise.

Einführung von Sam 3D Objects auf WaveSpeedAI
Fortschrittliches SAM 3D-Objektgenerierungsmodell zur Erstellung detaillierter 3D-Objektmodelle aus Bildern mit Textaufforderungen und optionaler maskierter Segmentierung. Sofort einsatzbereite REST-Inferenz-API, beste Leistung, keine Kaltstarts, erschwingliche Preisgestaltung.

Einführung von Any Llm auf WaveSpeedAI
Any LLM ist ein vielseitiges großes Sprachmodell für Textgenerierung, Sprachverständnis und diverse NLP-Aufgaben wie Chat und Zusammenfassung. Einsatzbereite REST-Inferenz-API, beste Leistung, keine Kaltstarts, erschwingliche Preisgestaltung.

Einführung von Real ESRGAN auf WaveSpeedAI
Real-ESRGAN bietet hochwertige Bild-Upscaling mit optionaler Gesichtskorrektur und anpassbaren Upscaling-Faktoren. Sofort einsatzbereit REST-API, beste Leistung, keine Kaltstart-Zeiten, erschwingliche Preise.