#model-release
306 articles - Page 22

Présentation de Runway Upscale V1 sur WaveSpeedAI
RunwayML Upscale V1 augmente les vidéos en 4K via un simple téléchargement de fichier, facturé à 0,02 $/s pour un upscaling rapide et de haute qualité. API d'inférence REST prête à l'emploi, meilleures performances, pas de démarrages à froid, tarification abordable.

Présentation de Ace Step Prompt To Audio sur WaveSpeedAI
ACE-Step Prompt-to-Audio crée de la musique à partir de simples invites, générant automatiquement les balises de genre et les paroles pour une création de chansons rapide. API d'inférence REST prête à l'emploi, meilleures performances, sans démarrages à froid, tarification abordable.

Présentation du modérateur de contenu d'images sur WaveSpeedAI
Image Content Moderator fournit une modération d'images automatisée pour détecter et signaler les images violant les politiques ou inappropriées pour l'automatisation. API d'inférence REST prête à l'emploi, meilleures performances, sans démarrages à froid, tarification abordable.

Présentation de Minicpm V Image sur WaveSpeedAI
MiniCPM-V 4.5 est le dernier et le plus capable modèle d'image MiniCPM-V pour une compréhension et une analyse précises des images par l'IA dans toutes les tâches visuelles. API d'inférence REST prête à l'emploi, meilleures performances, pas de démarrages à froid, tarification abordable.

Présentation de Minicpm V Video sur WaveSpeedAI
MiniCPM-V 4.5 est le dernier modèle MiniCPM-V le plus capable pour la compréhension et l'analyse vidéo par IA. API d'inférence REST prête à l'emploi, meilleures performances, pas de démarrages à froid, tarification abordable.

Présentation de WAN 2.2 Image To Image sur WaveSpeedAI
WAN 2.2 (14B) est un modèle image-à-image pour l'édition d'images photorréalistes haute résolution avec une précision et une fidélité exceptionnelles. API d'inférence REST prête à l'emploi, meilleures performances, pas de démarrages à froid, tarification abordable.

Présentation d'Alibaba Qwen3 TTS Flash sur WaveSpeedAI
Alibaba Qwen3 TTS Flash : synthèse vocale à faible latence pour l'anglais et le chinois avec plusieurs voix, idéale pour le dialogue en temps réel. API d'inférence REST prête à l'emploi, meilleures performances, pas de démarrages à froid, tarification abordable.

Présentation de ByteDance LatentSync sur WaveSpeedAI
ByteDance LatentSync combine Stable Diffusion et TREPA pour un lip-sync end-to-end haute résolution, offrant des mouvements de bouche précis et réalistes dans les vidéos générées. API REST d'inférence prête à l'emploi, meilleures performances, pas de démarrages à froid, tarification abordable.

Présentation de Sam 3d Body sur WaveSpeedAI
Modèle avancé de génération de corps 3D SAM pour créer des modèles de corps humains 3D détaillés à partir d'images avec segmentation basée sur masque optionnelle. API d'inférence REST prête à l'emploi, meilleures performances, pas de démarrages à froid, tarification abordable.

Présentation de Sam 3d Objects sur WaveSpeedAI
Modèle avancé de génération d'objets SAM 3D pour créer des modèles d'objets 3D détaillés à partir d'images avec des invites textuelles et une segmentation optionnelle basée sur le masque. API d'inférence REST prête à l'emploi, meilleures performances, sans démarrages à froid, tarification abordable.

Présentation de Any Llm sur WaveSpeedAI
Any LLM est un grand modèle de langage polyvalent pour la génération de texte, la compréhension et diverses tâches de traitement du langage naturel telles que le chat et la synthèse. API d'inférence REST prête à l'emploi, meilleures performances, pas de démarrages à froid, tarification abordable.

Présentation de Real ESRGAN sur WaveSpeedAI
Real-ESRGAN offre une super-résolution d'image haute qualité avec correction faciale optionnelle et facteurs d'upscale ajustables. API d'inférence REST prête à l'emploi, performances optimales, pas de démarrages à froid, tarification abordable.