#model-release
306 articles - Page 22

Presentando Runway Upscale V1 en WaveSpeedAI
RunwayML Upscale V1 aumenta la escala de videos a 4K mediante carga simple de archivos, facturado a $0.02/seg para aumento de escala rápido y de alta calidad. API de inferencia REST lista para usar, mejor rendimiento, sin arranques en frío, precios asequibles.

Presentando Ace Step Prompt To Audio en WaveSpeedAI
ACE-Step Prompt-to-Audio crea música a partir de indicaciones simples, generando automáticamente etiquetas de género y letras para una creación rápida de canciones. API de inferencia REST lista para usar, mejor rendimiento, sin arranques en frío, precios asequibles.

Presentamos Content Moderator Image en WaveSpeedAI
Image Content Moderator proporciona moderación automática de imágenes para detectar e identificar imágenes que violan políticas o inapropiadas para automatización. API REST de inferencia lista para usar, mejor rendimiento, sin arranques en frío, precios asequibles.

Presentamos Minicpm V Image en WaveSpeedAI
MiniCPM-V 4.5 es el último y más capaz modelo de imagen MiniCPM-V para una comprensión y análisis de imágenes de IA preciso en todas las tareas visuales. API de inferencia REST lista para usar, mejor rendimiento, sin arranques en frío, precios asequibles.

Presentamos Minicpm V Video en WaveSpeedAI
MiniCPM-V 4.5 es el último y más capaz modelo MiniCPM-V para comprensión y análisis de vídeo con IA. API de inferencia REST lista para usar, mejor rendimiento, sin arranques en frío, precios asequibles.

Presentación de WAN 2.2 Image To Image de en WaveSpeedAI
WAN 2.2 (14B) es un modelo de imagen a imagen para edición de imágenes fotorrealistas de alta resolución con precisión y fidelidad excepcionales. API de inferencia REST lista para usar, mejor rendimiento, sin arranques en frío, precios asequibles.

Introducción de Alibaba Qwen3 TTS Flash en WaveSpeedAI
Alibaba Qwen3 TTS Flash: Síntesis de voz de baja latencia para inglés y chino con múltiples voces, ideal para diálogos en tiempo real. API de inferencia REST lista para usar, mejor rendimiento, sin inicios en frío, precios asequibles.

Presentamos ByteDance LatentSync en WaveSpeedAI
ByteDance LatentSync combina Stable Diffusion y TREPA para sincronización de labios de alta resolución de extremo a extremo, entregando movimientos de boca precisos y realistas en videos generados. API de inferencia REST lista para usar, mejor rendimiento, sin arranques en frío, precios asequibles.

Presentando Sam 3d Body en WaveSpeedAI
Modelo avanzado de generación de cuerpo SAM 3D para crear modelos detallados de cuerpo humano en 3D a partir de imágenes con segmentación basada en máscara opcional. API de inferencia REST lista para usar, mejor rendimiento, sin arranques en frío, precios asequibles.

Presentando Sam 3d Objects en WaveSpeedAI
Modelo avanzado de generación de objetos SAM 3D para crear modelos de objetos 3D detallados a partir de imágenes con indicaciones de texto y segmentación opcional basada en máscaras. API de inferencia REST lista para usar, mejor rendimiento, sin arranques en frío, precios asequibles.

Presentando Any LLM en WaveSpeedAI
Any LLM es un modelo de lenguaje grande versátil para generación de texto, comprensión y diversas tareas de PNL como chat y resumen. API de inferencia REST lista para usar, mejor rendimiento, sin arranques en frío, precios asequibles.

Introducción a Real ESRGAN en WaveSpeedAI
Real-ESRGAN ofrece super-resolución de imágenes de alta calidad con corrección facial opcional y factores de ampliación ajustables. API REST de inferencia lista para usar, mejor rendimiento, sin arranques en frío, precios asequibles.