#model-release
306 articles - Page 21

Presentamos Google Gemini 2.5 Flash Image Text-to-Image en WaveSpeedAI
Google Gemini 2.5 Flash Image ofrece generación avanzada de imágenes a partir de texto y edición de imágenes con controles creativos para imágenes de calidad. API de inferencia REST lista para usar, mejor rendimiento, sin arranques en frío, precios asequibles.

Presentamos Kuaishou Kling LipSync Audio To Video en WaveSpeedAI
Kling LipSync convierte audio en video de cabeza parlante generando movimientos de labios realistas perfectamente sincronizados con el audio de entrada. API REST de inferencia lista para usar, mejor rendimiento, sin arranques en frío, precios asequibles.

Presentamos Luma Ray 2 Flash T2V en WaveSpeedAI
Luma Ray 2 Flash convierte texto en videos de alta calidad con tamaños flexibles y optimización de prompts incorporada para resultados precisos. API REST de inferencia lista para usar, mejor rendimiento, sin arranques en frío, precios asequibles.

Presentando Luma Ray 2 T2V en WaveSpeedAI
Luma Ray 2 es un modelo de texto a vídeo que crea vídeos de alta calidad a partir de indicaciones de texto, con optimización avanzada de indicaciones y soporte para varios tamaños de vídeo. API de inferencia REST lista para usar, mejor rendimiento, sin arranques en frío, precios asequibles.

Presentamos Steady Dancer en WaveSpeedAI
SteadyDancer es un marco de animación de imágenes humanas de 14B parámetros que transforma imágenes estáticas en videos de baile coherentes. Presenta preservación del primer fotograma, consistencia robusta de identidad y coherencia temporal para generación de movimiento realista. API de inferencia REST lista para usar, mejor rendimiento, sin arranque en frío

Presentamos MiniMax Speech 2.5 HD Preview en WaveSpeedAI
MiniMax Speech 2.5 HD Preview ofrece TTS en HD con expresividad multilingüe mejorada, clonación de voz precisa y soporte para 40 idiomas. API REST lista para usar, mejor rendimiento, sin arranques en frío, precios asequibles.

Presentación de MiniMax Speech 2.6 HD en WaveSpeedAI
MiniMax Speech 2.6 HD: TTS ultrahumano, baja latencia (< 250ms) con clonación de voz, normalización de texto y soporte para más de 40 idiomas. API de inferencia REST lista para usar, mejor rendimiento, sin inicios en frío, precios asequibles.

Presentando MiniMax Speech 2.6 Turbo en WaveSpeedAI
MiniMax Speech 2.6 Turbo es un modelo Text-to-Speech que ofrece clonación de voz ultrahumana, normalización de texto líder en la industria, latencia inferior a 250ms y soporte para más de 40 idiomas. Precio: $0.06 por 1000 caracteres. API de inferencia REST lista para usar, mejor rendimiento, sin inicios en frío, precios asequibles.

Presentamos Clarity AI Crystal Upscaler en WaveSpeedAI
Clarity AI Crystal Upscaler aumenta la resolución de imágenes con escalado impulsado por IA y ajuste de detalles para retratos y paisajes. API de inferencia REST lista para usar, mejor rendimiento, sin arranques en frío, precios asequibles.

Presentamos MiniMax Speech 2.5 Turbo Preview en WaveSpeedAI
MiniMax Speech 2.5 Turbo Preview: TTS HD con soporte multilingüe, replicación precisa de voz en más de 40 idiomas. $0.04/1000 caracteres. API REST de inferencia lista para usar, mejor rendimiento, sin inicio en frío, precios asequibles.

Presentando OpenAI Whisper en WaveSpeedAI
Whisper Large v3 de voz a texto: transcripciones multilingües instantáneas y precisas con detección automática de idioma y puntuación. Carga audio para obtener transcripciones. API REST lista para usar, sin inicios en frío, precios asequibles.

Presentando OpenAI GPT Image 1.5 Text-to-Image en WaveSpeedAI
GPT Image 1.5 text to image es el generador de texto a imagen rápido y rentable de OpenAI, potenciado por orientación GPT-5. Crea fotografías fotorrealistas, renders de productos, arte conceptual y gráficos estilizados a partir de indicaciones en lenguaje natural (opcionalmente condicionadas con una imagen). Soporta relaciones de aspecto personalizadas, seed