Nano Banana 2.1 ya DISPONIBLE — Lo último de Google | Pruébalo →
MiniMaxAPI de vídeoDesde $0.02/ejecución

MiniMax H3 API

La API de MiniMax H3 para generación cinematográfica de texto a vídeo, imagen a vídeo y referencia a vídeo, con audio estéreo nativo, gran calidad de movimiento, consistencia del sujeto y coherencia de escena. Ejecuta la versión de pesos abiertos en la infraestructura de WaveSpeed o los endpoints oficiales de MiniMax a través de una sola API de WaveSpeedAI.

Genera vídeos cinematográficos con IA a partir de prompts de texto, imágenes fijas o referencias visuales. El despliegue de pesos abiertos recomendado, en la infraestructura de WaveSpeed (wavespeed-ai/minimax-h3), ofrece vídeos coherentes en 480p/540p/768p/1080p con audio estéreo nativo, duraciones de 3 a 15 segundos y precios asequibles por segundo, con los endpoints oficiales de MiniMax disponibles en la misma familia.

Resumen

Acerca de MiniMax H3 API

Qué hace MiniMax H3, cómo encaja en la gama de modelos de MiniMax y por qué los equipos lo eligen.

MiniMax H3 es un modelo de generación de vídeo de MiniMax, disponible a través de la API REST de WaveSpeedAI. La API de MiniMax H3 para generación cinematográfica de texto a vídeo, imagen a vídeo y referencia a vídeo, con audio estéreo nativo, gran calidad de movimiento, consistencia del sujeto y coherencia de escena. Ejecuta la versión de pesos abiertos en la infraestructura de WaveSpeed o los endpoints oficiales de MiniMax a través de una sola API de WaveSpeedAI.

Genera vídeos cinematográficos con IA a partir de prompts de texto, imágenes fijas o referencias visuales. El despliegue de pesos abiertos recomendado, en la infraestructura de WaveSpeed (wavespeed-ai/minimax-h3), ofrece vídeos coherentes en 480p/540p/768p/1080p con audio estéreo nativo, duraciones de 3 a 15 segundos y precios asequibles por segundo, con los endpoints oficiales de MiniMax disponibles en la misma familia.

La familia MiniMax H3 en WaveSpeedAI incluye 20 endpoints REST que cubren los flujos de trabajo de Motion-Control, Image-To-Video, Reference-To-Video, Image-To-Image, Text-To-Image, Video-To-Video, Video-Extend, Text-To-Video. Cada variante tiene su propio precio, parámetros y ejemplos de resultados: elige la que se ajuste a tu modalidad de entrada y a tus requisitos de producción, o llama a varias con la misma clave de API para componer flujos de varios pasos.

Ejecuta MiniMax H3 con la misma clave de API, la misma cuenta de facturación y los mismos límites de uso que ya usas para los demás más de 1.000 modelos de IA de WaveSpeedAI. Sin configuración aparte por proveedor, sin SDK por proveedor, sin límites de uso distintos por proveedor: una sola integración lo cubre todo, desde texto a imagen y texto a vídeo hasta síntesis de audio, generación 3D, escalado y edición.

Especificaciones

Capacidades y estado de lanzamiento de MiniMax H3 API

Los detalles específicos del modelo que los desarrolladores buscan antes de elegir una API: disponibilidad, duración esperada del resultado, compatibilidad con referencias y la alternativa en producción actual.

Texto a vídeo

Generación guiada por prompts

Usa wavespeed-ai/minimax-h3/text-to-video para convertir un brief creativo escrito en un vídeo coherente en 480p/540p/768p/1080p con audio estéreo nativo, duraciones de 3 a 15 segundos y relaciones de aspecto flexibles.

Imagen a vídeo

Anima una imagen fija

Usa wavespeed-ai/minimax-h3/image-to-video para animar una imagen de primer fotograma (opcionalmente con un último fotograma) y obtener un vídeo coherente con audio estéreo nativo que traslada al movimiento el sujeto, el encuadre y la dirección de arte.

Referencia a vídeo

Guía la identidad y el estilo

Usa wavespeed-ai/minimax-h3/reference-to-video para guiar la generación con hasta 9 imágenes de referencia, 3 vídeos de referencia y 3 audios de referencia cuando el sujeto, la identidad del personaje o el estilo deban mantenerse consistentes.

Integración de API

Un único flujo de WaveSpeedAI

Envía predicciones de H3 con tu clave de API de WaveSpeedAI, sigue cada solicitud a través del ciclo de vida estándar de predicciones y obtén los vídeos generados de la respuesta del resultado. Es el mismo flujo para los endpoints alojados en WaveSpeed y los oficiales de MiniMax.

Endpoints

Todos los endpoints de la API de MiniMax H3

20 endpoints de MiniMax H3 disponibles ahora en WaveSpeedAI: elige la variante que se ajuste a tu flujo de trabajo.

50 % DTO.motion-controlMinimax H3 Controlnet Union — vista previa de motion-control de MiniMax H3 de MiniMax

Minimax H3 Controlnet Union

MiniMax H3 Open Weights ControlNet Union generates a new video that follows the motion and composition of a source video. Pose, depth, edges, lines, scribble or grayscale structure is extracted from the source automatically and guides the output, optionally with reference images for the subject or style, with native stereo audio generated in the same pass. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.30desde $0.15
50 % DTO.image-to-videoMinimax H3 Singularity Image To Video Lora — vista previa de image-to-video de MiniMax H3 de MiniMax

Minimax H3 Singularity Image To Video Lora

MiniMax H3 Singularity Open Weights Image to Video animates a first-frame image, optionally with last-frame guidance, into coherent 480P / 540P / 768P videos with native stereo audio, 5-15 second duration, flexible aspect ratios, and per-second billing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.3125desde $0.1563
50 % DTO.image-to-videoMinimax H3 Singularity Image To Video — vista previa de image-to-video de MiniMax H3 de MiniMax

Minimax H3 Singularity Image To Video

MiniMax H3 Singularity Open Weights Image-to-Video animates a first-frame image, with optional last-frame guidance, into coherent 480P / 540P / 768P videos with native stereo audio, 5-15 second duration, flexible aspect ratios, and per-second billing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.25desde $0.125
50 % DTO.reference-to-videoMinimax H3 Singularity Reference To Video Lora — vista previa de reference-to-video de MiniMax H3 de MiniMax

Minimax H3 Singularity Reference To Video Lora

MiniMax H3 Singularity Open Weights Reference to Video with custom LoRA support generates coherent 480P / 540P / 768P videos from prompts and multimodal references, guided by up to 9 reference images, 3 reference videos, and 3 reference audios, with native stereo audio and flexible reference-based video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.30desde $0.15
50 % DTO.reference-to-videoMinimax H3 Singularity Reference To Video — vista previa de reference-to-video de MiniMax H3 de MiniMax

Minimax H3 Singularity Reference To Video

MiniMax H3 Singularity Open Weights Reference to Video generates coherent 480P / 540P / 768P videos from prompts and multimodal references, guided by up to 9 reference images, 3 reference videos, and 3 reference audios, with native stereo audio and flexible reference-based video generation on WaveSpeedAI infrastructure. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.25desde $0.125
image-to-imageMinimax H3 Image Edit Lora — vista previa de image-to-image de MiniMax H3 de MiniMax

Minimax H3 Image Edit Lora

MiniMax H3 Open Weights Image Edit re-renders a subject from up to 9 reference images into a new scene, outfit or style from a text instruction, preserving identity at 1K or 2K resolution. Loads up to 3 custom LoRA weights per request. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

desde $0.03
text-to-imageMinimax H3 Text To Image Lora — vista previa de text-to-image de MiniMax H3 de MiniMax

Minimax H3 Text To Image Lora

MiniMax H3 Open Weights Text-to-Image generates photorealistic, cinema-grade stills from a text prompt at 1K or 2K resolution with fifteen aspect ratios. Loads up to 3 custom LoRA weights per request. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

desde $0.02
image-to-imageMinimax H3 Image Edit — vista previa de image-to-image de MiniMax H3 de MiniMax

Minimax H3 Image Edit

MiniMax H3 Open Weights Image Edit re-renders a subject from up to 9 reference images into a new scene, outfit or style from a text instruction, preserving identity at 1K or 2K resolution. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

desde $0.03
text-to-imageMinimax H3 Text To Image — vista previa de text-to-image de MiniMax H3 de MiniMax

Minimax H3 Text To Image

MiniMax H3 Open Weights Text-to-Image generates photorealistic, cinema-grade stills from a text prompt at 1K or 2K resolution with fifteen aspect ratios. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

desde $0.02
50 % DTO.video-to-videoMinimax H3 Video Edit — vista previa de video-to-video de MiniMax H3 de MiniMax

Minimax H3 Video Edit

MiniMax H3 Open Weights Video-Edit edits an input video from a natural-language prompt. The input video drives subject identity, composition, and motion while the model rewrites lighting, style, weather, environment, or specific elements as instructed, with native stereo audio generated in the same pass. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.25desde $0.125
50 % DTO.video-extendMinimax H3 Video Extend — vista previa de video-extend de MiniMax H3 de MiniMax

Minimax H3 Video Extend

MiniMax H3 Open Weights Video-Extend appends a new cinematic continuation to an existing video. A fresh segment with native stereo audio is generated from the input video's last frame and a natural-language prompt, then the original and new segment are concatenated into a single output. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.20desde $0.10
50 % DTO.reference-to-videoMinimax H3 Reference To Video Lora — vista previa de reference-to-video de MiniMax H3 de MiniMax

Minimax H3 Reference To Video Lora

MiniMax H3 Open Weights Reference to Video with custom LoRA support generates coherent 480P / 540P / 768P videos from prompts and multimodal references, guided by up to 9 reference images, 3 reference videos, and 3 reference audios, with native stereo audio and flexible reference-based video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.30desde $0.15
50 % DTO.image-to-videoMinimax H3 Image To Video Lora — vista previa de image-to-video de MiniMax H3 de MiniMax

Minimax H3 Image To Video Lora

MiniMax H3 Open Weights Image to Video animates a first-frame image, optionally with last-frame guidance, into coherent 480P / 540P / 768P videos with native stereo audio, 5-15 second duration, flexible aspect ratios, and per-second billing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.25desde $0.125
50 % DTO.text-to-videoMinimax H3 Text To Video Lora — vista previa de text-to-video de MiniMax H3 de MiniMax

Minimax H3 Text To Video Lora

MiniMax H3 Open Weights Text to Video with custom LoRA support generates coherent videos from text prompts, with 480P / 540P / 768P output, native stereo audio, 5-15 second duration, flexible aspect ratios, and per-second billing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.25desde $0.125
50 % DTO.reference-to-videoMinimax H3 Reference To Video — vista previa de reference-to-video de MiniMax H3 de MiniMax

Minimax H3 Reference To Video

MiniMax H3 Open Weights Reference to Video generates coherent 480P / 540P / 768P videos from prompts and multimodal references, guided by up to 9 reference images, 3 reference videos, and 3 reference audios, with native stereo audio and flexible reference-based video generation on WaveSpeedAI infrastructure. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.25desde $0.125
50 % DTO.image-to-videoMinimax H3 Image To Video — vista previa de image-to-video de MiniMax H3 de MiniMax

Minimax H3 Image To Video

MiniMax H3 Open Weights Image to Video animates a first-frame image, optionally with last-frame guidance, into coherent 480P / 540P / 768P videos with native stereo audio, 5-15 second duration, flexible aspect ratios, and per-second billing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.20desde $0.10
50 % DTO.text-to-videoMinimax H3 Text To Video — vista previa de text-to-video de MiniMax H3 de MiniMax

Minimax H3 Text To Video

MiniMax H3 Open Weights Text to Video generates coherent videos from text prompts, with 480P / 540P / 768P output, native stereo audio, 5-15 second duration, flexible aspect ratios, and per-second billing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.20desde $0.10
reference-to-videoH3 Reference To Video — vista previa de reference-to-video de MiniMax H3 de MiniMax

H3 Reference To Video

MiniMax H3 Reference to Video generates coherent 2K videos from natural-language prompts and multimodal references, including images, videos, and audio, guiding subject consistency, motion, timing, visual style, and scene continuity. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

desde $0.70
image-to-videoH3 Image To Video — vista previa de image-to-video de MiniMax H3 de MiniMax

H3 Image To Video

MiniMax H3 Image to Video animates a first-frame image into a coherent 2K video, with natural-language motion instructions and optional last-frame control for consistent motion, scene continuity, and cinematic video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

desde $0.70
text-to-videoH3 Text To Video — vista previa de text-to-video de MiniMax H3 de MiniMax

H3 Text To Video

MiniMax H3 Text to Video generates coherent 2K videos from text prompts, with flexible 5-15 second duration and adaptive or custom aspect ratios for cinematic scenes, creative videos, and production workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

desde $0.70

Ejemplos

Mira MiniMax H3 en acción

Resultados reales generados con la API de MiniMax H3. Pasa el cursor sobre cualquier vídeo para previsualizarlo y haz clic para abrir el visor a tamaño completo.

Cómo empezar

Cómo usar la API de MiniMax H3

Cuatro pasos desde el registro hasta una generación terminada. Encontrarás ejemplos completos en Python, Node.js y cURL en la sección de API más abajo.

  1. 01

    Obtén una clave de API

    Regístrate en WaveSpeedAI y copia tu clave de API desde el panel. Las cuentas nuevas incluyen créditos gratuitos para empezar: suficientes para usar el playground unas decenas de veces antes de que empiece la facturación.

  2. 02

    Envía una predicción

    Haz POST de tu entrada como JSON a https://api.wavespeed.ai/api/v3/wavespeed-ai/minimax-h3/text-to-video. El endpoint devuelve un id de predicción de inmediato: las generaciones son asíncronas, así que no mantienes una conexión abierta durante la inferencia.

  3. 03

    Consulta hasta que termine

    Haz GET a https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Devuelve los resultados con completed; detente con un error en failed, cancelled, timeout o deleted; sigue consultando con cualquier otro estado.

  4. 04

    Lee la URL del resultado

    Cuando status sea "completed", lee la URL de data.outputs[0]. La URL apunta a tu contenido generado en la CDN de WaveSpeedAI: imagen, vídeo, audio o archivo 3D según la variante de MiniMax H3 que hayas llamado.

Casos de uso

Qué puedes crear con MiniMax H3

Flujos de trabajo habituales para los que desarrolladores y creadores usan la API de MiniMax H3.

01

Texto a vídeo para conceptos originales

Convierte un prompt en una escena cinematográfica original con wavespeed-ai/minimax-h3/text-to-video: salida coherente en 480p/540p/768p/1080p con audio estéreo nativo y relaciones de aspecto flexibles. Úsalo para visualizar conceptos, contar historias, desarrollar ideas de campaña y crear planos que no necesitan partir de material gráfico existente.

text-to-videopromptcinematic
02

Imagen a vídeo para presentar productos

Anima fotografía de producto, imágenes de campaña, key art o imágenes de personajes conservando la dirección visual del original. Útil para presentaciones de producto, anuncios sociales y contenido de landing basado en movimiento.

image-to-videoproductadvertising
03

Referencia a vídeo para sujetos consistentes

Usa hasta 9 imágenes de referencia, 3 vídeos de referencia y 3 audios de referencia para guiar la identidad del personaje, la apariencia del sujeto, el diseño de la escena o el estilo. Referencia a vídeo es el flujo de H3 para personajes recurrentes, imágenes de marca y conjuntos creativos conectados.

reference-to-videoconsistencyidentity
04

Creatividades para redes sociales y anuncios

Genera conceptos creativos de formato corto para campañas, lanzamientos, feeds sociales y marketing de rendimiento. Parte de texto, de una imagen final o de una referencia visual aprobada sin cambiar de plataforma de API.

social-videoad-creativemarketing
05

Escenas de personajes y narrativa visual

Crea escenas protagonizadas por personajes, momentos narrativos, piezas de ambiente y previsualización con el endpoint adecuado al material de origen: texto para escenas nuevas, imagen para animar o referencias para mayor continuidad.

charactersstorytellingprevisualization
06

Pipelines escalables de generación de vídeo con IA

Integra MiniMax H3 en aplicaciones y flujos creativos automatizados a través de WaveSpeedAI. Usa una sola clave de API y un ciclo de vida de predicciones uniforme en los tres modos de generación de H3.

apiautomationproduction

Consejos

Consejos para escribir prompts en MiniMax H3

Consejos prácticos para obtener mejores resultados con MiniMax H3, basados en los patrones que funcionan en modelos de vídeo en flujos de producción.

  1. 01

    Elige el endpoint según el material de origen

    Usa texto a vídeo para un prompt original, imagen a vídeo para animar una imagen de origen y referencia a vídeo cuando las referencias visuales deban guiar la identidad, la apariencia del sujeto, el diseño de la escena o el estilo.

  2. 02

    Describe el movimiento como una secuencia

    Escribe el estado inicial, la acción, la respuesta del entorno, el movimiento de cámara y el estado final en orden cronológico. Una progresión clara da a H3 un plan de movimiento más sólido que una lista de adjetivos visuales desconectados.

  3. 03

    Usa imagen a vídeo cuando la composición ya está aprobada

    Si el sujeto, el producto, el encuadre o la dirección de arte están fijados en una imagen, empieza con imagen a vídeo en lugar de reconstruir la escena desde texto. Centra el prompt en el movimiento y el comportamiento de la cámara.

  4. 04

    Da a cada referencia una función clara

    En referencia a vídeo, indica qué debe controlar cada referencia: la identidad del personaje, la apariencia del producto, el estilo visual, el entorno o la composición. Evita pedir a una misma referencia que defina varios aspectos contradictorios del plano.

  5. 05

    Una acción principal por escena corta

    Una acción enfocada se renderiza de forma más coherente que una secuencia completa de sucesos inconexos. Genera planos distintos para cada momento narrativo y móntalos en edición cuando el concepto necesite más alcance narrativo.

Precios

Precios de la API de MiniMax H3

El precio es por resultado. El cargo final depende de los parámetros que definas en el playground de cada variante (resolución, duración, número de resultados, referencias).

Precio inicial

$0.02/ ejecución

20 endpoints · MiniMax H3

Abrir Playground
EndpointTipoPrecio inicial
wavespeed-ai/minimax-h3/controlnet-unionmotion-control50 % DTO.$0.30$0.15
wavespeed-ai/minimax-h3-singularity/image-to-video-loraimage-to-video50 % DTO.$0.3125$0.1563
wavespeed-ai/minimax-h3-singularity/image-to-videoimage-to-video50 % DTO.$0.25$0.125
wavespeed-ai/minimax-h3-singularity/reference-to-video-lorareference-to-video50 % DTO.$0.30$0.15
wavespeed-ai/minimax-h3-singularity/reference-to-videoreference-to-video50 % DTO.$0.25$0.125
wavespeed-ai/minimax-h3/image-edit-loraimage-to-image$0.03
wavespeed-ai/minimax-h3/text-to-image-loratext-to-image$0.02
wavespeed-ai/minimax-h3/image-editimage-to-image$0.03
wavespeed-ai/minimax-h3/text-to-imagetext-to-image$0.02
wavespeed-ai/minimax-h3/video-editvideo-to-video50 % DTO.$0.25$0.125
wavespeed-ai/minimax-h3/video-extendvideo-extend50 % DTO.$0.20$0.10
wavespeed-ai/minimax-h3/reference-to-video-lorareference-to-video50 % DTO.$0.30$0.15
wavespeed-ai/minimax-h3/image-to-video-loraimage-to-video50 % DTO.$0.25$0.125
wavespeed-ai/minimax-h3/text-to-video-loratext-to-video50 % DTO.$0.25$0.125
wavespeed-ai/minimax-h3/reference-to-videoreference-to-video50 % DTO.$0.25$0.125
wavespeed-ai/minimax-h3/image-to-videoimage-to-video50 % DTO.$0.20$0.10
wavespeed-ai/minimax-h3/text-to-videotext-to-video50 % DTO.$0.20$0.10
minimax/h3/reference-to-videoreference-to-video$0.70
minimax/h3/image-to-videoimage-to-video$0.70
minimax/h3/text-to-videotext-to-video$0.70

API

Llama a la API de MiniMax H3

Obtén una clave de API en wavespeed.ai/accesskey y envía una predicción por REST. El playground genera ejemplos listos para pegar con cualquier combinación de entradas.

POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/minimax-h3/text-to-video

# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
  -X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/minimax-h3/text-to-video" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $WAVESPEED_API_KEY" \
  -d '{
    "prompt": "A cinematic shot of a city at sunset, soft golden light",
    "aspect_ratio": "16:9",
    "resolution": "480p",
    "duration": 5
}')

TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
  printf 'Submission response did not contain a prediction id
' >&2
  exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"

# 2. Poll until the prediction finishes.
while true; do
  RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
    -H "Authorization: Bearer $WAVESPEED_API_KEY")
  RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
  STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
  case "$STATUS" in
    completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
    failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
    *) sleep 2 ;;
  esac
done

Comparar

MiniMax H3 frente a las alternativas

Cuándo elegir MiniMax H3 en lugar de modelos similares en WaveSpeedAI.

MiniMax H3 frente a Hailuo 2.3

Hailuo 2.3 ofrece endpoints escalonados de texto a vídeo e imagen a vídeo en las variantes Standard, Pro, Fast y Fast Pro. MiniMax H3 utiliza un conjunto más compacto de tres endpoints y añade referencia a vídeo como flujo de primer nivel para la guía visual y la consistencia del sujeto.

MiniMax H3 frente a Seedance 2.0

Seedance 2.0 es una familia de producción amplia con texto a vídeo, imagen a vídeo, edición de vídeo, extensión de vídeo, audio nativo y varios niveles de rendimiento. MiniMax H3 es una opción más sencilla cuando el flujo gira en torno a generar desde texto, una imagen de origen o referencias visuales.

MiniMax H3 frente a Kling 3.0

Kling 3.0 destaca por sus niveles de calidad de salida y sus endpoints específicos de control de movimiento. MiniMax H3 organiza su API según el tipo de origen, con una ruta dedicada de referencia a vídeo para generar guiándose por la identidad, el sujeto y el estilo.

Preguntas frecuentes

MiniMax H3 API — Preguntas frecuentes

Precios, licencia, integración: preguntas habituales sobre cómo ejecutar MiniMax H3 en WaveSpeedAI.

¿Qué es la API de MiniMax H3?

La API de MiniMax H3 es un conjunto de tres modelos de generación de vídeo con IA en WaveSpeedAI. Admite texto a vídeo para escenas guiadas por prompts, imagen a vídeo para animar imágenes fijas y referencia a vídeo para generar guiándose por referencias visuales.

¿Qué endpoint de la API de MiniMax H3 debo usar?

Empieza por el despliegue de pesos abiertos recomendado en la infraestructura de WaveSpeed: wavespeed-ai/minimax-h3/text-to-video si partes de un prompt, wavespeed-ai/minimax-h3/image-to-video si animas una imagen de origen y wavespeed-ai/minimax-h3/reference-to-video cuando las referencias visuales deban guiar la identidad, la apariencia o el estilo del sujeto. Los endpoints oficiales minimax/h3 están disponibles en la misma familia.

¿MiniMax H3 admite la generación de imagen a vídeo?

Sí. El endpoint wavespeed-ai/minimax-h3/image-to-video anima una imagen de primer fotograma (opcionalmente con un último fotograma) y obtiene un vídeo coherente con audio estéreo nativo, por lo que es adecuado para animar fotos de producto, arte de campaña, imágenes de personajes, fotogramas conceptuales y otros recursos visuales existentes.

¿Qué es la referencia a vídeo de MiniMax H3?

La referencia a vídeo de MiniMax H3 genera un vídeo nuevo guiado por hasta 9 imágenes de referencia, 3 vídeos de referencia y 3 audios de referencia que orientan el sujeto, la identidad del personaje, el estilo o el lenguaje de la escena. Es el endpoint de H3 preferido para personajes recurrentes y flujos creativos coherentes con la marca.

¿Cómo uso la API de MiniMax H3 en WaveSpeedAI?

Elige el endpoint de H3 que corresponda a tu origen, autentícate con tu clave de API de WaveSpeedAI, envía la entrada del modelo como JSON y usa el ID de predicción o la URL de resultado devueltos para obtener el vídeo generado. Las tarjetas de endpoints y los ejemplos de código de esta página muestran el esquema de solicitud vigente.

¿Cómo llamo a la API de MiniMax H3?

Regístrate en WaveSpeedAI, copia tu clave de API desde /accesskey y haz POST a https://api.wavespeed.ai/api/v3/wavespeed-ai/minimax-h3/text-to-video con tu entrada como JSON. El endpoint devuelve un id de predicción. Consulta el endpoint de resultados aproximadamente cada 2 segundos, aumenta el intervalo en las tareas largas y detente ante cualquier estado final. Arriba tienes ejemplos en Python / Node.js / cURL orientados a producción.

¿Cuánto cuesta la API de MiniMax H3?

MiniMax H3 empieza en $0.02 por ejecución. El coste exacto depende de los parámetros que definas (resolución, duración, número de resultados, referencias). La vista previa del coste en tiempo real junto al botón Generar del playground muestra el precio exacto de tu entrada actual.

¿Qué variantes de MiniMax H3 hay disponibles?

WaveSpeedAI aloja 20 endpoints de MiniMax H3 en producción: wavespeed-ai/minimax-h3/controlnet-union, wavespeed-ai/minimax-h3-singularity/image-to-video-lora, wavespeed-ai/minimax-h3-singularity/image-to-video, wavespeed-ai/minimax-h3-singularity/reference-to-video-lora, wavespeed-ai/minimax-h3-singularity/reference-to-video, wavespeed-ai/minimax-h3/image-edit-lora, wavespeed-ai/minimax-h3/text-to-image-lora, wavespeed-ai/minimax-h3/image-edit y más. Cada variante tiene su propia página de playground y sus propios precios.

¿Puedo usar comercialmente los resultados de MiniMax H3?

Los derechos de uso comercial dependen de la licencia del modelo de MiniMax. La mayoría de los modelos de MiniMax permiten el uso comercial de los resultados; consulta la página del playground de cada modelo para ver el resumen de su licencia y los Términos del servicio de WaveSpeedAI para las condiciones de la plataforma.

¿Por qué usar MiniMax H3 en WaveSpeedAI en lugar de ir directamente al proveedor?

Una sola clave de API y una sola cuenta de facturación para MiniMax H3 Y más de 1.000 modelos de IA de otros proveedores. Sin configurar un SDK por proveedor, sin límites de uso aparte y sin reescribir el código de integración para cada proveedor. Los precios suelen ser iguales o inferiores a los de la API directa de MiniMax.

Proveedor

Acerca de MiniMax

El equipo detrás de MiniMax H3 y de la gama más amplia de modelos de MiniMax en WaveSpeedAI.

MiniMax es un laboratorio de IA chino conocido por la generación de vídeo Hailuo y por sus modelos de voz. Hailuo 2.3 ofrece texto a vídeo e imagen a vídeo que respetan la física, con niveles Standard, Pro y Fast, posicionado en torno a una eficiencia 2,5× y una gran precisión en instrucciones complejas para flujos de creadores y de marketing.

Empieza a crear con MiniMax H3 en WaveSpeedAI

Créditos gratuitos al registrarte. Una sola clave de API para más de 1.000 modelos de IA de MiniMax y de todos los demás proveedores.