Nano Banana 2.1 DOSTĘPNE — Najnowszy od Google | Wypróbuj →
MiniMaxAPI wideoOd $0.02/uruchomienie

MiniMax H3 API

API MiniMax H3 do filmowego generowania wideo z tekstu, obrazu i referencji, z natywnym dźwiękiem stereo, wysoką jakością ruchu, spójnością bohatera i koherencją scen. Uruchamiaj wydanie open-weights na infrastrukturze WaveSpeed albo oficjalne endpointy MiniMax przez jedno API WaveSpeedAI.

Generuj filmowe wideo AI z promptów tekstowych, obrazów statycznych lub referencji wizualnych. Zalecane wdrożenie open-weights na infrastrukturze WaveSpeed (wavespeed-ai/minimax-h3) zapewnia spójne wideo 480p/540p/768p/1080p z natywnym dźwiękiem stereo, długością 3–15 sekund i przystępnym cennikiem za sekundę — a oficjalne endpointy MiniMax są dostępne w tej samej rodzinie.

Przegląd

O modelu MiniMax H3 API

Co robi MiniMax H3, jakie miejsce zajmuje w linii modeli MiniMax i dlaczego zespoły po niego sięgają.

MiniMax H3 to model generowania wideo od MiniMax, dostępny przez REST API WaveSpeedAI. API MiniMax H3 do filmowego generowania wideo z tekstu, obrazu i referencji, z natywnym dźwiękiem stereo, wysoką jakością ruchu, spójnością bohatera i koherencją scen. Uruchamiaj wydanie open-weights na infrastrukturze WaveSpeed albo oficjalne endpointy MiniMax przez jedno API WaveSpeedAI.

Generuj filmowe wideo AI z promptów tekstowych, obrazów statycznych lub referencji wizualnych. Zalecane wdrożenie open-weights na infrastrukturze WaveSpeed (wavespeed-ai/minimax-h3) zapewnia spójne wideo 480p/540p/768p/1080p z natywnym dźwiękiem stereo, długością 3–15 sekund i przystępnym cennikiem za sekundę — a oficjalne endpointy MiniMax są dostępne w tej samej rodzinie.

Rodzina MiniMax H3 w WaveSpeedAI zawiera 20 endpointów REST obejmujące workflowy: Motion-Control, Image-To-Video, Reference-To-Video, Image-To-Image, Text-To-Image, Video-To-Video, Video-Extend, Text-To-Video. Każdy wariant ma własny cennik, parametry i przykładowe wyniki — wybierz ten, który pasuje do Twoich danych wejściowych i wymagań produkcyjnych, albo wywołuj kilka z jednego klucza API, aby składać wieloetapowe pipeline'y.

Uruchamiaj MiniMax H3 z tym samym kluczem API, kontem rozliczeniowym i limitami, których używasz dla ponad 1000 innych modeli AI w WaveSpeedAI. Bez osobnej konfiguracji u dostawcy, bez osobnych SDK, bez osobnych limitów — jedna integracja obejmuje wszystko: od tekstu na obraz i tekstu na wideo, przez syntezę dźwięku i generowanie 3D, po upscaling i edycję.

Specyfikacja

Możliwości i status premiery MiniMax H3 API

Szczegóły modelu, których deweloperzy szukają przed wyborem API: dostępność, oczekiwana długość wyniku, obsługa referencji i aktualne rozwiązanie zastępcze.

Tekst na wideo

Generowanie sterowane promptem

Użyj wavespeed-ai/minimax-h3/text-to-video, aby zamienić pisemny brief kreatywny w spójne wideo 480p/540p/768p/1080p z natywnym dźwiękiem stereo, długością 3–15 sekund i elastycznymi proporcjami obrazu.

Obraz na wideo

Animacja obrazu statycznego

Użyj wavespeed-ai/minimax-h3/image-to-video, aby animować obraz pierwszej klatki — opcjonalnie z ostatnią klatką — w spójne wideo z natywnym dźwiękiem stereo, przenosząc bohatera, kadrowanie i kierunek artystyczny do ruchu.

Referencja na wideo

Sterowanie tożsamością i stylem

Użyj wavespeed-ai/minimax-h3/reference-to-video, aby sterować generowaniem za pomocą do 9 obrazów referencyjnych, 3 wideo referencyjnych i 3 nagrań referencyjnych, gdy bohater, tożsamość postaci lub styl muszą pozostać spójne.

Integracja API

Jeden workflow WaveSpeedAI

Wysyłaj predykcje H3 swoim kluczem API WaveSpeedAI, śledź każde żądanie w standardowym cyklu życia predykcji i pobieraj wygenerowane wideo z odpowiedzi z wynikiem — ten sam workflow dla endpointów hostowanych przez WaveSpeed i oficjalnych endpointów MiniMax.

Endpointy

Wszystkie endpointy API MiniMax H3

20 endpointów MiniMax H3 dostępnych teraz w WaveSpeedAI — wybierz wariant pasujący do Twojego workflow.

-50%motion-controlMinimax H3 Controlnet Union — podgląd motion-control z MiniMax H3 od MiniMax

Minimax H3 Controlnet Union

MiniMax H3 Open Weights ControlNet Union generates a new video that follows the motion and composition of a source video. Pose, depth, edges, lines, scribble or grayscale structure is extracted from the source automatically and guides the output, optionally with reference images for the subject or style, with native stereo audio generated in the same pass. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.30od $0.15
-50%image-to-videoMinimax H3 Singularity Image To Video Lora — podgląd image-to-video z MiniMax H3 od MiniMax

Minimax H3 Singularity Image To Video Lora

MiniMax H3 Singularity Open Weights Image to Video animates a first-frame image, optionally with last-frame guidance, into coherent 480P / 540P / 768P videos with native stereo audio, 5-15 second duration, flexible aspect ratios, and per-second billing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.3125od $0.1563
-50%image-to-videoMinimax H3 Singularity Image To Video — podgląd image-to-video z MiniMax H3 od MiniMax

Minimax H3 Singularity Image To Video

MiniMax H3 Singularity Open Weights Image-to-Video animates a first-frame image, with optional last-frame guidance, into coherent 480P / 540P / 768P videos with native stereo audio, 5-15 second duration, flexible aspect ratios, and per-second billing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.25od $0.125
-50%reference-to-videoMinimax H3 Singularity Reference To Video Lora — podgląd reference-to-video z MiniMax H3 od MiniMax

Minimax H3 Singularity Reference To Video Lora

MiniMax H3 Singularity Open Weights Reference to Video with custom LoRA support generates coherent 480P / 540P / 768P videos from prompts and multimodal references, guided by up to 9 reference images, 3 reference videos, and 3 reference audios, with native stereo audio and flexible reference-based video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.30od $0.15
-50%reference-to-videoMinimax H3 Singularity Reference To Video — podgląd reference-to-video z MiniMax H3 od MiniMax

Minimax H3 Singularity Reference To Video

MiniMax H3 Singularity Open Weights Reference to Video generates coherent 480P / 540P / 768P videos from prompts and multimodal references, guided by up to 9 reference images, 3 reference videos, and 3 reference audios, with native stereo audio and flexible reference-based video generation on WaveSpeedAI infrastructure. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.25od $0.125
image-to-imageMinimax H3 Image Edit Lora — podgląd image-to-image z MiniMax H3 od MiniMax

Minimax H3 Image Edit Lora

MiniMax H3 Open Weights Image Edit re-renders a subject from up to 9 reference images into a new scene, outfit or style from a text instruction, preserving identity at 1K or 2K resolution. Loads up to 3 custom LoRA weights per request. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

od $0.03
text-to-imageMinimax H3 Text To Image Lora — podgląd text-to-image z MiniMax H3 od MiniMax

Minimax H3 Text To Image Lora

MiniMax H3 Open Weights Text-to-Image generates photorealistic, cinema-grade stills from a text prompt at 1K or 2K resolution with fifteen aspect ratios. Loads up to 3 custom LoRA weights per request. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

od $0.02
image-to-imageMinimax H3 Image Edit — podgląd image-to-image z MiniMax H3 od MiniMax

Minimax H3 Image Edit

MiniMax H3 Open Weights Image Edit re-renders a subject from up to 9 reference images into a new scene, outfit or style from a text instruction, preserving identity at 1K or 2K resolution. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

od $0.03
text-to-imageMinimax H3 Text To Image — podgląd text-to-image z MiniMax H3 od MiniMax

Minimax H3 Text To Image

MiniMax H3 Open Weights Text-to-Image generates photorealistic, cinema-grade stills from a text prompt at 1K or 2K resolution with fifteen aspect ratios. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.

od $0.02
-50%video-to-videoMinimax H3 Video Edit — podgląd video-to-video z MiniMax H3 od MiniMax

Minimax H3 Video Edit

MiniMax H3 Open Weights Video-Edit edits an input video from a natural-language prompt. The input video drives subject identity, composition, and motion while the model rewrites lighting, style, weather, environment, or specific elements as instructed, with native stereo audio generated in the same pass. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.25od $0.125
-50%video-extendMinimax H3 Video Extend — podgląd video-extend z MiniMax H3 od MiniMax

Minimax H3 Video Extend

MiniMax H3 Open Weights Video-Extend appends a new cinematic continuation to an existing video. A fresh segment with native stereo audio is generated from the input video's last frame and a natural-language prompt, then the original and new segment are concatenated into a single output. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.20od $0.10
-50%reference-to-videoMinimax H3 Reference To Video Lora — podgląd reference-to-video z MiniMax H3 od MiniMax

Minimax H3 Reference To Video Lora

MiniMax H3 Open Weights Reference to Video with custom LoRA support generates coherent 480P / 540P / 768P videos from prompts and multimodal references, guided by up to 9 reference images, 3 reference videos, and 3 reference audios, with native stereo audio and flexible reference-based video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.30od $0.15
-50%image-to-videoMinimax H3 Image To Video Lora — podgląd image-to-video z MiniMax H3 od MiniMax

Minimax H3 Image To Video Lora

MiniMax H3 Open Weights Image to Video animates a first-frame image, optionally with last-frame guidance, into coherent 480P / 540P / 768P videos with native stereo audio, 5-15 second duration, flexible aspect ratios, and per-second billing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.25od $0.125
-50%text-to-videoMinimax H3 Text To Video Lora — podgląd text-to-video z MiniMax H3 od MiniMax

Minimax H3 Text To Video Lora

MiniMax H3 Open Weights Text to Video with custom LoRA support generates coherent videos from text prompts, with 480P / 540P / 768P output, native stereo audio, 5-15 second duration, flexible aspect ratios, and per-second billing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.25od $0.125
-50%reference-to-videoMinimax H3 Reference To Video — podgląd reference-to-video z MiniMax H3 od MiniMax

Minimax H3 Reference To Video

MiniMax H3 Open Weights Reference to Video generates coherent 480P / 540P / 768P videos from prompts and multimodal references, guided by up to 9 reference images, 3 reference videos, and 3 reference audios, with native stereo audio and flexible reference-based video generation on WaveSpeedAI infrastructure. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.25od $0.125
-50%image-to-videoMinimax H3 Image To Video — podgląd image-to-video z MiniMax H3 od MiniMax

Minimax H3 Image To Video

MiniMax H3 Open Weights Image to Video animates a first-frame image, optionally with last-frame guidance, into coherent 480P / 540P / 768P videos with native stereo audio, 5-15 second duration, flexible aspect ratios, and per-second billing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.20od $0.10
-50%text-to-videoMinimax H3 Text To Video — podgląd text-to-video z MiniMax H3 od MiniMax

Minimax H3 Text To Video

MiniMax H3 Open Weights Text to Video generates coherent videos from text prompts, with 480P / 540P / 768P output, native stereo audio, 5-15 second duration, flexible aspect ratios, and per-second billing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

$0.20od $0.10
reference-to-videoH3 Reference To Video — podgląd reference-to-video z MiniMax H3 od MiniMax

H3 Reference To Video

MiniMax H3 Reference to Video generates coherent 2K videos from natural-language prompts and multimodal references, including images, videos, and audio, guiding subject consistency, motion, timing, visual style, and scene continuity. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

od $0.70
image-to-videoH3 Image To Video — podgląd image-to-video z MiniMax H3 od MiniMax

H3 Image To Video

MiniMax H3 Image to Video animates a first-frame image into a coherent 2K video, with natural-language motion instructions and optional last-frame control for consistent motion, scene continuity, and cinematic video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

od $0.70
text-to-videoH3 Text To Video — podgląd text-to-video z MiniMax H3 od MiniMax

H3 Text To Video

MiniMax H3 Text to Video generates coherent 2K videos from text prompts, with flexible 5-15 second duration and adaptive or custom aspect ratios for cinematic scenes, creative videos, and production workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.

od $0.70

Przykłady

MiniMax H3 w akcji

Prawdziwe wyniki wygenerowane przez API MiniMax H3. Najedź na wideo, aby zobaczyć podgląd, kliknij, aby otworzyć pełnowymiarowy podgląd.

Jak zacząć

Jak korzystać z API MiniMax H3

Cztery kroki od rejestracji do gotowego wyniku. Pełne przykłady w Pythonie, Node.js i cURL znajdziesz w sekcji API poniżej.

  1. 01

    Uzyskaj klucz API

    Załóż konto WaveSpeedAI i skopiuj klucz API z panelu. Nowe konta otrzymują darmowe kredyty na start — wystarczy na kilkadziesiąt uruchomień w playground, zanim zaczną się opłaty.

  2. 02

    Wyślij predykcję

    Wyślij dane wejściowe jako JSON metodą POST na https://api.wavespeed.ai/api/v3/wavespeed-ai/minimax-h3/text-to-video. Endpoint od razu zwraca identyfikator predykcji — generowanie jest asynchroniczne, więc nie trzymasz otwartego połączenia na czas inferencji.

  3. 03

    Sprawdzaj ukończenie

    Wywołaj GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Przy statusie completed odbierz wyniki; przy failed, cancelled, timeout lub deleted zakończ z błędem; przy każdym innym statusie odpytuj dalej.

  4. 04

    Odczytaj adres wyniku

    Gdy status to "completed", odczytaj adres URL z data.outputs[0]. Wskazuje on wygenerowane media w CDN WaveSpeedAI — obraz, wideo, dźwięk lub plik 3D, zależnie od wywołanego wariantu MiniMax H3.

Zastosowania

Co możesz zbudować z MiniMax H3

Typowe workflowy, do których deweloperzy i twórcy używają API MiniMax H3.

01

Tekst na wideo dla oryginalnych koncepcji

Zamień prompt w oryginalną filmową scenę dzięki wavespeed-ai/minimax-h3/text-to-video — spójne wyjście 480p/540p/768p/1080p z natywnym dźwiękiem stereo i elastycznymi proporcjami obrazu. Używaj go do wizualizacji koncepcji, opowiadania historii, pomysłów na kampanie i ujęć, które nie muszą wychodzić z istniejącej grafiki.

text-to-videopromptcinematic
02

Obraz na wideo do prezentacji produktów

Animuj zdjęcia produktowe, kadry kampanii, key art lub obrazy postaci, zachowując kierunek wizualny źródła. Przydatne w prezentacjach produktów, reklamach społecznościowych i treściach landing page opartych na ruchu.

image-to-videoproductadvertising
03

Referencja na wideo dla spójnych bohaterów

Użyj do 9 obrazów referencyjnych, 3 wideo referencyjnych i 3 nagrań referencyjnych, aby sterować tożsamością postaci, wyglądem bohatera, projektem sceny lub stylem. Referencja na wideo to workflow H3 dla powracających postaci, wizualiów marki i powiązanych zestawów kreatywnych.

reference-to-videoconsistencyidentity
04

Treści do mediów społecznościowych i reklam

Generuj krótkie koncepcje kreatywne do kampanii, premier, feedów społecznościowych i marketingu efektywnościowego. Przechodź od tekstu, gotowego obrazu lub zatwierdzonej referencji wizualnej bez zmiany platformy API.

social-videoad-creativemarketing
05

Sceny z postaciami i opowiadanie wizualne

Twórz sceny z postaciami, momenty fabularne, ujęcia nastrojowe i previzualizacje, wybierając endpoint pod materiał źródłowy: tekst dla nowych scen, obraz do animacji lub referencje dla większej ciągłości.

charactersstorytellingprevisualization
06

Skalowalne potoki generowania wideo AI

Zintegruj MiniMax H3 z aplikacjami i zautomatyzowanymi workflow kreatywnymi przez WaveSpeedAI. Używaj jednego klucza API i spójnego cyklu życia predykcji we wszystkich trzech trybach generowania H3.

apiautomationproduction

Wskazówki

Wskazówki do promptów dla MiniMax H3

Praktyczne rady, jak uzyskiwać lepsze wyniki z MiniMax H3 — oparte na wzorcach, które sprawdzają się w produkcyjnych pipeline'ach dla modeli wideo.

  1. 01

    Wybierz endpoint według materiału źródłowego

    Użyj tekstu na wideo dla oryginalnego promptu, obrazu na wideo, aby animować jeden obraz źródłowy, oraz referencji na wideo, gdy referencje wizualne mają sterować tożsamością, wyglądem bohatera, projektem sceny lub stylem.

  2. 02

    Opisuj ruch jako sekwencję

    Zapisz stan początkowy, akcję, reakcję otoczenia, ruch kamery i stan końcowy w kolejności chronologicznej. Wyraźna progresja daje H3 silniejszy plan ruchu niż lista niepowiązanych przymiotników wizualnych.

  3. 03

    Używaj obrazu na wideo, gdy kompozycja jest już zatwierdzona

    Jeśli bohater, produkt, kadrowanie lub kierunek artystyczny są ustalone na obrazie statycznym, zacznij od obrazu na wideo zamiast odtwarzać scenę z tekstu. Skup prompt na ruchu i zachowaniu kamery.

  4. 04

    Daj każdej referencji jedno wyraźne zadanie

    W referencji na wideo określ, co referencje mają kontrolować: tożsamość postaci, wygląd produktu, styl wizualny, otoczenie lub kompozycję. Unikaj proszenia tej samej referencji o zdefiniowanie kilku sprzecznych aspektów ujęcia.

  5. 05

    Jedna główna akcja na krótką scenę

    Skupioną akcję łatwiej wyrenderować spójnie niż pełną sekwencję niepowiązanych zdarzeń. Generuj osobne ujęcia dla osobnych momentów fabuły, a potem złóż je w montażu, gdy koncepcja wymaga szerszego zakresu narracji.

Cennik

Cennik API MiniMax H3

Cena jest naliczana za wynik. Końcowa opłata zależy od parametrów ustawionych w playground każdego wariantu (rozdzielczość, czas trwania, liczba wyników, referencje).

Cena początkowa

$0.02/ uruchomienie

20 endpointów · MiniMax H3

Otwórz Playground
EndpointTypCena początkowa
wavespeed-ai/minimax-h3/controlnet-unionmotion-control-50%$0.30$0.15
wavespeed-ai/minimax-h3-singularity/image-to-video-loraimage-to-video-50%$0.3125$0.1563
wavespeed-ai/minimax-h3-singularity/image-to-videoimage-to-video-50%$0.25$0.125
wavespeed-ai/minimax-h3-singularity/reference-to-video-lorareference-to-video-50%$0.30$0.15
wavespeed-ai/minimax-h3-singularity/reference-to-videoreference-to-video-50%$0.25$0.125
wavespeed-ai/minimax-h3/image-edit-loraimage-to-image$0.03
wavespeed-ai/minimax-h3/text-to-image-loratext-to-image$0.02
wavespeed-ai/minimax-h3/image-editimage-to-image$0.03
wavespeed-ai/minimax-h3/text-to-imagetext-to-image$0.02
wavespeed-ai/minimax-h3/video-editvideo-to-video-50%$0.25$0.125
wavespeed-ai/minimax-h3/video-extendvideo-extend-50%$0.20$0.10
wavespeed-ai/minimax-h3/reference-to-video-lorareference-to-video-50%$0.30$0.15
wavespeed-ai/minimax-h3/image-to-video-loraimage-to-video-50%$0.25$0.125
wavespeed-ai/minimax-h3/text-to-video-loratext-to-video-50%$0.25$0.125
wavespeed-ai/minimax-h3/reference-to-videoreference-to-video-50%$0.25$0.125
wavespeed-ai/minimax-h3/image-to-videoimage-to-video-50%$0.20$0.10
wavespeed-ai/minimax-h3/text-to-videotext-to-video-50%$0.20$0.10
minimax/h3/reference-to-videoreference-to-video$0.70
minimax/h3/image-to-videoimage-to-video$0.70
minimax/h3/text-to-videotext-to-video$0.70

API

Wywołaj API MiniMax H3

Uzyskaj klucz API na wavespeed.ai/accesskey, a następnie wyślij predykcję przez REST. Playground generuje gotowe do wklejenia przykłady dla dowolnej kombinacji danych wejściowych.

POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/minimax-h3/text-to-video

# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
  -X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/minimax-h3/text-to-video" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $WAVESPEED_API_KEY" \
  -d '{
    "prompt": "A cinematic shot of a city at sunset, soft golden light",
    "aspect_ratio": "16:9",
    "resolution": "480p",
    "duration": 5
}')

TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
  printf 'Submission response did not contain a prediction id
' >&2
  exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"

# 2. Poll until the prediction finishes.
while true; do
  RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
    -H "Authorization: Bearer $WAVESPEED_API_KEY")
  RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
  STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
  case "$STATUS" in
    completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
    failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
    *) sleep 2 ;;
  esac
done

Porównanie

MiniMax H3 a alternatywy

Kiedy wybrać MiniMax H3 zamiast podobnych modeli w WaveSpeedAI.

MiniMax H3 a Hailuo 2.3

Hailuo 2.3 oferuje warstwowe endpointy tekst na wideo i obraz na wideo w wariantach Standard, Pro, Fast i Fast Pro. MiniMax H3 ma zwarty zestaw trzech endpointów i dodaje referencję na wideo jako pełnoprawny workflow dla wskazówek wizualnych i spójności bohatera.

MiniMax H3 a Seedance 2.0

Seedance 2.0 to szeroka rodzina produkcyjna z tekstem na wideo, obrazem na wideo, video-edit, video-extend, natywnym dźwiękiem i wieloma poziomami wydajności. MiniMax H3 jest prostszym wyborem, gdy workflow opiera się na generowaniu z tekstu, obrazu źródłowego lub referencji wizualnych.

MiniMax H3 a Kling 3.0

Kling 3.0 kładzie nacisk na warstwową jakość wyjścia i dedykowane endpointy motion control. MiniMax H3 porządkuje API według typu źródła, w tym dedykowanej ścieżki referencja na wideo dla generowania sterowanego tożsamością, bohaterem i stylem.

FAQ

MiniMax H3 API — najczęściej zadawane pytania

Cennik, licencja, integracja — typowe pytania o uruchamianie MiniMax H3 w WaveSpeedAI.

Czym jest API MiniMax H3?

API MiniMax H3 to zestaw trzech modeli do generowania wideo AI w WaveSpeedAI. Obsługuje tekst na wideo dla scen sterowanych promptem, obraz na wideo do animowania obrazów statycznych oraz referencję na wideo do generowania sterowanego referencjami wizualnymi.

Którego endpointu API MiniMax H3 powinienem użyć?

Zacznij od zalecanego wdrożenia open-weights na infrastrukturze WaveSpeed: wavespeed-ai/minimax-h3/text-to-video, gdy zaczynasz od promptu, wavespeed-ai/minimax-h3/image-to-video, gdy animujesz obraz źródłowy, oraz wavespeed-ai/minimax-h3/reference-to-video, gdy referencje wizualne mają sterować tożsamością, wyglądem lub stylem bohatera. Oficjalne endpointy minimax/h3 są dostępne w tej samej rodzinie.

Czy MiniMax H3 obsługuje generowanie obrazu na wideo?

Tak. Endpoint wavespeed-ai/minimax-h3/image-to-video animuje obraz pierwszej klatki — opcjonalnie z ostatnią klatką — w spójne wideo z natywnym dźwiękiem stereo, dzięki czemu nadaje się do animowania zdjęć produktowych, grafik kampanii, obrazów postaci, klatek koncepcyjnych i innych istniejących materiałów wizualnych.

Czym jest referencja na wideo w MiniMax H3?

Referencja na wideo w MiniMax H3 generuje nowe wideo, którym sterują do 9 obrazów referencyjnych, 3 wideo referencyjne i 3 nagrania referencyjne wyznaczające bohatera, tożsamość postaci, styl lub język sceny. To preferowany endpoint H3 dla powracających postaci i workflow kreatywnych spójnych z marką.

Jak używać API MiniMax H3 w WaveSpeedAI?

Wybierz endpoint H3 pasujący do Twojego źródła, uwierzytelnij się kluczem API WaveSpeedAI, wyślij dane wejściowe modelu jako JSON i użyj zwróconego identyfikatora predykcji lub adresu URL wyniku, aby pobrać wygenerowane wideo. Karty endpointów i przykłady kodu na tej stronie pokazują aktualny schemat żądania.

Jak wywołać API MiniMax H3?

Załóż konto WaveSpeedAI, skopiuj klucz API z /accesskey, a następnie wyślij POST na https://api.wavespeed.ai/api/v3/wavespeed-ai/minimax-h3/text-to-video z danymi wejściowymi w JSON. Endpoint zwraca identyfikator predykcji. Odpytuj endpoint wyniku mniej więcej co 2 sekundy, wydłużaj odstęp przy długich zadaniach i zatrzymaj się przy dowolnym statusie końcowym. Produkcyjne przykłady w Pythonie / Node.js / cURL znajdziesz powyżej.

Ile kosztuje API MiniMax H3?

MiniMax H3 zaczyna się od $0.02 za uruchomienie. Dokładny koszt zależy od ustawionych parametrów (rozdzielczość, czas trwania, liczba wyników, referencje). Podgląd kosztu na żywo obok przycisku Generuj w playground pokazuje dokładną cenę dla bieżących danych.

Jakie warianty MiniMax H3 są dostępne?

WaveSpeedAI udostępnia 20 aktywnych endpointów MiniMax H3: wavespeed-ai/minimax-h3/controlnet-union, wavespeed-ai/minimax-h3-singularity/image-to-video-lora, wavespeed-ai/minimax-h3-singularity/image-to-video, wavespeed-ai/minimax-h3-singularity/reference-to-video-lora, wavespeed-ai/minimax-h3-singularity/reference-to-video, wavespeed-ai/minimax-h3/image-edit-lora, wavespeed-ai/minimax-h3/text-to-image-lora, wavespeed-ai/minimax-h3/image-edit, i inne. Każdy wariant ma własną stronę playground i cennik.

Czy mogę używać wyników MiniMax H3 komercyjnie?

Prawa do komercyjnego użycia wynikają z licencji modelu MiniMax. Większość modeli MiniMax zezwala na komercyjne wykorzystanie wyników; skrót licencji znajdziesz na stronie playground każdego modelu, a warunki na poziomie platformy w Warunkach świadczenia usług WaveSpeedAI.

Dlaczego korzystać z MiniMax H3 w WaveSpeedAI zamiast bezpośrednio?

Jeden klucz API i jedno konto rozliczeniowe dla MiniMax H3 ORAZ ponad 1000 innych modeli AI od innych dostawców. Bez osobnej konfiguracji SDK, bez osobnych limitów, bez przepisywania kodu integracji pod każdego dostawcę. Ceny są zazwyczaj na poziomie bezpośredniego API MiniMax lub niższe.

Dostawca

O MiniMax

Zespół stojący za MiniMax H3 i szerszą linią modeli MiniMax w WaveSpeedAI.

MiniMax to chińskie laboratorium AI znane z generowania wideo Hailuo i modeli mowy. Hailuo 2.3 oferuje tekst na wideo i obraz na wideo uwzględniające fizykę na poziomach Standard, Pro i Fast — pozycjonowane wokół 2,5× wyższej wydajności i dużej dokładności przy złożonych instrukcjach w workflow twórców i marketingu.

Zacznij budować z MiniMax H3 w WaveSpeedAI

Darmowe kredyty na start po rejestracji. Jeden klucz API do ponad 1000 modeli AI od MiniMax i wszystkich innych dostawców.