MiniMax H3 API
API MiniMax H3 do filmowego generowania wideo z tekstu, obrazu i referencji, z natywnym dźwiękiem stereo, wysoką jakością ruchu, spójnością bohatera i koherencją scen. Uruchamiaj wydanie open-weights na infrastrukturze WaveSpeed albo oficjalne endpointy MiniMax przez jedno API WaveSpeedAI.
Generuj filmowe wideo AI z promptów tekstowych, obrazów statycznych lub referencji wizualnych. Zalecane wdrożenie open-weights na infrastrukturze WaveSpeed (wavespeed-ai/minimax-h3) zapewnia spójne wideo 480p/540p/768p/1080p z natywnym dźwiękiem stereo, długością 3–15 sekund i przystępnym cennikiem za sekundę — a oficjalne endpointy MiniMax są dostępne w tej samej rodzinie.
Przegląd
O modelu MiniMax H3 API
Co robi MiniMax H3, jakie miejsce zajmuje w linii modeli MiniMax i dlaczego zespoły po niego sięgają.
MiniMax H3 to model generowania wideo od MiniMax, dostępny przez REST API WaveSpeedAI. API MiniMax H3 do filmowego generowania wideo z tekstu, obrazu i referencji, z natywnym dźwiękiem stereo, wysoką jakością ruchu, spójnością bohatera i koherencją scen. Uruchamiaj wydanie open-weights na infrastrukturze WaveSpeed albo oficjalne endpointy MiniMax przez jedno API WaveSpeedAI.
Generuj filmowe wideo AI z promptów tekstowych, obrazów statycznych lub referencji wizualnych. Zalecane wdrożenie open-weights na infrastrukturze WaveSpeed (wavespeed-ai/minimax-h3) zapewnia spójne wideo 480p/540p/768p/1080p z natywnym dźwiękiem stereo, długością 3–15 sekund i przystępnym cennikiem za sekundę — a oficjalne endpointy MiniMax są dostępne w tej samej rodzinie.
Rodzina MiniMax H3 w WaveSpeedAI zawiera 20 endpointów REST obejmujące workflowy: Motion-Control, Image-To-Video, Reference-To-Video, Image-To-Image, Text-To-Image, Video-To-Video, Video-Extend, Text-To-Video. Każdy wariant ma własny cennik, parametry i przykładowe wyniki — wybierz ten, który pasuje do Twoich danych wejściowych i wymagań produkcyjnych, albo wywołuj kilka z jednego klucza API, aby składać wieloetapowe pipeline'y.
Uruchamiaj MiniMax H3 z tym samym kluczem API, kontem rozliczeniowym i limitami, których używasz dla ponad 1000 innych modeli AI w WaveSpeedAI. Bez osobnej konfiguracji u dostawcy, bez osobnych SDK, bez osobnych limitów — jedna integracja obejmuje wszystko: od tekstu na obraz i tekstu na wideo, przez syntezę dźwięku i generowanie 3D, po upscaling i edycję.
Specyfikacja
Możliwości i status premiery MiniMax H3 API
Szczegóły modelu, których deweloperzy szukają przed wyborem API: dostępność, oczekiwana długość wyniku, obsługa referencji i aktualne rozwiązanie zastępcze.
Tekst na wideo
Generowanie sterowane promptem
Użyj wavespeed-ai/minimax-h3/text-to-video, aby zamienić pisemny brief kreatywny w spójne wideo 480p/540p/768p/1080p z natywnym dźwiękiem stereo, długością 3–15 sekund i elastycznymi proporcjami obrazu.
Obraz na wideo
Animacja obrazu statycznego
Użyj wavespeed-ai/minimax-h3/image-to-video, aby animować obraz pierwszej klatki — opcjonalnie z ostatnią klatką — w spójne wideo z natywnym dźwiękiem stereo, przenosząc bohatera, kadrowanie i kierunek artystyczny do ruchu.
Referencja na wideo
Sterowanie tożsamością i stylem
Użyj wavespeed-ai/minimax-h3/reference-to-video, aby sterować generowaniem za pomocą do 9 obrazów referencyjnych, 3 wideo referencyjnych i 3 nagrań referencyjnych, gdy bohater, tożsamość postaci lub styl muszą pozostać spójne.
Integracja API
Jeden workflow WaveSpeedAI
Wysyłaj predykcje H3 swoim kluczem API WaveSpeedAI, śledź każde żądanie w standardowym cyklu życia predykcji i pobieraj wygenerowane wideo z odpowiedzi z wynikiem — ten sam workflow dla endpointów hostowanych przez WaveSpeed i oficjalnych endpointów MiniMax.
Endpointy
Wszystkie endpointy API MiniMax H3
20 endpointów MiniMax H3 dostępnych teraz w WaveSpeedAI — wybierz wariant pasujący do Twojego workflow.
/filters:quality(82)/media/images/1790573118566544886_jzIR0oxG.webp)
Minimax H3 Controlnet Union
MiniMax H3 Open Weights ControlNet Union generates a new video that follows the motion and composition of a source video. Pose, depth, edges, lines, scribble or grayscale structure is extracted from the source automatically and guides the output, optionally with reference images for the subject or style, with native stereo audio generated in the same pass. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1789888783447157992_hG8iqAJS.webp)
Minimax H3 Singularity Image To Video Lora
MiniMax H3 Singularity Open Weights Image to Video animates a first-frame image, optionally with last-frame guidance, into coherent 480P / 540P / 768P videos with native stereo audio, 5-15 second duration, flexible aspect ratios, and per-second billing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1789888766253281059_pb1bluDL.webp)
Minimax H3 Singularity Image To Video
MiniMax H3 Singularity Open Weights Image-to-Video animates a first-frame image, with optional last-frame guidance, into coherent 480P / 540P / 768P videos with native stereo audio, 5-15 second duration, flexible aspect ratios, and per-second billing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1789742735070040548_71aJS2bl.webp)
Minimax H3 Singularity Reference To Video Lora
MiniMax H3 Singularity Open Weights Reference to Video with custom LoRA support generates coherent 480P / 540P / 768P videos from prompts and multimodal references, guided by up to 9 reference images, 3 reference videos, and 3 reference audios, with native stereo audio and flexible reference-based video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1789742804979721138_b4T1aktE.webp)
Minimax H3 Singularity Reference To Video
MiniMax H3 Singularity Open Weights Reference to Video generates coherent 480P / 540P / 768P videos from prompts and multimodal references, guided by up to 9 reference images, 3 reference videos, and 3 reference audios, with native stereo audio and flexible reference-based video generation on WaveSpeedAI infrastructure. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1788684887040987486_ILX6fU3e.webp)
Minimax H3 Image Edit Lora
MiniMax H3 Open Weights Image Edit re-renders a subject from up to 9 reference images into a new scene, outfit or style from a text instruction, preserving identity at 1K or 2K resolution. Loads up to 3 custom LoRA weights per request. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/1788684121915845410_PlPY7gqA.webp)
Minimax H3 Text To Image Lora
MiniMax H3 Open Weights Text-to-Image generates photorealistic, cinema-grade stills from a text prompt at 1K or 2K resolution with fifteen aspect ratios. Loads up to 3 custom LoRA weights per request. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/1788684872529921426_LGPY7gpy.webp)
Minimax H3 Image Edit
MiniMax H3 Open Weights Image Edit re-renders a subject from up to 9 reference images into a new scene, outfit or style from a text instruction, preserving identity at 1K or 2K resolution. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/1788684072554630514_Lg4clvEO.webp)
Minimax H3 Text To Image
MiniMax H3 Open Weights Text-to-Image generates photorealistic, cinema-grade stills from a text prompt at 1K or 2K resolution with fifteen aspect ratios. Ready-to-use REST inference API, best performance, no cold starts, affordable pricing.
/filters:quality(82)/media/images/1788329903545692055_lEMW5fpy.webp)
Minimax H3 Video Edit
MiniMax H3 Open Weights Video-Edit edits an input video from a natural-language prompt. The input video drives subject identity, composition, and motion while the model rewrites lighting, style, weather, environment, or specific elements as instructed, with native stereo audio generated in the same pass. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1788333421627652695_cNUHuh5T.webp)
Minimax H3 Video Extend
MiniMax H3 Open Weights Video-Extend appends a new cinematic continuation to an existing video. A fresh segment with native stereo audio is generated from the input video's last frame and a natural-language prompt, then the original and new segment are concatenated into a single output. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1786952873106530692_cwjsCLT3.webp)
Minimax H3 Reference To Video Lora
MiniMax H3 Open Weights Reference to Video with custom LoRA support generates coherent 480P / 540P / 768P videos from prompts and multimodal references, guided by up to 9 reference images, 3 reference videos, and 3 reference audios, with native stereo audio and flexible reference-based video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1786952854061501695_t8heoxGQ.webp)
Minimax H3 Image To Video Lora
MiniMax H3 Open Weights Image to Video animates a first-frame image, optionally with last-frame guidance, into coherent 480P / 540P / 768P videos with native stereo audio, 5-15 second duration, flexible aspect ratios, and per-second billing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1788760867264586097_7BZ9isBK.webp)
Minimax H3 Text To Video Lora
MiniMax H3 Open Weights Text to Video with custom LoRA support generates coherent videos from text prompts, with 480P / 540P / 768P output, native stereo audio, 5-15 second duration, flexible aspect ratios, and per-second billing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1785814033019871155_vhrAKT2c.webp)
Minimax H3 Reference To Video
MiniMax H3 Open Weights Reference to Video generates coherent 480P / 540P / 768P videos from prompts and multimodal references, guided by up to 9 reference images, 3 reference videos, and 3 reference audios, with native stereo audio and flexible reference-based video generation on WaveSpeedAI infrastructure. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1785815150161566057_2VF6wZoP.webp)
Minimax H3 Image To Video
MiniMax H3 Open Weights Image to Video animates a first-frame image, optionally with last-frame guidance, into coherent 480P / 540P / 768P videos with native stereo audio, 5-15 second duration, flexible aspect ratios, and per-second billing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1785814561183432100_tW5eoxGP.webp)
Minimax H3 Text To Video
MiniMax H3 Open Weights Text to Video generates coherent videos from text prompts, with 480P / 540P / 768P output, native stereo audio, 5-15 second duration, flexible aspect ratios, and per-second billing. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1785415007635242852_UoxHQZ9H.webp)
H3 Reference To Video
MiniMax H3 Reference to Video generates coherent 2K videos from natural-language prompts and multimodal references, including images, videos, and audio, guiding subject consistency, motion, timing, visual style, and scene continuity. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1785414895750297795_1JajtDMV.webp)
H3 Image To Video
MiniMax H3 Image to Video animates a first-frame image into a coherent 2K video, with natural-language motion instructions and optional last-frame control for consistent motion, scene continuity, and cinematic video generation. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
/filters:quality(82)/media/images/1785412796956877340_AktCLU4J.webp)
H3 Text To Video
MiniMax H3 Text to Video generates coherent 2K videos from text prompts, with flexible 5-15 second duration and adaptive or custom aspect ratios for cinematic scenes, creative videos, and production workflows. Ready-to-use REST inference API, best performance, no coldstarts, affordable pricing.
Przykłady
MiniMax H3 w akcji
Prawdziwe wyniki wygenerowane przez API MiniMax H3. Najedź na wideo, aby zobaczyć podgląd, kliknij, aby otworzyć pełnowymiarowy podgląd.
Jak zacząć
Jak korzystać z API MiniMax H3
Cztery kroki od rejestracji do gotowego wyniku. Pełne przykłady w Pythonie, Node.js i cURL znajdziesz w sekcji API poniżej.
- 01
Uzyskaj klucz API
Załóż konto WaveSpeedAI i skopiuj klucz API z panelu. Nowe konta otrzymują darmowe kredyty na start — wystarczy na kilkadziesiąt uruchomień w playground, zanim zaczną się opłaty.
- 02
Wyślij predykcję
Wyślij dane wejściowe jako JSON metodą POST na https://api.wavespeed.ai/api/v3/wavespeed-ai/minimax-h3/text-to-video. Endpoint od razu zwraca identyfikator predykcji — generowanie jest asynchroniczne, więc nie trzymasz otwartego połączenia na czas inferencji.
- 03
Sprawdzaj ukończenie
Wywołaj GET https://api.wavespeed.ai/api/v3/predictions/{request_id}/result. Przy statusie completed odbierz wyniki; przy failed, cancelled, timeout lub deleted zakończ z błędem; przy każdym innym statusie odpytuj dalej.
- 04
Odczytaj adres wyniku
Gdy status to "completed", odczytaj adres URL z data.outputs[0]. Wskazuje on wygenerowane media w CDN WaveSpeedAI — obraz, wideo, dźwięk lub plik 3D, zależnie od wywołanego wariantu MiniMax H3.
Zastosowania
Co możesz zbudować z MiniMax H3
Typowe workflowy, do których deweloperzy i twórcy używają API MiniMax H3.
Tekst na wideo dla oryginalnych koncepcji
Zamień prompt w oryginalną filmową scenę dzięki wavespeed-ai/minimax-h3/text-to-video — spójne wyjście 480p/540p/768p/1080p z natywnym dźwiękiem stereo i elastycznymi proporcjami obrazu. Używaj go do wizualizacji koncepcji, opowiadania historii, pomysłów na kampanie i ujęć, które nie muszą wychodzić z istniejącej grafiki.
Obraz na wideo do prezentacji produktów
Animuj zdjęcia produktowe, kadry kampanii, key art lub obrazy postaci, zachowując kierunek wizualny źródła. Przydatne w prezentacjach produktów, reklamach społecznościowych i treściach landing page opartych na ruchu.
Referencja na wideo dla spójnych bohaterów
Użyj do 9 obrazów referencyjnych, 3 wideo referencyjnych i 3 nagrań referencyjnych, aby sterować tożsamością postaci, wyglądem bohatera, projektem sceny lub stylem. Referencja na wideo to workflow H3 dla powracających postaci, wizualiów marki i powiązanych zestawów kreatywnych.
Treści do mediów społecznościowych i reklam
Generuj krótkie koncepcje kreatywne do kampanii, premier, feedów społecznościowych i marketingu efektywnościowego. Przechodź od tekstu, gotowego obrazu lub zatwierdzonej referencji wizualnej bez zmiany platformy API.
Sceny z postaciami i opowiadanie wizualne
Twórz sceny z postaciami, momenty fabularne, ujęcia nastrojowe i previzualizacje, wybierając endpoint pod materiał źródłowy: tekst dla nowych scen, obraz do animacji lub referencje dla większej ciągłości.
Skalowalne potoki generowania wideo AI
Zintegruj MiniMax H3 z aplikacjami i zautomatyzowanymi workflow kreatywnymi przez WaveSpeedAI. Używaj jednego klucza API i spójnego cyklu życia predykcji we wszystkich trzech trybach generowania H3.
Wskazówki
Wskazówki do promptów dla MiniMax H3
Praktyczne rady, jak uzyskiwać lepsze wyniki z MiniMax H3 — oparte na wzorcach, które sprawdzają się w produkcyjnych pipeline'ach dla modeli wideo.
- 01
Wybierz endpoint według materiału źródłowego
Użyj tekstu na wideo dla oryginalnego promptu, obrazu na wideo, aby animować jeden obraz źródłowy, oraz referencji na wideo, gdy referencje wizualne mają sterować tożsamością, wyglądem bohatera, projektem sceny lub stylem.
- 02
Opisuj ruch jako sekwencję
Zapisz stan początkowy, akcję, reakcję otoczenia, ruch kamery i stan końcowy w kolejności chronologicznej. Wyraźna progresja daje H3 silniejszy plan ruchu niż lista niepowiązanych przymiotników wizualnych.
- 03
Używaj obrazu na wideo, gdy kompozycja jest już zatwierdzona
Jeśli bohater, produkt, kadrowanie lub kierunek artystyczny są ustalone na obrazie statycznym, zacznij od obrazu na wideo zamiast odtwarzać scenę z tekstu. Skup prompt na ruchu i zachowaniu kamery.
- 04
Daj każdej referencji jedno wyraźne zadanie
W referencji na wideo określ, co referencje mają kontrolować: tożsamość postaci, wygląd produktu, styl wizualny, otoczenie lub kompozycję. Unikaj proszenia tej samej referencji o zdefiniowanie kilku sprzecznych aspektów ujęcia.
- 05
Jedna główna akcja na krótką scenę
Skupioną akcję łatwiej wyrenderować spójnie niż pełną sekwencję niepowiązanych zdarzeń. Generuj osobne ujęcia dla osobnych momentów fabuły, a potem złóż je w montażu, gdy koncepcja wymaga szerszego zakresu narracji.
Cennik
Cennik API MiniMax H3
Cena jest naliczana za wynik. Końcowa opłata zależy od parametrów ustawionych w playground każdego wariantu (rozdzielczość, czas trwania, liczba wyników, referencje).
API
Wywołaj API MiniMax H3
Uzyskaj klucz API na wavespeed.ai/accesskey, a następnie wyślij predykcję przez REST. Playground generuje gotowe do wklejenia przykłady dla dowolnej kombinacji danych wejściowych.
POSThttps://api.wavespeed.ai/api/v3/wavespeed-ai/minimax-h3/text-to-video
# 1. Submit the prediction.
SUBMIT_RESPONSE=$(curl --silent --show-error --fail-with-body \
-X POST "https://api.wavespeed.ai/api/v3/wavespeed-ai/minimax-h3/text-to-video" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "16:9",
"resolution": "480p",
"duration": 5
}')
TASK=$(printf '%s' "$SUBMIT_RESPONSE" | jq 'if has("data") then .data else . end')
PREDICTION_ID=$(printf '%s' "$TASK" | jq -r '.id')
if [ -z "$PREDICTION_ID" ] || [ "$PREDICTION_ID" = "null" ]; then
printf 'Submission response did not contain a prediction id
' >&2
exit 1
fi
RESULT_URL="https://api.wavespeed.ai/api/v3/predictions/$PREDICTION_ID/result"
# 2. Poll until the prediction finishes.
while true; do
RESPONSE=$(curl --silent --show-error --fail-with-body "$RESULT_URL" \
-H "Authorization: Bearer $WAVESPEED_API_KEY")
RESULT=$(printf '%s' "$RESPONSE" | jq 'if has("data") then .data else . end')
STATUS=$(printf '%s' "$RESULT" | jq -r '.status')
case "$STATUS" in
completed) printf '%s\n' "$RESULT" | jq '.outputs'; break ;;
failed|cancelled|timeout|deleted) printf '%s\n' "$RESULT" | jq . >&2; exit 1 ;;
*) sleep 2 ;;
esac
doneconst submitUrl = "https://api.wavespeed.ai/api/v3/wavespeed-ai/minimax-h3/text-to-video";
const apiKey = process.env.WAVESPEED_API_KEY;
if (!apiKey) throw new Error('Set WAVESPEED_API_KEY');
async function requestJson(url, options = {}) {
const response = await fetch(url, options);
if (!response.ok) throw new Error(await response.text());
return response.json();
}
// 1. Submit the prediction.
const body = await requestJson(submitUrl, {
method: "POST",
headers: {
"Authorization": `Bearer ${apiKey}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "16:9",
"resolution": "480p",
"duration": 5
}),
});
const task = body.data ?? body;
const resultUrl = `https://api.wavespeed.ai/api/v3/predictions/${task.id}/result`;
// 2. Poll until the prediction finishes.
while (true) {
const resultBody = await requestJson(resultUrl, {
headers: { "Authorization": `Bearer ${apiKey}` },
});
const result = resultBody.data ?? resultBody;
if (result.status === "completed") {
console.log(result.outputs);
break;
}
if (["failed", "cancelled", "timeout", "deleted"].includes(result.status)) throw new Error(JSON.stringify(result));
await new Promise(resolve => setTimeout(resolve, 2000));
}import json
import os
import time
from urllib.request import Request, urlopen
api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
"prompt": "A cinematic shot of a city at sunset, soft golden light",
"aspect_ratio": "16:9",
"resolution": "480p",
"duration": 5
}
def request_json(url, data=None):
request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
with urlopen(request) as response:
return json.load(response)
# 1. Submit the prediction.
body = request_json("https://api.wavespeed.ai/api/v3/wavespeed-ai/minimax-h3/text-to-video", json.dumps(payload).encode())
task = body.get("data", body)
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"
# 2. Poll until the prediction finishes.
while True:
result_body = request_json(result_url)
result = result_body.get("data", result_body)
status = result.get("status")
if status == "completed":
print(result.get("outputs", []))
break
if status in {"failed", "cancelled", "timeout", "deleted"}:
raise RuntimeError(result)
time.sleep(2)Porównanie
MiniMax H3 a alternatywy
Kiedy wybrać MiniMax H3 zamiast podobnych modeli w WaveSpeedAI.
MiniMax H3 a Hailuo 2.3
Hailuo 2.3 oferuje warstwowe endpointy tekst na wideo i obraz na wideo w wariantach Standard, Pro, Fast i Fast Pro. MiniMax H3 ma zwarty zestaw trzech endpointów i dodaje referencję na wideo jako pełnoprawny workflow dla wskazówek wizualnych i spójności bohatera.
MiniMax H3 a Seedance 2.0
Seedance 2.0 to szeroka rodzina produkcyjna z tekstem na wideo, obrazem na wideo, video-edit, video-extend, natywnym dźwiękiem i wieloma poziomami wydajności. MiniMax H3 jest prostszym wyborem, gdy workflow opiera się na generowaniu z tekstu, obrazu źródłowego lub referencji wizualnych.
MiniMax H3 a Kling 3.0
Kling 3.0 kładzie nacisk na warstwową jakość wyjścia i dedykowane endpointy motion control. MiniMax H3 porządkuje API według typu źródła, w tym dedykowanej ścieżki referencja na wideo dla generowania sterowanego tożsamością, bohaterem i stylem.
FAQ
MiniMax H3 API — najczęściej zadawane pytania
Cennik, licencja, integracja — typowe pytania o uruchamianie MiniMax H3 w WaveSpeedAI.
Czym jest API MiniMax H3?
API MiniMax H3 to zestaw trzech modeli do generowania wideo AI w WaveSpeedAI. Obsługuje tekst na wideo dla scen sterowanych promptem, obraz na wideo do animowania obrazów statycznych oraz referencję na wideo do generowania sterowanego referencjami wizualnymi.
Którego endpointu API MiniMax H3 powinienem użyć?
Zacznij od zalecanego wdrożenia open-weights na infrastrukturze WaveSpeed: wavespeed-ai/minimax-h3/text-to-video, gdy zaczynasz od promptu, wavespeed-ai/minimax-h3/image-to-video, gdy animujesz obraz źródłowy, oraz wavespeed-ai/minimax-h3/reference-to-video, gdy referencje wizualne mają sterować tożsamością, wyglądem lub stylem bohatera. Oficjalne endpointy minimax/h3 są dostępne w tej samej rodzinie.
Czy MiniMax H3 obsługuje generowanie obrazu na wideo?
Tak. Endpoint wavespeed-ai/minimax-h3/image-to-video animuje obraz pierwszej klatki — opcjonalnie z ostatnią klatką — w spójne wideo z natywnym dźwiękiem stereo, dzięki czemu nadaje się do animowania zdjęć produktowych, grafik kampanii, obrazów postaci, klatek koncepcyjnych i innych istniejących materiałów wizualnych.
Czym jest referencja na wideo w MiniMax H3?
Referencja na wideo w MiniMax H3 generuje nowe wideo, którym sterują do 9 obrazów referencyjnych, 3 wideo referencyjne i 3 nagrania referencyjne wyznaczające bohatera, tożsamość postaci, styl lub język sceny. To preferowany endpoint H3 dla powracających postaci i workflow kreatywnych spójnych z marką.
Jak używać API MiniMax H3 w WaveSpeedAI?
Wybierz endpoint H3 pasujący do Twojego źródła, uwierzytelnij się kluczem API WaveSpeedAI, wyślij dane wejściowe modelu jako JSON i użyj zwróconego identyfikatora predykcji lub adresu URL wyniku, aby pobrać wygenerowane wideo. Karty endpointów i przykłady kodu na tej stronie pokazują aktualny schemat żądania.
Jak wywołać API MiniMax H3?
Załóż konto WaveSpeedAI, skopiuj klucz API z /accesskey, a następnie wyślij POST na https://api.wavespeed.ai/api/v3/wavespeed-ai/minimax-h3/text-to-video z danymi wejściowymi w JSON. Endpoint zwraca identyfikator predykcji. Odpytuj endpoint wyniku mniej więcej co 2 sekundy, wydłużaj odstęp przy długich zadaniach i zatrzymaj się przy dowolnym statusie końcowym. Produkcyjne przykłady w Pythonie / Node.js / cURL znajdziesz powyżej.
Ile kosztuje API MiniMax H3?
MiniMax H3 zaczyna się od $0.02 za uruchomienie. Dokładny koszt zależy od ustawionych parametrów (rozdzielczość, czas trwania, liczba wyników, referencje). Podgląd kosztu na żywo obok przycisku Generuj w playground pokazuje dokładną cenę dla bieżących danych.
Jakie warianty MiniMax H3 są dostępne?
WaveSpeedAI udostępnia 20 aktywnych endpointów MiniMax H3: wavespeed-ai/minimax-h3/controlnet-union, wavespeed-ai/minimax-h3-singularity/image-to-video-lora, wavespeed-ai/minimax-h3-singularity/image-to-video, wavespeed-ai/minimax-h3-singularity/reference-to-video-lora, wavespeed-ai/minimax-h3-singularity/reference-to-video, wavespeed-ai/minimax-h3/image-edit-lora, wavespeed-ai/minimax-h3/text-to-image-lora, wavespeed-ai/minimax-h3/image-edit, i inne. Każdy wariant ma własną stronę playground i cennik.
Czy mogę używać wyników MiniMax H3 komercyjnie?
Prawa do komercyjnego użycia wynikają z licencji modelu MiniMax. Większość modeli MiniMax zezwala na komercyjne wykorzystanie wyników; skrót licencji znajdziesz na stronie playground każdego modelu, a warunki na poziomie platformy w Warunkach świadczenia usług WaveSpeedAI.
Dlaczego korzystać z MiniMax H3 w WaveSpeedAI zamiast bezpośrednio?
Jeden klucz API i jedno konto rozliczeniowe dla MiniMax H3 ORAZ ponad 1000 innych modeli AI od innych dostawców. Bez osobnej konfiguracji SDK, bez osobnych limitów, bez przepisywania kodu integracji pod każdego dostawcę. Ceny są zazwyczaj na poziomie bezpośredniego API MiniMax lub niższe.
Dostawca
O MiniMax
Zespół stojący za MiniMax H3 i szerszą linią modeli MiniMax w WaveSpeedAI.
MiniMax to chińskie laboratorium AI znane z generowania wideo Hailuo i modeli mowy. Hailuo 2.3 oferuje tekst na wideo i obraz na wideo uwzględniające fizykę na poziomach Standard, Pro i Fast — pozycjonowane wokół 2,5× wyższej wydajności i dużej dokładności przy złożonych instrukcjach w workflow twórców i marketingu.
Zacznij budować z MiniMax H3 w WaveSpeedAI
Darmowe kredyty na start po rejestracji. Jeden klucz API do ponad 1000 modeli AI od MiniMax i wszystkich innych dostawców.