모델 제품군 37개 · 엔드포인트 358개 이상
AI 모델 API
API 키 하나로 선도적인 비디오, 이미지, 3D 모델을 모두 사용하세요. 모델을 고르면 엔드포인트, 실시간 가격, 바로 실행할 수 있는 코드를 볼 수 있습니다.
curl -X POST https://api.wavespeed.ai/api/v3/<model> \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{"prompt": "…"}'비디오23
텍스트, 이미지, 레퍼런스에서 비디오로, 그리고 편집과 연장.

FLUX 3 API
Black Forest Labs FLUX 3 API가 WaveSpeedAI에서 제공됩니다.

MiniMax H3 API
네이티브 스테레오 오디오, 뛰어난 모션 품질, 피사체 일관성, 장면 일관성을 갖춘 시네마틱 텍스트-투-비디오, 이미지-투-비디오, 레퍼런스-투-비디오 생성을 위한 MiniMax H3 API입니다.

Seedance 2.5 API
ByteDance Seedance 2.5 API가 WaveSpeedAI에서 제공됩니다.

Seedance 2.0 Mini API
Seedance 2.0의 더 빠르고 저렴한 등급입니다.

Seedance 2.0 API
네이티브 오디오-비주얼 동기화, 감독 수준의 카메라 및 조명 제어, 뛰어난 모션 안정성을 갖춘 할리우드급 시네마틱 비디오입니다.

Seedance 1.5 Pro API
강한 프롬프트 반영, 표현력 있는 모션, 안정적인 미감을 갖춘 실사 지향의 시네마틱 클립입니다.

Veo 3.1 API
1080p에서 동기화된 네이티브 오디오를 지원하는 텍스트-투-비디오입니다.

Wan 3.0 API
Wan 2.7의 두 배인 최대 30초를 한 번의 생성 패스로 만드는 시네마틱 비디오입니다.

Wan 2.7 API
선명한 디테일, 안정적인 모션, 강한 지시 이행을 갖춘 일관성 있는 시네마틱 비디오입니다.

Happy Horse 1.0 API
부드러운 카메라 무빙, 표현력 있는 모션, 강한 프롬프트 충실도를 갖춘 시네마틱 720p / 1080p 비디오입니다.

Kling 3.0 API
부드러운 모션, 시네마틱 비주얼, 정확한 프롬프트 반영, 네이티브 오디오를 갖춘 텍스트-투-비디오와 이미지-투-비디오입니다.

Kling 3.0 Motion Control API
레퍼런스 비디오의 모션을 전이해 정지된 캐릭터 이미지를 움직입니다.

Vidu Q4 API
3~16초 클립, 540p~4K 출력, 선택형 오디오 생성을 갖춘 이미지-투-비디오와 레퍼런스-투-비디오를 제공합니다.

Vidu Q3 API
텍스트-투-비디오, 이미지-투-비디오, 레퍼런스-투-비디오(멀티 엔티티 일관성을 위한 1~4장의 레퍼런스 이미지), start-end-to-video를 제공합니다.

InfiniteTalk API
사진 한 장과 오디오로 말하거나 노래하는 아바타 비디오를 최대 10분까지 만듭니다.

Wan 2.2 API
WaveSpeedAI에 배포된 35개 이상의 자체 변형을 갖춘 오픈 웨이트 비디오 툴킷입니다.

Sora 2 API
사실적인 비주얼, 정확한 물리, 동기화된 오디오, 강한 조향성을 갖춘 최첨단 텍스트-투-비디오와 이미지-투-비디오입니다.

Kling Omni O3 API
MVL(Multi-modal Visual Language) 기술을 갖춘 고급 통합 멀티모달 비디오 모델입니다.

Grok Imagine Video 1.5 API
최대 1080p의 빠른 텍스트-투-비디오, 이미지-투-비디오, 최대 7장의 레퍼런스 이미지로 정체성이 일관된 출력을 만드는 레퍼런스-투-비디오를 제공하며 화면 비율을 선택할 수 있습니다.

Grok Imagine Video API
텍스트-투-비디오, 이미지-투-비디오, 레퍼런스-투-비디오, video-extend, edit-video와 더불어, 1080p 텍스트-투-비디오와 최대 7장 이미지의 레퍼런스-투-비디오를 지원하는 빠른 v1.5 생성을 제공합니다.

Hailuo 2.3 API
2.5배의 효율 향상과 85%의 복잡한 지시 정확도를 갖춘 물리 인식 텍스트-투-비디오와 이미지-투-비디오입니다.

Wan 2.6 API
720p/1080p에서 동기화된 오디오를 지원하는 텍스트-투-비디오와 이미지-투-비디오이며, 같은 패밀리에서 레퍼런스-투-비디오, video-extend, image-edit, 텍스트-투-이미지도 제공합니다.

Higgsfield API Alternative
Seedance 2.5 및 2.0, Kling 3.0 및 O3, Wan 3.0, 오픈 웨이트 MiniMax H3와 Qwen Image 3.0 — 에 더해 Seedream 5.0, Nano Banana 2 및 Pro, GPT Image 2.5 및 2까지, 하나의 W…
이미지11
텍스트 → 이미지와 이미지 편집, 빠른 초안부터 4K까지.

Nano Banana Pro API
휴대폰에 최적화된 고해상도 4K 텍스트-투-이미지 및 이미지 편집입니다.

Nano Banana 2.1 API
최신 Nano Banana 이미지 생성 및 편집 모델입니다.

Nano Banana 2 API
Flash 속도로 제공되는 Pro 품질의 이미지 생성입니다.

GPT Image 2 API
자연어 프롬프트로 고품질 이미지를 만드는 텍스트-투-이미지 및 편집 엔드포인트입니다.

GPT Image 2.5 API
빠르고 균형 잡힌 Flare와 정밀도 중심의 Sunburst, 두 등급으로 제공되는 텍스트-투-이미지 및 편집 엔드포인트입니다.

Seedream 4.5 API
타이포그래피에 최적화된 차세대 텍스트-투-이미지 모델입니다.

Seedream 5 API
하나의 API에서 제공되는 두 가지 등급입니다.

Video Watermark Remover API
품질을 유지하면서 비디오에서 Kling과 Seedance 워터마크, 로고, 자막, 텍스트를 제거합니다.

Qwen Image 3.0 API
유연한 화면 비율, 1K/2K 출력, 자연어 지시 이해를 갖춘 Standard 및 Pro 텍스트-투-이미지와 이미지 편집 엔드포인트입니다.

Qwen Image API
중국어/영어 이중 언어 지원, 멀티 이미지 편집, LoRA 커스터마이징, 레이어 합성, 96가지 포즈의 카메라 앵글 시스템을 갖춘 20B MMDiT 차세대 텍스트-투-이미지 및 편집 툴킷입니다.

Flux 2 Klein API
향상된 사실감, 더 선명한 텍스트 생성, 빠른 커스터마이징을 위한 LoRA 지원을 갖춘 고품질 4B 및 9B 텍스트-투-이미지와 편집 모델입니다.
도구02
이미지와 비디오의 업스케일링 및 정리.

Image Upscaler Collection API
WaveSpeedAI(Standard, Ultimate, Real-ESRGAN), Clarity AI(Creative, Crystal, Flux, Pro), Recraft(Creative, Crisp), Pruna AI — 를 하나의 WaveSpeedAI API …

Video Upscaler Collection API
WaveSpeedAI(Standard, Pro, Ultimate, SeedVR2, LTX-2 19B), ByteDance, Bria, Clarity AI — 를 하나의 WaveSpeedAI API 키로 모두 사용할 수 있습니다.
3D01
텍스트와 이미지에서 3D 에셋으로.
API 키 하나로 만들어 보세요
WaveSpeedAI의 모든 모델은 같은 REST API, SDK, 결제 체계를 공유합니다.
