37のモデルファミリー · 358以上のエンドポイント
AIモデルAPI
主要な動画・画像・3Dモデルを、1つのAPIキーで。モデルを選ぶと、エンドポイント、リアルタイム料金、すぐに実行できるコードが表示されます。
curl -X POST https://api.wavespeed.ai/api/v3/<model> \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{"prompt": "…"}'動画23
テキスト、画像、参照入力からの動画生成に加え、編集と延長。

FLUX 3 API
Black Forest Labs の FLUX 3 API が WaveSpeedAI で利用可能になりました。テキストから動画、画像から動画、開始・終了フレーム動画、動画延長、Draft、動画アップスケールの各エンドポイントを提供します。5〜20秒のクリップを720Pまたは1080Pで生成…

MiniMax H3 API
MiniMax H3 API は、テキストから動画、画像から動画、リファレンスから動画のシネマティックな生成に対応し、ネイティブステレオオーディオ、優れたモーション品質、被写体の一貫性、シーンのまとまりを備えています。オープンウェイト版を WaveSpeed のインフラで、または公式の Min…

Seedance 2.5 API
ByteDance の Seedance 2.5 API が WaveSpeedAI で利用可能になりました。30秒のワンショット動画生成、ネイティブの多言語オーディオ、最大50のマルチモーダルリファレンス、高精度な動画編集と延長に対応し、テキストから動画、画像から動画、video-edit、…

Seedance 2.0 Mini API
ByteDance の Seedance 2.0 Mini は、Seedance 2.0 のより高速で低コストな階層です。シネマティックなマルチショットのストーリーテリング、AIカメラコントロール、ネイティブオーディオ付きのキャラクターの一貫性はそのままに、標準価格の50%で利用できます。

Seedance 2.0 API
ByteDance の Seedance 2.0 は、映像とオーディオのネイティブな同期、ディレクター級のカメラ・ライティング制御、卓越したモーション安定性を備えた、ハリウッド品質のシネマティック動画です。Seed の統合マルチモーダルアーキテクチャをベースにしています。

Seedance 1.5 Pro API
ByteDance の Seedance 1.5 Pro は、実写寄りのシネマティックなクリップを、高いプロンプト追従性、表現力豊かなモーション、安定した美しさで生成します。4〜12秒の長さと Smart Duration、複数のアスペクト比、シードによる再現可能な生成に対応しています。

Veo 3.1 API
Google の Veo 3.1 は、1080pの同期ネイティブオーディオ付きのテキストから動画に対応しています。3つの階層(Standard、Fast、Lite)に、テキストから動画、画像から動画、リファレンスから動画、video-extend があり、Lite 階層では start-end…

Wan 3.0 API
Alibaba の Wan 3.0 は、1回の生成処理で最長30秒のシネマティックな動画を作れます。これは Wan 2.7 の上限の2倍です。テキストから動画、最初と最後のフレームでガイドできる画像から動画、画像、動画、オーディオの参照をまとめて受け付けるリファレンスから動画に対応。480p …

Wan 2.7 API
Alibaba の WAN 2.7 は、くっきりしたディテール、安定したモーション、優れた指示追従性を備えた、まとまりのあるシネマティックな動画を生成します。テキストから動画、画像から動画、リファレンスから動画、video-edit、video-extend のエンドポイントがそれぞれ別に用意…

Happy Horse 1.0 API
Alibaba の Happy Horse 1.0 は、滑らかなカメラワーク、表現力豊かなモーション、高いプロンプト忠実度を備えた、720p / 1080pのシネマティックな動画を生成します。複数の生成にわたってキャラクターやスタイルのアイデンティティを一貫させる、リファレンスから動画も備えて…

Kling 3.0 API
Kuaishou の Kling 3.0 は、滑らかなモーション、シネマティックなビジュアル、正確なプロンプト追従性、ネイティブオーディオを備えた、テキストから動画と画像から動画に対応します。Standard、Pro、4K の3つの階層があります。

Kling 3.0 Motion Control API
Kuaishou の Kling 3.0 Motion Control は、参照動画からモーションを転送して、静止したキャラクター画像をアニメーション化します。キャラクター画像とモーションのクリップ(ダンス、アクション、ジェスチャー)をアップロードすると、モデルが動きを抽出して、滑らかでリアル…

Vidu Q4 API
Shengshu の Vidu Q4 は、画像から動画とリファレンスから動画に対応し、3〜16秒のクリップ、540p〜4Kの出力、オプションの音声生成を備えています。リファレンスから動画では、1回のリクエストで最大12枚の参照画像と最大3本の参照オーディオを使えます。

Vidu Q3 API
Shengshu の Vidu Q3 は、テキストから動画、画像から動画、リファレンスから動画(複数の被写体の一貫性のための1〜4枚の参照画像)、start-end-to-video に対応します。Standard、Pro、Turbo の3つの階層があり、一部のバリアントでは最長16秒の出力が…

InfiniteTalk API
WaveSpeedAI の InfiniteTalk は、1枚の写真とオーディオを、最長10分の、話す、または歌うアバター動画に変換します。Standard と Fast の階層に加え、Multi バリアント(1枚の画像と2つのオーディオ入力による複数キャラクターの出力)と、Video-to-…

Wan 2.2 API
Alibaba の Wan 2.2 は、WaveSpeedAI にデプロイされた、35以上の自社バリアントを持つオープンウェイトの動画ツールキットです。Animate(120秒のキャラクターアニメーション)、Video Edit、Speech-to-Video(10分のオーディオ駆動)、Fun…

Sora 2 API
OpenAI の Sora 2 は、リアルなビジュアル、正確な物理、同期されたオーディオ、高い操作性を備えた、最先端のテキストから動画と画像から動画です。Standard と Pro の階層に加え、複数の生成にわたって再利用できるキャラクターIDを作る Characters エンドポイントがあ…

Kling Omni O3 API
Kuaishou の Kling Omni Video O3 は、MVL(Multi-modal Visual Language)技術を備えた、高度な統合型マルチモーダル動画モデルです。Standard、Pro、4K の階層に、テキストから動画、画像から動画、リファレンスから動画、会話形式の …

Grok Imagine Video 1.5 API
XAI の Grok Imagine Video 1.5 は、最大1080pの高速なテキストから動画、画像から動画、最大7枚の参照画像からアイデンティティの一貫性を保つリファレンスから動画に対応し、アスペクト比も選べます。

Grok Imagine Video API
XAI の Grok Imagine Video は、テキストから動画、画像から動画、リファレンスから動画、video-extend、edit-video に対応し、さらに、1080pのテキストから動画と最大7枚の画像からのリファレンスから動画を備えた高速な v1.5 の生成も提供します。

Hailuo 2.3 API
MiniMax の Hailuo 2.3 は、物理を考慮したテキストから動画と画像から動画で、2.5倍の効率向上と、複雑な指示への85%の正確さを備えています。768pと1080pの Standard と Pro の階層に加え、クリエイターやマーケター向けに最適化された Fast バリアントが…

Wan 2.6 API
Alibaba の WAN 2.6 は、720p/1080pで同期オーディオ付きのテキストから動画と画像から動画に対応し、同じファミリーにリファレンスから動画、video-extend、image-edit、text-to-image も備えています。速度を最適化した生成のための Flash …

Higgsfield API Alternative
Higgsfield API で開発者が探しているモデル(Seedance 2.5 と 2.0、Kling 3.0 と O3、Wan 3.0、オープンウェイトの MiniMax H3、Qwen Image 3.0)に加え、Seedream 5.0、Nano Banana 2 と Pro、GPT…
画像11
テキストから画像と画像編集。高速なドラフトから4Kまで。

Nano Banana Pro API
Google の Nano Banana Pro(Gemini 3.0 Pro Image)は、スマートフォン向けに最適化された高解像度4Kのテキストから画像生成と画像編集を提供します。生成と編集の両方に、Standard、Ultra(より高解像度)、Multi(複数出力)のバリアントがあります。

Nano Banana 2.1 API
Google の Nano Banana 2.1 は、Nano Banana シリーズ最新の画像生成・編集モデルです。Google によると、従来モデルからあらゆる面で向上しており、特にビジュアルデザインと被写体の一貫性が大きく改善されたほか、プロンプトへの忠実度が高まり、文字描画もよりきれい…

Nano Banana 2 API
Google の Nano Banana 2(Gemini 3.1 Flash Image)は、Flash の速度で Pro 品質の画像生成を実現します。512pxから4Kの解像度、向上した文字描画、最大5キャラクターの一貫性、実世界の知識の統合に対応しています。

GPT Image 2 API
OpenAI の GPT Image 2 は、自然言語のプロンプトから高品質な画像を作るテキストから画像・編集エンドポイントを提供します。品質階層(low / medium / high)と解像度のスケーリングにより、呼び出しごとにコストと精細さのバランスを選べます。

GPT Image 2.5 API
OpenAI の GPT Image 2.5 は、テキストから画像と編集のエンドポイントを、Flare(高速でバランス型)と Sunburst(精度重視)の2つの階層で提供します。lowからmaxまでの5段階の品質、1K / 2K / 4Kの出力、15種類のアスペクト比、最大16枚の参照画像に…

Seedream 4.5 API
ByteDance の Seedream 4.5 は、タイポグラフィに最適化された次世代のテキストから画像モデルです。よりくっきりした文字描画、より強いプロンプト追従性、ポスターやブランドビジュアル向けの最大4K出力を備えています。

Seedream 5 API
ByteDance の Seedream 5 は、1つのAPIで2つの階層を提供します。Pro は ByteDance のデザイン理解に優れたフラッグシップで、データ、コンセプト、密度の高いテキストをプロのレイアウトに変換し、インタラクティブな精密編集(ポイントや投げ縄による選択、スケッチのレ…

Video Watermark Remover API
WaveSpeedAI の動画ウォーターマーク除去は、品質を保ちながら、動画から Kling と Seedance のウォーターマーク、ロゴ、字幕、テキストを除去します。多くの形式と、10分のファイルに対応しています。

Qwen Image 3.0 API
Alibaba の Qwen Image 3.0 は、Standard と Pro のテキストから画像と画像編集のエンドポイントで、柔軟なアスペクト比、1K/2Kの出力、自然言語による指示の理解を備えています。

Qwen Image API
Alibaba の Qwen-Image は、20B MMDiT の次世代テキストから画像・編集ツールキットで、中国語/英語のバイリンガル対応、複数画像の編集、LoRAによるカスタマイズ、レイヤー合成、96ポーズのカメラアングルシステムを備えています。

Flux 2 Klein API
Black Forest Labs の FLUX.2 [klein] は、リアリズムの向上、よりくっきりした文字生成、高速なカスタマイズのための LoRA 対応を備えた、高品質な4Bと9Bのテキストから画像・編集モデルです。生成と編集の両方に、Base と LoRA のバリアントがあります。
ツール02
画像と動画の高画質化とクリーンアップ。

Image Upscaler Collection API
5つのプロバイダーの10の画像超解像エンドポイント(WaveSpeedAI(Standard、Ultimate、Real-ESRGAN)、Clarity AI(Creative、Crystal、Flux、Pro)、Recraft(Creative、Crisp)、Pruna AI)を、1つの W…

Video Upscaler Collection API
5つのプロバイダーの8つの動画超解像エンドポイント(WaveSpeedAI(Standard、Pro、Ultimate、SeedVR2、LTX-2 19B)、ByteDance、Bria、Clarity AI)を、1つの WaveSpeedAI のAPIキーで利用できます。目標解像度(最大8K…
3D01
テキストや画像から3Dアセットを生成。
1つのAPIキーで開発を始めよう
WaveSpeedAIのすべてのモデルが、同じREST API、SDK、請求を共有しています。
