Nano Banana 2.1 公開中 — Google 最新モデル | 今すぐ試す →

37のモデルファミリー · 358以上のエンドポイント

AIモデルAPI

主要な動画・画像・3Dモデルを、1つのAPIキーで。モデルを選ぶと、エンドポイント、リアルタイム料金、すぐに実行できるコードが表示されます。

curl -X POST https://api.wavespeed.ai/api/v3/<model> \
  -H "Authorization: Bearer $WAVESPEED_API_KEY" \
  -d '{"prompt": "…"}'

動画23

テキスト、画像、参照入力からの動画生成に加え、編集と延長。

FLUX 3 API

FLUX 3 API

Black Forest Labs の FLUX 3 API が WaveSpeedAI で利用可能になりました。テキストから動画、画像から動画、開始・終了フレーム動画、動画延長、Draft、動画アップスケールの各エンドポイントを提供します。5〜20秒のクリップを720Pまたは1080Pで生成…

1回あたり$0.03から
MiniMax H3 API

MiniMax H3 API

MiniMax H3 API は、テキストから動画、画像から動画、リファレンスから動画のシネマティックな生成に対応し、ネイティブステレオオーディオ、優れたモーション品質、被写体の一貫性、シーンのまとまりを備えています。オープンウェイト版を WaveSpeed のインフラで、または公式の Min…

1回あたり$0.02から
Seedance 2.5 API

Seedance 2.5 API

ByteDance の Seedance 2.5 API が WaveSpeedAI で利用可能になりました。30秒のワンショット動画生成、ネイティブの多言語オーディオ、最大50のマルチモーダルリファレンス、高精度な動画編集と延長に対応し、テキストから動画、画像から動画、video-edit、…

1回あたり$0.81から
Seedance 2.0 Mini API

Seedance 2.0 Mini API

ByteDance の Seedance 2.0 Mini は、Seedance 2.0 のより高速で低コストな階層です。シネマティックなマルチショットのストーリーテリング、AIカメラコントロール、ネイティブオーディオ付きのキャラクターの一貫性はそのままに、標準価格の50%で利用できます。

1回あたり$0.60から
Seedance 2.0 API

Seedance 2.0 API

ByteDance の Seedance 2.0 は、映像とオーディオのネイティブな同期、ディレクター級のカメラ・ライティング制御、卓越したモーション安定性を備えた、ハリウッド品質のシネマティック動画です。Seed の統合マルチモーダルアーキテクチャをベースにしています。

1回あたり$0.50から
Seedance 1.5 Pro API

Seedance 1.5 Pro API

ByteDance の Seedance 1.5 Pro は、実写寄りのシネマティックなクリップを、高いプロンプト追従性、表現力豊かなモーション、安定した美しさで生成します。4〜12秒の長さと Smart Duration、複数のアスペクト比、シードによる再現可能な生成に対応しています。

1回あたり$0.20から
Veo 3.1 API

Veo 3.1 API

Google の Veo 3.1 は、1080pの同期ネイティブオーディオ付きのテキストから動画に対応しています。3つの階層(Standard、Fast、Lite)に、テキストから動画、画像から動画、リファレンスから動画、video-extend があり、Lite 階層では start-end…

1回あたり$0.30から
Wan 3.0 API

Wan 3.0 API

Alibaba の Wan 3.0 は、1回の生成処理で最長30秒のシネマティックな動画を作れます。これは Wan 2.7 の上限の2倍です。テキストから動画、最初と最後のフレームでガイドできる画像から動画、画像、動画、オーディオの参照をまとめて受け付けるリファレンスから動画に対応。480p …

1回あたり$0.475から
Wan 2.7 API

Wan 2.7 API

Alibaba の WAN 2.7 は、くっきりしたディテール、安定したモーション、優れた指示追従性を備えた、まとまりのあるシネマティックな動画を生成します。テキストから動画、画像から動画、リファレンスから動画、video-edit、video-extend のエンドポイントがそれぞれ別に用意…

1回あたり$0.03から
Happy Horse 1.0 API

Happy Horse 1.0 API

Alibaba の Happy Horse 1.0 は、滑らかなカメラワーク、表現力豊かなモーション、高いプロンプト忠実度を備えた、720p / 1080pのシネマティックな動画を生成します。複数の生成にわたってキャラクターやスタイルのアイデンティティを一貫させる、リファレンスから動画も備えて…

1回あたり$0.70から
Kling 3.0 API

Kling 3.0 API

Kuaishou の Kling 3.0 は、滑らかなモーション、シネマティックなビジュアル、正確なプロンプト追従性、ネイティブオーディオを備えた、テキストから動画と画像から動画に対応します。Standard、Pro、4K の3つの階層があります。

1回あたり$0.42から
Kling 3.0 Motion Control API

Kling 3.0 Motion Control API

Kuaishou の Kling 3.0 Motion Control は、参照動画からモーションを転送して、静止したキャラクター画像をアニメーション化します。キャラクター画像とモーションのクリップ(ダンス、アクション、ジェスチャー)をアップロードすると、モデルが動きを抽出して、滑らかでリアル…

1回あたり$0.63から
Vidu Q4 API

Vidu Q4 API

Shengshu の Vidu Q4 は、画像から動画とリファレンスから動画に対応し、3〜16秒のクリップ、540p〜4Kの出力、オプションの音声生成を備えています。リファレンスから動画では、1回のリクエストで最大12枚の参照画像と最大3本の参照オーディオを使えます。

1回あたり$0.25から
Vidu Q3 API

Vidu Q3 API

Shengshu の Vidu Q3 は、テキストから動画、画像から動画、リファレンスから動画(複数の被写体の一貫性のための1〜4枚の参照画像)、start-end-to-video に対応します。Standard、Pro、Turbo の3つの階層があり、一部のバリアントでは最長16秒の出力が…

1回あたり$0.15から
InfiniteTalk API

InfiniteTalk API

WaveSpeedAI の InfiniteTalk は、1枚の写真とオーディオを、最長10分の、話す、または歌うアバター動画に変換します。Standard と Fast の階層に加え、Multi バリアント(1枚の画像と2つのオーディオ入力による複数キャラクターの出力)と、Video-to-…

1回あたり$0.075から
Wan 2.2 API

Wan 2.2 API

Alibaba の Wan 2.2 は、WaveSpeedAI にデプロイされた、35以上の自社バリアントを持つオープンウェイトの動画ツールキットです。Animate(120秒のキャラクターアニメーション)、Video Edit、Speech-to-Video(10分のオーディオ駆動)、Fun…

1回あたり$0.02から
Sora 2 API

Sora 2 API

OpenAI の Sora 2 は、リアルなビジュアル、正確な物理、同期されたオーディオ、高い操作性を備えた、最先端のテキストから動画と画像から動画です。Standard と Pro の階層に加え、複数の生成にわたって再利用できるキャラクターIDを作る Characters エンドポイントがあ…

1回あたり$0.40から
Kling Omni O3 API

Kling Omni O3 API

Kuaishou の Kling Omni Video O3 は、MVL(Multi-modal Visual Language)技術を備えた、高度な統合型マルチモーダル動画モデルです。Standard、Pro、4K の階層に、テキストから動画、画像から動画、リファレンスから動画、会話形式の …

1回あたり$0.42から
Grok Imagine Video 1.5 API

Grok Imagine Video 1.5 API

XAI の Grok Imagine Video 1.5 は、最大1080pの高速なテキストから動画、画像から動画、最大7枚の参照画像からアイデンティティの一貫性を保つリファレンスから動画に対応し、アスペクト比も選べます。

1回あたり$0.08から
Grok Imagine Video API

Grok Imagine Video API

XAI の Grok Imagine Video は、テキストから動画、画像から動画、リファレンスから動画、video-extend、edit-video に対応し、さらに、1080pのテキストから動画と最大7枚の画像からのリファレンスから動画を備えた高速な v1.5 の生成も提供します。

1回あたり$0.05から
Hailuo 2.3 API

Hailuo 2.3 API

MiniMax の Hailuo 2.3 は、物理を考慮したテキストから動画と画像から動画で、2.5倍の効率向上と、複雑な指示への85%の正確さを備えています。768pと1080pの Standard と Pro の階層に加え、クリエイターやマーケター向けに最適化された Fast バリアントが…

1回あたり$0.19から
Wan 2.6 API

Wan 2.6 API

Alibaba の WAN 2.6 は、720p/1080pで同期オーディオ付きのテキストから動画と画像から動画に対応し、同じファミリーにリファレンスから動画、video-extend、image-edit、text-to-image も備えています。速度を最適化した生成のための Flash …

1回あたり$0.03から
Higgsfield API Alternative

Higgsfield API Alternative

Higgsfield API で開発者が探しているモデル(Seedance 2.5 と 2.0、Kling 3.0 と O3、Wan 3.0、オープンウェイトの MiniMax H3、Qwen Image 3.0)に加え、Seedream 5.0、Nano Banana 2 と Pro、GPT…

1回あたり$0.024から

画像11

テキストから画像と画像編集。高速なドラフトから4Kまで。

Nano Banana Pro API

Nano Banana Pro API

Google の Nano Banana Pro(Gemini 3.0 Pro Image)は、スマートフォン向けに最適化された高解像度4Kのテキストから画像生成と画像編集を提供します。生成と編集の両方に、Standard、Ultra(より高解像度)、Multi(複数出力)のバリアントがあります。

1回あたり$0.07から
Nano Banana 2.1 API

Nano Banana 2.1 API

Google の Nano Banana 2.1 は、Nano Banana シリーズ最新の画像生成・編集モデルです。Google によると、従来モデルからあらゆる面で向上しており、特にビジュアルデザインと被写体の一貫性が大きく改善されたほか、プロンプトへの忠実度が高まり、文字描画もよりきれい…

1回あたり$0.036から
Nano Banana 2 API

Nano Banana 2 API

Google の Nano Banana 2(Gemini 3.1 Flash Image)は、Flash の速度で Pro 品質の画像生成を実現します。512pxから4Kの解像度、向上した文字描画、最大5キャラクターの一貫性、実世界の知識の統合に対応しています。

1回あたり$0.036から
GPT Image 2 API

GPT Image 2 API

OpenAI の GPT Image 2 は、自然言語のプロンプトから高品質な画像を作るテキストから画像・編集エンドポイントを提供します。品質階層(low / medium / high)と解像度のスケーリングにより、呼び出しごとにコストと精細さのバランスを選べます。

1回あたり$0.057から
GPT Image 2.5 API

GPT Image 2.5 API

OpenAI の GPT Image 2.5 は、テキストから画像と編集のエンドポイントを、Flare(高速でバランス型)と Sunburst(精度重視)の2つの階層で提供します。lowからmaxまでの5段階の品質、1K / 2K / 4Kの出力、15種類のアスペクト比、最大16枚の参照画像に…

1回あたり$0.024から
Seedream 4.5 API

Seedream 4.5 API

ByteDance の Seedream 4.5 は、タイポグラフィに最適化された次世代のテキストから画像モデルです。よりくっきりした文字描画、より強いプロンプト追従性、ポスターやブランドビジュアル向けの最大4K出力を備えています。

1回あたり$0.04から
Seedream 5 API

Seedream 5 API

ByteDance の Seedream 5 は、1つのAPIで2つの階層を提供します。Pro は ByteDance のデザイン理解に優れたフラッグシップで、データ、コンセプト、密度の高いテキストをプロのレイアウトに変換し、インタラクティブな精密編集(ポイントや投げ縄による選択、スケッチのレ…

1回あたり$0.0243から
Video Watermark Remover API

Video Watermark Remover API

WaveSpeedAI の動画ウォーターマーク除去は、品質を保ちながら、動画から Kling と Seedance のウォーターマーク、ロゴ、字幕、テキストを除去します。多くの形式と、10分のファイルに対応しています。

1回あたり$0.05から
Qwen Image 3.0 API

Qwen Image 3.0 API

Alibaba の Qwen Image 3.0 は、Standard と Pro のテキストから画像と画像編集のエンドポイントで、柔軟なアスペクト比、1K/2Kの出力、自然言語による指示の理解を備えています。

1回あたり$0.03から
Qwen Image API

Qwen Image API

Alibaba の Qwen-Image は、20B MMDiT の次世代テキストから画像・編集ツールキットで、中国語/英語のバイリンガル対応、複数画像の編集、LoRAによるカスタマイズ、レイヤー合成、96ポーズのカメラアングルシステムを備えています。

1回あたり$0.02から
Flux 2 Klein API

Flux 2 Klein API

Black Forest Labs の FLUX.2 [klein] は、リアリズムの向上、よりくっきりした文字生成、高速なカスタマイズのための LoRA 対応を備えた、高品質な4Bと9Bのテキストから画像・編集モデルです。生成と編集の両方に、Base と LoRA のバリアントがあります。

1回あたり$0.008から

ツール02

画像と動画の高画質化とクリーンアップ。

3D01

テキストや画像から3Dアセットを生成。

1つのAPIキーで開発を始めよう

WaveSpeedAIのすべてのモデルが、同じREST API、SDK、請求を共有しています。