#announcement
422 articles - Page 13
WaveSpeedAI InfiniteTalk Fast Multi がWaveSpeedAIに登場
InfiniteTalk fast multiは、1つの画像と2つのオーディオ入力を複数キャラクターのトーキングまたはシンギングビデオに変換します。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
WaveSpeedAI HunyuanVideo FoleyがWaveSpeedAIに登場
HunyuanVideo-Foleyは、アップロードされたビデオから、目的の音を説明するテキストプロンプトを使用して、リアルなフォーリーと環境音を生成します。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。
ThinkSoundがWaveSpeedAIに登場
ThinkSoundは、アップロードされたビデオをテキストガイドのリアルなオーディオに変換します。ビデオをアップロードしてテキストプロンプトを追加して、リアルなサウンドを生成できます。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。
WaveSpeedAI Video OutpainterがWaveSpeedAIに登場
WaveSpeedAI Video Outpainterは、モーション、アイデンティティ、シーンの一貫性を保ちながら、任意のビデオを元の境界を超えて拡張します。アスペクト比の変更、リフレーミング、安全マージンの追加、またはコンテンツを切り取ったり失うことなく新しい視覚的コンテキストを生成するのに最適です。
WaveSpeedAI WAN 2.2 ビデオ編集がWaveSpeedAIに登場
Wan 2.2 Video Editは、テキストプロンプトでビデオを編集できます(例:衣装やキャラクターを変更)。Wan 2.2を搭載し、480p(5秒あたり$0.20)と720p(5秒あたり$0.40)に対応、最大120秒まで対応。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
MiniMax Speech 02 HDがWaveSpeedAIに登場
MiniMax Speech 02 HDはMinimaxの高定義テキスト音声モデルで、クリアなHD音声を提供します。料金は1,000文字あたり$0.05。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
WaveSpeedAI WAN 2.2 I2V 480p ウルトラファストがWaveSpeedAIに登場
Wan 2.2 A14B Image-to-Video (i2v-480p) は単一画像からウルトラファストな480p動画を生成し、高スループットで無制限のAI動画生成を実現します。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。
WaveSpeedAI WAN 2.2 I2V 5b 720p がWaveSpeedAIに登場
Wan 2.2 I2V 5Bは、5Bのimage-to-videoモデルを使用して画像を高品質の720Pビデオに変換します。AI動画生成に対応した本番対応のREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
WaveSpeedAI WAN 2.2 T2V 480pをWaveSpeedAIで利用可能に
Wan 2.2 t2v-480pはテキストプロンプトから480p解像度の無制限のAIビデオを生成します。迅速なプロトタイピングとコンテンツ制作に最適です。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
WaveSpeedAI WAN 2.2 T2V 720p Ultra Fast がWaveSpeedAIに登場
WAN 2.2 T2V 720p Ultra-Fastは、テキストプロンプトから無制限の出力と超高速スループットで高品質の720p動画を生成します。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
WaveSpeedAI Jib Mix Qwen Image テキスト画像生成がWaveSpeedAIで利用可能に
Jib Mix Qwenは次世代のテキスト画像生成モデルで、自然で美しい顔の生成とアジア系顔のレンダリング向上に最適化されています。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
WaveSpeedAI Qwen Image EditがWaveSpeedAIで利用可能に
Qwen-Image-Editは20B MMDiTイメージ・ツー・イメージモデルで、スタイルを保ちながら正確なバイリンガル(中国語と英語)テキスト編集を提供します。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。