#alibaba
190 articles - Page 12
WaveSpeedAI WAN 2.1 V2V 720p LoRA ウルトラファストがWaveSpeedAIで利用可能に
Wan 2.1 V2V 720p LoRA ウルトラファストは、カスタムLoRAサポート付きでビデオを720pに変換し、無制限のAIビデオ生成が可能です。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
WaveSpeedAI WAN 2.1 V2V 480p LoRA ウルトラファーストがWaveSpeedAIに登場
Wan 2.1 V2V 480pは、無制限のAIビデオを生成し、カスタムLoRAによるパーソナライズに対応した超高速ビデオ-ビデオモデルです。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
WaveSpeedAI WAN 2.1 V2V 480p LoRAがWaveSpeedAIに登場
WAN 2.1 V2V 480pLoRAは、カスタムLoRAサポートでテーラーメイドスタイルを実現し、無制限の480p動画-動画編集を生成します。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
MiniMax Voice DesignがWaveSpeedAIに登場
MiniMax Voice Designはテキストの説明から自然な音声を生成します。クローニングは不要で、トーン、アクセント、個性を設定できます。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。
WaveSpeedAIにCharacter AI Ovi Image-to-Videoが登場
OviはVeo-3のようなイメージ・トゥ・ビデオモデルで、テキストまたはテキスト+画像プロンプトから同期されたビデオとオーディオを生成します。すぐに使用できるRESTインファレンスAPI、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。
Alibaba Qwen Image TranslateがWaveSpeedAIに登場
Alibaba Qwen Vision TranslateはOCRベースの画像理解と多言語の画像内テキスト翻訳を提供し、文脈を考慮した結果を実現します。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Kuaishou Kling Text To AudioがWaveSpeedAIに登場
Kling Text-to-Audio は、テキストプロンプトをビデオ、ゲーム、マルチメディア用のカスタム音声効果に変換します。KlingAI のオーディオモデルを使用しており、すぐに使える REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定を提供します。
Kuaishou Kling V2.6 Pro画像からビデオへの変換がWaveSpeedAIで利用可能に
Kling 2.6 Proは、滑らかなモーション、シネマティックなビジュアル、正確なプロンプト準拠、ネイティブオーディオを備えた最高レベルの画像からビデオへの生成を提供します。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。
Google Gemini 2.5 Flash画像編集がWaveSpeedAIに登場
Nano Banana (Gemini 2.5 Flash Image) は画像から画像への生成と深い推論による正確な編集を提供します。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Kuaishou Kling V2.6 Create Voice がWaveSpeedAIに登場
Kling 2.6 Create Voiceはカスタムボイスを生成できるモデルです。オーディオファイルをアップロードして、V2.6ビデオ生成のボイスコントロール機能で使用できるカスタムボイスを作成できます。オーディオはクリーン、ノイズフリー、単一音声で、5~30秒の期間である必要があります。安定した製品向けに構築されています
Lightricks LTX 2 RetakeがWaveSpeedAIに登場
LTX-2 Retakeはビデオの任意のセクションに対して標的化された再撮影を実行し、ビジュアル、オーディオ、またはその両方を置き換えながら、タイミングと連続性を保持します(出力ビデオ1秒あたり$0.1)。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。
WaveSpeedAIでBria Video Eraser Maskの提供開始
Bria Video Eraser (Mask)はユーザーが提供したマスクビデオを使用して、ビデオから不要なオブジェクトを削除します。フレームごとに領域をマーク(黒/白またはアルファ)し、モデルがAIビデオインペイティングを実行して、人物、ロゴ、テキスト、小道具などの時間的に一貫した背景を再構成します。すぐに使用できるREST