Kuaishou Kling V2.6 Create Voice がWaveSpeedAIに登場
Kling 2.6 Create Voiceはカスタムボイスを生成できるモデルです。オーディオファイルをアップロードして、V2.6ビデオ生成のボイスコントロール機能で使用できるカスタムボイスを作成できます。オーディオはクリーン、ノイズフリー、単一音声で、5~30秒の期間である必要があります。安定した製品向けに構築されています
Kuaishou Kling V1.6 マルチ I2V スタンダードが WaveSpeedAI に登場
Kling v1.6 Image-to-Video は Kling 1.5 と比較して 195% の性能向上を実現し、プロンプト理解、物理演算、ビジュアルエフェクトが大幅に改善されました。すぐに使用できる REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。
Kuaishou Kling V2.1 I2V Pro Start End Frame が WaveSpeedAI に登場
Kling v2.1 I2V Pro Start-End Frame は、正確なスタート/エンドフレーム制御、強化されたビジュアル忠実度、動的なカメラモーションを備えた映画的なImage-to-Videoクリップを生成します。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。
KuaishouのKling Video O1 Std Text-to-Videoが WaveSpeedAI に登場
Kling Omni Video O1(Standard)は、MVL(マルチモーダルビジュアル言語)技術を搭載したKuaishouの初の統合マルチモーダルビデオモデルです。Text-to-Videoモードはテキストプロンプトからシネマティックなビデオを生成し、被写体の一貫性、自然な物理シミュレーション、正確な意味理解を実現します。すぐに使用可能です
Lightricks LTX 2 RetakeがWaveSpeedAIに登場
LTX-2 Retakeはビデオの任意のセクションに対して標的化された再撮影を実行し、ビジュアル、オーディオ、またはその両方を置き換えながら、タイミングと連続性を保持します(出力ビデオ1秒あたり$0.1)。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。
WaveSpeedAIに登場 Luma Ray 2 Flash T2V
Luma Ray 2 Flash は、テキストを高品質のビデオに変換します。柔軟なサイズと組み込みのプロンプト最適化により、正確な出力が可能です。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
Luma Ray 2 T2VがWaveSpeedAIに登場
Luma Ray 2はテキストプロンプトから高品質なビデオを生成するText-to-Videoモデルで、高度なプロンプト最適化と様々なビデオサイズのサポートを備えています。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。
MiniMax Hailuo 02 FastがWaveSpeedAIに登場
Hailuo 02 Fastはクリエイターとマーケター向けの高品質な6秒および10秒クリップを512pで生成するMiniMaxの画像からビデオへの変換モデルです。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。
WaveSpeedAI Steady DancerがWaveSpeedAIに登場
SteadyDancer は 14B パラメータの人間画像アニメーションフレームワークで、静止画を一貫性のあるダンス動画に変換します。最初のフレーム保存、堅牢なアイデンティティ一貫性、現実的なモーション生成のための時間的一貫性を備えています。すぐに使用できる REST 推論 API、最高のパフォーマンス、コールドスタートなし
MiniMax Speech 2.5 HD Preview がWaveSpeedAIに登場
MiniMax Speech 2.5 HD Preview は、強化された多言語表現力、正確な音声クローニング、40言語対応を備えた HD TTS を提供します。すぐに使える REST API、最高のパフォーマンス、コールドスタートなし、手頃な価格。
MiniMax Speech 2.6 HDがWaveSpeedAIに登場
MiniMax Speech 2.6 HD:超自然で低レイテンシー(250ms未満)のTTS、音声クローニング、テキスト正規化、40以上の言語対応。使用可能なRESTインference API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。
MiniMax Speech 2.6 TurboがWaveSpeedAIに登場
Minimax Speech 2.6 Turboはテキスト音声合成モデルで、超自然な音声クローニング、業界最高水準のテキスト正規化、250ms以下の低遅延、40以上の言語をサポートしています。料金: 1000文字あたり0.06ドル。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。