#model-release
317 articles - Page 23

AKOOL Video Face SwapがWaveSpeedAIに登場
AKOOL Video Face Swapは単一の画像からビデオ内の顔を置き換え、複数の顔に対応してシームレスで現実的なスワップを実現します。価格はビデオ1秒あたり$0.05から、最小料金は10秒です。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。

Alibaba Qwen3 TTS FlashがWaveSpeedAIで利用可能に
Alibaba Qwen3 TTS Flash:英語と中国語に対応した低遅延テキスト音声変換で、複数の音声オプションを備えリアルタイム対話に最適。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。

ByteDanceのLatentSyncがWaveSpeedAIで利用開始
ByteDanceのLatentSyncはStable DiffusionとTREPAを組み合わせ、高解像度のエンドツーエンドリップシンク機能を提供し、生成ビデオで正確でリアルな口の動きを実現します。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。

WaveSpeedAI Sam 3d BodyがWaveSpeedAIに登場
画像から詳細な3Dヒューマンボディモデルを作成するための高度なSAM 3Dボディ生成モデル。オプションのマスクベースセグメンテーション対応。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。

WaveSpeedAI Sam 3d ObjectsがWaveSpeedAIに登場
高度な SAM 3D オブジェクト生成モデルで、画像からテキストプロンプトとオプションのマスクベースのセグメンテーションを使用して、詳細な 3D オブジェクトモデルを作成します。すぐに使用できる REST 推論 API、最高のパフォーマンス、コールドスタートなし、手頃な価格。

Higgsfield Soulの画像生成機能がWaveSpeedAIで利用可能に
SOULは高度なビジュアル表現に対応したリアルな画像生成エンジンで、Soul IDにより複数のシーン全体でキャラクターの一貫性を保持します。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。

Any LLMがWaveSpeedAIに登場
Any LLMは、テキスト生成、理解、チャットや要約などの多様なNLPタスク向けの多目的大規模言語モデルです。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。

Real ESRGANがWaveSpeedAIに登場
Real-ESRGANは、顔補正オプション付きの高品質画像超解像度化と調整可能なアップスケール係数を提供します。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。

任意のLLM VisionモデルがWaveSpeedAIに登場
OpenRouterが提供するキュレーションされたカタログから任意のビジョン言語モデルを使用して、柔軟なマルチモーダル推論を実現。すぐに使用可能なREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。

PixVerse V5トランジションがWaveSpeedAIに登場
2つの静止画像を5秒または8秒のビデオ(360p、540p、720p、または1080p)へのスムーズなモーフトランジションに変換します。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。

Leonardoai Motion 2.0がWaveSpeedAIに登場
Leonardo Motion 2.0は画像から動画への生成を強化し、前作よりもリアルで詳細な動画を生成します。すぐに使用できるRESTオブザーベーションAPI、最高のパフォーマンス、コールドスタートなし、手頃な価格。

Leonardoai Phoenix 1.0がWaveSpeedAIに登場
Leonardo.AiのPhoenixは、テキストから画像への生成で強力なプロンプト忠実度、読みやすい画像内テキスト、AIによる編集機能を提供します。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。