ElevenLabs Eleven V3 TimingがWaveSpeedAIに登場
avatardigital-human

ElevenLabs Eleven V3 TimingがWaveSpeedAIに登場

ElevenLabs Eleven-V3 Timingはテキストを自然な音声に変換し、アライメントメタデータ(JSON形式の文字/単語タイムスタンプ)を返します。正確な字幕、カラオケエフェクト、リップシンクに対応。voice_id、相似度/安定性、オプションのSpeaker Boostをサポート。1,000文字あたり$0.10で価格設定。すぐに使用可能

1 min read
ElevenLabs Multilingual V1がWaveSpeedAIに登場
announcementmodel-release

ElevenLabs Multilingual V1がWaveSpeedAIに登場

ElevenLabs Multilingual V1は、多くの言語にわたって自然な音声の多言語テキスト音声変換を提供します。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。

1 min read
ElevenLabs Multilingual V2がWaveSpeedAIに登場
announcementmodel-release

ElevenLabs Multilingual V2がWaveSpeedAIに登場

ElevenLabsの多言語音声合成モデルMultilingual V2は、1000文字あたり0.1ドルのコストで利用可能。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。

1 min read
利用可能なElevenLabs Turbo V2.5がWaveSpeedAIに登場
announcementmodel-release

利用可能なElevenLabs Turbo V2.5がWaveSpeedAIに登場

ElevenLabs Turbo V2.5はWaveSpeedAI経由で利用可能なテキスト音声変換モデルで、TTSリクエストは1000文字あたり$0.05で課金されます。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。

1 min read
ElevenLabs Turbo V2がWaveSpeedAIに登場
announcementmodel-release

ElevenLabs Turbo V2がWaveSpeedAIに登場

ElevenLabs Turbo V2はWaveSpeedAI経由で利用できるテキスト音声合成モデルで、APIリクエストあたり1000文字につき$0.05で課金されます。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。

1 min read
WaveSpeedAIでGoogle Gemini 2.5 Flash Image Preview Editが登場
text-to-imageimage-generation

WaveSpeedAIでGoogle Gemini 2.5 Flash Image Preview Editが登場

Google Gemini 2.5 Flash Image Previewは、高度なクリエイティブコントロール機能を備えた画像から画像への編集モデルで、正確な画像編集が可能です。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。

1 min read
Google Gemini 2.5 Flash画像編集がWaveSpeedAIに登場
wanalibaba

Google Gemini 2.5 Flash画像編集がWaveSpeedAIに登場

Nano Banana (Gemini 2.5 Flash Image) は画像から画像への生成と深い推論による正確な編集を提供します。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格。

1 min read
Google Gemini 2.5 Flash Image Preview テキストから画像へ WaveSpeedAIで利用可能
text-to-imageimage-generation

Google Gemini 2.5 Flash Image Preview テキストから画像へ WaveSpeedAIで利用可能

Google Gemini 2.5 Flash テキストから画像へは、最先端のテキストから画像への生成とプレビュー付き画像編集を提供します。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。

1 min read
Google Gemini 2.5 Flash Image テキストから画像生成がWaveSpeedAIで利用可能に
text-to-imageimage-generation

Google Gemini 2.5 Flash Image テキストから画像生成がWaveSpeedAIで利用可能に

Google Gemini 2.5 Flash Imageは、高度なテキストから画像への生成と創造的なコントロールを備えた画像編集を提供します。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。

1 min read
Kuaishou Kling LipSync オーディオ・トゥ・ビデオ機能がWaveSpeedAIに登場
klingkuaishou

Kuaishou Kling LipSync オーディオ・トゥ・ビデオ機能がWaveSpeedAIに登場

Kling LipSyncは音声を話す人物のビデオに変換し、入力音声に完全に同期したリアルなリップムーブメントを生成します。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、リーズナブルな価格設定。

2 min read
WaveSpeedAIにKuaishou Kling LipSync Text-to-Videoが登場
klingkuaishou

WaveSpeedAIにKuaishou Kling LipSync Text-to-Videoが登場

KwaivgiによるKling TextToVideoは、入力テキストに正確に同期するリアルな口の動きを持つビデオを作成し、自然な話し言葉のビジュアルを実現します。すぐに使用できるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。

1 min read
WaveSpeedAIで公開開始: Kuaishou Kling V1.6 Multi I2V Pro
klingkuaishou

WaveSpeedAIで公開開始: Kuaishou Kling V1.6 Multi I2V Pro

Kling 1.6 Multi Proは、Kling 1.5比で画像からビデオへの生成を195%向上させ、プロンプト理解、物理演算、ビジュアルを改善しました。すぐに使えるREST推論API、最高のパフォーマンス、コールドスタートなし、手頃な価格設定。

2 min read