#model-release
317 articles - Page 20

Vidu Image-to-Video Q2 Turbo 现已登陆WaveSpeedAI
Vidu Q2 Turbo Image-to-Video 将单张图像转化为流畅的电影级动态效果,具有快速、高质量的输出。提供随时可用的 REST 推理 API、最佳性能、无冷启动、价格实惠。

Vidu Reference To Video Q2 现已登陆WaveSpeedAI
Vidu Q2 是一款图像转视频和参考转视频模型,强调细微的面部表情和流畅的推拉摄像机运动以实现自然运动。提供即用型 REST 推理 API、最佳性能、无冷启动、价格实惠。

Vidu 万圣节模板现已登陆WaveSpeedAI
Vidu 万圣节模板提供现成的图像和视频模板,用于恐怖宣传和活动邀请,带有覆盖层。开箱即用的 REST 推理 API,最佳性能,无冷启动,价格实惠。

字节跳动 LipSync 音频转视频现已登陆WaveSpeedAI
字节跳动 LipSync 通过生成精确的唇动与输入音频完全同步,将音频转换为逼真的说话视频。提供即用型 REST 推理 API、最佳性能、无冷启动、价格实惠。

字节跳动视频超分现已登陆WaveSpeedAI
字节跳动视频超分利用AI超分辨率技术将视频升级至4K并在安全的云环境中恢复细节。即用型REST推理API、最佳性能、无冷启动、价格实惠。

字节跳动 USO 现已登陆WaveSpeedAI
字节跳动的 USO(统一风格-主题优化)统一了风格驱动和主题驱动的生成,产生一致的输出,融合了艺术风格和主题保真度。即用型 REST 推理 API,最佳性能,无冷启动,价格实惠。

ElevenLabs Eleven V3 现已登陆WaveSpeedAI
ElevenLabs eleven-v3是一个文本转语音模型,可作为托管端点使用;请求成本为每1000个字符0.1美元。即用型REST推理API,最佳性能,无冷启动,价格实惠。

ElevenLabs Flash V2.5 现已登陆WaveSpeedAI
ElevenLabs Flash V2是一个文本转语音模型,使用ElevenLabs Flash V2引擎将文本转换为语音。提供开箱即用的REST推理API、最佳性能、无冷启动、平价定价。

ElevenLabs Flash V2 现已登陆WaveSpeedAI
ElevenLabs Flash V2 是一个文本转语音模型,使用 ElevenLabs Flash V2 引擎将文本转换为语音音频。提供即用型 REST 推理 API、最佳性能、无冷启动、价格实惠。

ElevenLabs Eleven V3 Timing 现已登陆WaveSpeedAI
ElevenLabs Eleven-V3 Timing将文本转换为自然语音,并返回对齐元数据——JSON格式的字符/单词时间戳——用于精确字幕、卡拉OK效果和唇同步。支持voice_id、相似度/稳定性和可选的Speaker Boost。价格为每1000个字符0.10美元。随时可用

ElevenLabs 多语言 V1 现已登陆WaveSpeedAI
ElevenLabs 多语言 V1 提供跨多种语言的自然发音文本转语音。提供开箱即用的 REST 推理 API,最佳性能,无冷启动,价格实惠。

ElevenLabs多语言V2 现已登陆WaveSpeedAI
ElevenLabs多语言V2是一个多语言文本转语音模型;成本为每1000个字符0.1美元。随时可用的REST推理API,最佳性能,无冷启动,价格实惠。