InfiniteTalk 快速视频转视频现已登陆WaveSpeedAI
音频驱动的 infinitetalk-fast 将一个视频加上音频转换为逼真的说话或唱歌视频,具有唇形同步。现成可用的 REST 推理 API、最佳性能、无冷启动、价格实惠。
WaveSpeedAI WAN 2.1 Ditto 现已登陆WaveSpeedAI
Wan2.1-DITTO是一款统一的视频转视频模型,用于逼真的风格转移和重演,可复制整个帧中的整体运动和表情。提供即用型REST推理API、最佳性能、无冷启动、价格实惠。
HunyuanVideo Foley 现已登陆WaveSpeedAI
HunyuanVideo-Foley通过上传视频并使用文本提示描述所需声音,生成逼真的Foley和环境音频。提供即用型REST推理API、最佳性能、无冷启动、价格实惠。
WaveSpeedAI InfiniteTalk 视频转视频功能现已登陆WaveSpeedAI
音频驱动的 InfiniteTalk 将一个视频加音频转换为逼真的说话或唱歌视频,具有 480p 或 720p 的唇形同步。开箱即用的 REST 推理 API,最佳性能,无冷启动,价格实惠。
在 WaveSpeedAI 上引入 WaveSpeedAI Think Sound
ThinkSound 将上传的视频转换为逼真的、文本引导的音频。上传视频并添加文本提示以生成逼真的声音。随时可用的 REST 推理 API、最佳性能、无冷启动、价格实惠。
WAN 2.1合成到真实Ditto 现已登陆WaveSpeedAI
WAN 2.1 合成到真实 Ditto 在视频转视频的合成到真实转换中镜像动作和面部表情。即用的 REST 推理 API、最佳性能、无冷启动、实惠定价。
WaveSpeedAI Qwen Image Edit LoRA 现已登陆WaveSpeedAI
Qwen-Image-Edit LoRA (20B) 支持中英文双语图像编辑,具有风格保留和语义与外观编辑功能。提供现成的 REST API、最佳性能、无冷启动、经济实惠的价格。
WaveSpeedAI视频扩展工具现已登陆WaveSpeedAI
WaveSpeedAI视频扩展工具可以扩展任何视频的边界,同时保持运动、身份和场景的连贯性。适合改变宽高比、重新构图、添加安全边距或生成新的视觉内容,无需裁剪或丢失内容。
WaveSpeedAI WAN 2.2 视频编辑功能现已登陆WaveSpeedAI
WAN 2.2 视频编辑让您可以通过文本提示修改视频(例如更改服装或角色)。采用 WAN 2.2 技术,支持 480p($0.20/5秒)和 720p($0.40/5秒),最长可处理 120 秒视频。即用型 REST 推理 API,性能最佳,无冷启动延迟,价格实惠。
WaveSpeedAI FLUX Dev LoRA 现已登陆WaveSpeedAI
FLUX.1 [dev] 端点支持 LoRA,通过预训练的 LoRA 适配器实现快速、高质量的图像生成和简单的个性化。即用型 REST 推理 API,最佳性能,无冷启动,价格实惠。
WaveSpeedAI Jib Mix Qwen Image 文本到图像 LoRA 现已登陆WaveSpeedAI
Jib Mix Qwen LoRA 专门生成更自然、更有吸引力的面孔,特别擅长渲染亚洲面部特征,用于支持 LoRA 的下一代文本到图像生成。即用型 REST 推理 API,性能最佳,无冷启动,价格实惠。
通义万象文本生成图像LoRA 现已登陆WaveSpeedAI
通义万象LoRA是一个20B MMDiT下一代文本生成图像模型,支持LoRA以实现快速定制和精细的图像生成。即用型REST推理API,最佳性能,无冷启动,价格实惠。