
图像字幕生成器现已登陆WaveSpeedAI
高精度图像字幕生成器,可从图像生成详细、类似人类的描述。适用于内容理解、无障碍访问、数据集标注、SEO 和多模态 AI 工作流。即用型 REST 推理 API,性能最佳,无冷启动,价格实惠。

WAN 2.1 文本生成图像现已登陆WaveSpeedAI
Wan 2.1 文本生成图像通过将 Wan 2.1 视频模型适配为最先进的视觉保真度,提供超逼真的摄影图像。开箱即用的 REST 推理 API、最佳性能、无冷启动、价格实惠。

MMAudio V2 现已登陆WaveSpeedAI
MMAudio v2 从视频或文本输入生成同步音频,非常适合与视频模型配合为视频添加配乐。提供即用型 REST 推理 API,最佳性能,无冷启动,价格实惠。

Seedvr2视频现已登陆WaveSpeedAI
SeedVR2视频升级器将低分辨率视频转换为高保真4K,具有无缝运动和一致的帧。即用型REST推理API,最佳性能,无冷启动,价格实惠。

视频换脸功能现已登陆WaveSpeedAI
通过上传视频和图像来交换任何视频中的面孔——快速执行无限次、无缝的面部替换。随时可用的REST推理API、最佳性能、无冷启动、价格实惠。

视频升级器现已登陆WaveSpeedAI
AI 视频升级器增强分辨率和清晰度,修复模糊的 Sora 2 输出并通过机器学习升级改善低分辨率素材。即用型 REST 推理 API,最佳性能,无冷启动,价格实惠。

Luma Photon Modify 现已登陆WaveSpeedAI
Luma Photon Modify 是一款文本转图像生成模型,可将文本提示转换为图像,适用于创意与生产工作流程。即用型 REST 推理 API,性能卓越,无冷启动,价格实惠。

FLUX Kontext Max Multi 现已登陆WaveSpeedAI
实验性 FLUX.1 Kontext [max] (multi) 支持多图像上下文处理,可处理组合输入。随时可用的 REST 推理 API、最佳性能、无冷启动、价格实惠。

FLUX Kontext Max文本转图像模型现已登陆WaveSpeedAI
FLUX.1 Kontext [max]是一款文本转图像模型,具有最高性能和显著改进的提示词遵循能力,可实现精确结果。提供即插即用的REST推理API、最佳性能、无冷启动、价格实惠。

字节跳动Seedance V1 Lite I2V 1080p 现已登陆WaveSpeedAI
Seedance Lite可在1080p分辨率下创建连贯的多镜头图像转视频片段,具有平滑稳定的动作和准确的提示词跟随能力。提供即用型REST推理API,性能最佳,无冷启动,价格实惠。

字节跳动Seedance V1 Lite T2V 1080p 现已登陆WaveSpeedAI
Seedance v1 Lite是一个文本转视频模型,可生成连贯的多镜头1080p视频,具有平滑稳定的运动和准确的提示词遵循。即用型REST推理API,性能最佳,无冷启动,价格实惠。

字节跳动Seedance V1 Lite T2V 720p 现已登陆WaveSpeedAI
字节跳动Seedance V1 Lite生成连贯的多镜头720p视频,具有流畅的运动效果和对详细文本提示的精准跟随。开箱即用的REST推理API,最佳性能,无冷启动,价格实惠。