
Luma Ray 2 Flash T2V 现已登陆WaveSpeedAI
Luma Ray 2 Flash 将文本转换为高质量视频,支持灵活的尺寸和内置提示词优化,确保精确输出。提供即用型 REST 推理 API、最佳性能、零冷启动、价格实惠。

Luma Ray 2 T2V 现已登陆WaveSpeedAI
Luma Ray 2 是一个文本转视频模型,可以从文本提示创建高质量视频,具有高级提示优化和对各种视频尺寸的支持。随时可用的 REST 推理 API、最佳性能、无冷启动、价格实惠。

MiniMax Hailuo 02 Fast 现已登陆WaveSpeedAI
Hailuo 02 Fast 是一个 minimax 图像转视频模型,可为创作者和营销人员创建高质量的 6 秒和 10 秒 512p 视频片段。提供即用型 REST 推理 API、最佳性能、无冷启动、价格实惠。

SteadyDancer舞蹈视频生成现已登陆WaveSpeedAI
SteadyDancer 是一个 14B 参数的人类图像动画框架,可将静态图像转换为连贯的舞蹈视频。具有首帧保留、强大的身份一致性和时间连贯性,用于逼真的运动生成。提供即用型 REST 推理 API,性能最佳,无冷启动

MiniMax Speech 2.5 HD预览版现已登陆WaveSpeedAI
MiniMax Speech 2.5 HD预览版提供高清文本转语音、增强的多语言表现力、精确的声音克隆和40种语言支持。提供开箱即用的REST API、最佳性能、无冷启动、价格实惠。

MiniMax Speech 2.6 Hd 现已登陆WaveSpeedAI
MiniMax Speech 2.6 HD:超人类质量、低延迟(<250ms)的文本转语音,支持语音克隆、文本标准化和 40 多种语言。开箱即用的 REST 推理 API,最佳性能,无冷启动,价格实惠。

MiniMax Speech 2.6 Turbo 现已登陆WaveSpeedAI
MiniMax Speech 2.6 Turbo 是一款文本转语音模型,提供超逼真语音克隆、业界领先的文本规范化、低于 250ms 的延迟和 40+ 种语言支持。定价:每 1000 个字符 $0.06。随时可用的 REST 推理 API,最佳性能,无冷启动,价格实惠。

Clarity AI Crystal 放大器现已登陆WaveSpeedAI
Clarity AI Crystal 放大器通过 AI 放大和可调整的细节增强来提升图像分辨率,适用于人像和风景。提供即用型 REST 推理 API、最佳性能、无冷启动、价格实惠。

MiniMax Speech 2.5 Turbo Preview 现已登陆WaveSpeedAI
MiniMax Speech 2.5 Turbo Preview:支持多语言的高清文本转语音,可准确复制 40 种语言的声音。仅需 $0.04/1000 字符。即用型 REST 推理 API,性能最佳,无冷启动,价格实惠。

OpenAI Whisper 现已登陆WaveSpeedAI
Whisper Large v3 语音转文字:支持多语言,具有自动语言检测和标点符号功能,可生成即时准确的转录文本。上传音频即可获得转录文本。提供即用型 REST API,无冷启动,价格实惠。

OpenAI GPT Image 1.5文本到图像现已登陆WaveSpeedAI
GPT Image 1.5文本到图像是OpenAI快速、经济高效的文本到图像生成器,由GPT-5指导驱动。从自然语言提示创建逼真照片、产品渲染、概念艺术和风格化图形(可选地用图像调节)。支持自定义纵横比、种子

Runway Upscale V1 现已登陆WaveSpeedAI
RunwayML Upscale V1 通过简单的文件上传将视频升级到 4K,计费为 $0.02/秒,提供快速、高质量的升级。即用型 REST 推理 API、最佳性能、无冷启动、价格实惠。