37 个模型系列 · 358+ 个端点
AI 模型 API
一个 API 密钥,即可使用领先的视频、图片和 3D 模型。选择一个模型,查看它的端点、实时价格和可直接运行的代码。
curl -X POST https://api.wavespeed.ai/api/v3/<model> \
-H "Authorization: Bearer $WAVESPEED_API_KEY" \
-d '{"prompt": "…"}'视频23
文本、图片和参考素材转视频,以及编辑和延长。

FLUX 3 API
Black Forest Labs FLUX 3 API 已在 WaveSpeedAI 上线,提供文生视频、图生视频、首尾帧视频、视频延长、Draft 草稿和视频放大端点。通过一个可用于生产的 API,生成 5 至 20 秒、720P 或 1080P 的视频片段,并可选配同步音频。

MiniMax H3 API
MiniMax H3 API 支持电影感的文生视频、图生视频和参考生视频,具备原生立体声音频、出色的运动质量、主体一致性和场景连贯性。可在 WaveSpeed 基础设施上运行开放权重版本,或通过同一个 WaveSpeedAI API 调用 MiniMax 官方端点。

Seedance 2.5 API
—提供文生视频、图生视频、视频编辑、视频延长和 Turbo 端点。

Seedance 2.0 Mini API
—Seedance 2.0 中更快、成本更低的档位。同样具备电影感多镜头叙事、AI 运镜控制和带原生音频的角色一致性,价格仅为标准版的 50%。

Seedance 2.0 API
—好莱坞级的电影感视频,具备原生音画同步、导演级的镜头与灯光控制,以及出色的运动稳定性。基于 Seed 统一的多模态架构构建。

Seedance 1.5 Pro API
—偏实拍风格的电影感片段,提示词遵循度强、动作表现力丰富、美学风格稳定。时长 4-12 秒并支持智能时长,提供多种画幅比例,可通过种子复现生成结果。

Veo 3.1 API
—文生视频,带 1080p 同步原生音频。提供 Standard、Fast、Lite 三个档位,包含文生视频、图生视频、参考生视频和视频延长,Lite 档位另有首尾帧生视频。

Wan 3.0 API
—单次生成最长可达 30 秒的电影感视频,上限是 Wan 2.7 的两倍。提供文生视频、支持首尾帧引导的图生视频,以及同时接受图像、视频和音频参考的参考生视频。输出 480p / 720p / 1080p,可选生成音频,并支持提示词扩写,以获得更高质量的运动和场景连贯性。

Wan 2.7 API
—连贯的电影感视频,细节清晰、运动稳定、指令遵循能力强。文生视频、图生视频、参考生视频、视频编辑、视频延长均有独立端点,同系列中还有图像编辑和文生图变体。

Happy Horse 1.0 API
—电影感 720p / 1080p 视频,运镜流畅、动作富有表现力、提示词保真度高。包含参考生视频,可在多次生成间保持一致的角色/风格身份。

Kling 3.0 API
—文生视频和图生视频,运动流畅、视觉具电影感、提示词遵循准确,并带原生音频。三个档位:Standard、Pro 和 4K。

Kling 3.0 Motion Control API
—从参考视频迁移动作,让静态角色图像动起来。上传角色图像和动作片段(舞蹈、动作、手势),模型提取动作并生成流畅、逼真的视频。提供 Standard 和 Pro 档位。

Vidu Q4 API
—图生视频和参考生视频,时长 3-16 秒,输出 540p 至 4K,可选生成音频。参考生视频单次请求最多接受 12 张参考图像和 3 段参考音频。

Vidu Q3 API
—文生视频、图生视频、参考生视频(1-4 张参考图像,保持多主体一致性)和首尾帧生视频。三个档位:Standard、Pro、Turbo。部分变体最长可输出 16 秒。

InfiniteTalk API
—将一张照片加音频转换为说话或唱歌的数字人视频,最长 10 分钟。提供 Standard 和 Fast 档位,以及 Multi 变体(单张图像加两路音频输入,生成多角色输出)和 Video-to-Video 变体(用新音频驱动现有视频)。

Wan 2.2 API
—部署在 WaveSpeedAI 上的开放权重视频工具集,拥有 35 多个官方变体:Animate(120 秒角色动画)、Video Edit、Speech-to-Video(10 分钟音频驱动)、Fun-Control(Apache 2.0 许可),以及多种模型规模(5B、A14B)和分辨率…

Sora 2 API
—业界领先的文生视频和图生视频,视觉写实、物理准确、音频同步,可控性强。提供 Standard 和 Pro 档位,另有 Characters 端点,可创建可跨多次生成复用的角色 ID。

Kling Omni O3 API
—采用 MVL(Multi-modal Visual Language,多模态视觉语言)技术的先进统一多模态视频模型。Standard、Pro 和 4K 档位,提供文生视频、图生视频、参考生视频和对话式视频编辑。

Grok Imagine Video 1.5 API
—快速的文生视频(最高 1080p)、图生视频,以及基于最多七张参考图像的参考生视频,输出身份一致,画幅比例可选。

Grok Imagine Video API
—文生视频、图生视频、参考生视频、视频延长和视频编辑,另有快速的 v1.5 版本,提供 1080p 文生视频和基于最多七张图像的参考生视频。

Hailuo 2.3 API
—物理感知的文生视频和图生视频,效率提升 2.5 倍,复杂指令准确率达 85%。提供 768p 和 1080p 的 Standard 与 Pro 档位,另有为创作者和营销人员优化的 Fast 变体。

Wan 2.6 API
—文生视频和图生视频,720p/1080p 并带同步音频,同系列中还有参考生视频、视频延长、图像编辑和文生图。提供追求速度的 Flash 档位。

Higgsfield API Alternative
—Seedance 2.5 与 2.0、Kling 3.0 与 O3、Wan 3.0、开放权重的 MiniMax H3 和 Qwen Image 3.0——以及 Seedream 5.0、Nano Banana 2 与 Pro、GPT Image 2.5 与 2,全部通过一个 WaveSpee…
图片11
文生图和图像编辑,从快速草稿到 4K。

Nano Banana Pro API
—高分辨率 4K 文生图和图像编辑,并针对手机做了优化。生成和编辑均提供 Standard、Ultra(更高分辨率)和 Multi(多图输出)变体。

Nano Banana 2.1 API
—最新的 Nano Banana 图像生成与编辑模型。据 Google 介绍,它相比此前的模型全面提升,在视觉设计和主体一致性方面进步明显,同时提示词遵循更精准,文字渲染也更干净。

Nano Banana 2 API
—Flash 速度下的 Pro 级图像生成。分辨率从 512px 到 4K,文字渲染更出色,最多可保持 5 个角色的一致性,并融入真实世界知识。

GPT Image 2 API
—根据自然语言提示词生成高质量图像,提供文生图和编辑端点。质量档位(low / medium / high)和分辨率缩放让您每次调用都能在成本与保真度之间取舍。

GPT Image 2.5 API
—提供文生图和编辑端点,分 Flare(快速均衡)与 Sunburst(专注精度)两个档位,有从 low 到 max 的五个质量等级,支持 1K / 2K / 4K 输出、十五种画幅比例,编辑最多可基于 16 张参考图像。请求格式与 GPT Image 2 相同,单张图像价格更低。

Seedream 4.5 API
—针对排版优化的新一代文生图模型。文字渲染更清晰,提示词遵循更强,最高支持 4K 输出,适合海报和品牌视觉。

Seedream 5 API
—一个 API 提供两个档位。Pro 是字节跳动具备设计理解力的旗舰:可将数据、概念和密集文字转换为专业版式,支持交互式精确编辑(点选和套索选择、草图渲染、颜色和材质替换、图层分离、多图融合),渲染真实的光线、材质和皮肤质感,并能处理 10 多种语言的高质量文字。Lite 是成本优化档位,具备…

Video Watermark Remover API
—在保持画质的同时,去除视频中的 Kling 和 Seedance 水印、徽标、字幕和文字。支持多种格式和 10 分钟的文件。

Qwen Image 3.0 API
—提供 Standard 和 Pro 文生图及图像编辑端点,画幅比例灵活,支持 1K/2K 输出,并能理解自然语言指令。

Qwen Image API
—20B MMDiT 新一代文生图和编辑工具集,支持中英双语,具备多图编辑、LoRA 定制、分层合成和 96 种姿态的镜头角度系统。

Flux 2 Klein API
—高质量的 4B 和 9B 文生图及编辑模型,真实感更强、文字生成更清晰,并支持 LoRA 以便快速定制。生成和编辑均提供基础版和 LoRA 变体。
工具02
图片和视频的放大与清理。

Image Upscaler Collection API
—WaveSpeedAI(Standard、Ultimate、Real-ESRGAN)、Clarity AI(Creative、Crystal、Flux、Pro)、Recraft(Creative、Crisp)和 Pruna AI——全部通过一个 WaveSpeedAI API 密钥调用。可按…

Video Upscaler Collection API
—WaveSpeedAI(Standard、Pro、Ultimate、SeedVR2、LTX-2 19B)、ByteDance、Bria 和 Clarity AI——全部通过一个 WaveSpeedAI API 密钥调用。可按目标分辨率(最高 8K)、源视频时长、运动特征和单次调用成本来选择。
3D01
文本和图片生成 3D 资产。
一个 API 密钥,开始构建
WaveSpeedAI 上的每个模型都共用同一套 REST API、SDK 和计费。
