在 Cline 里用 WaveSpeed MCP Server 生成图像与视频
给 Cline 加上 WaveSpeed MCP server,agent 获得七个工具:实时目录搜索、逐模型 schema 自省、带本地文件上传的生成、以及花钱前的价格报价。
By WaveSpeedAI1 min read
Cline 原生支持 MCP,而 WaveSpeed MCP server(@wavespeed/mcp,MIT)把整个 wavespeed.ai 平台——图像、视频、音频、3D 生成——变成七个类型化工具。
server 与开源的 wavespeed CLI 共享同一套设计:不硬编码模型列表、一个生成动词由实时 schema 驱动、绝不改写输入、诚实报价。
配置
加到 Cline 的 MCP 设置(cline_mcp_settings.json):
{
"mcpServers": {
"wavespeed": {
"command": "npx",
"args": ["-y", "@wavespeed/mcp"],
"env": { "WAVESPEED_API_KEY": "wsk_..." }
}
}
}
密钥在 wavespeed.ai/accesskey 获取。如果你已在用 CLI,wavespeed login 的登录态对 server 同样有效,env 可省略。
agent 怎么用它
预期的循环是先读后写:
list_models——按文本或模态搜索实时目录(text-to-image、image-to-video……)get_model_schema——模型的真实输入 schema:必填项、属性、默认值run_model——按 schema 执行;返回输出 URL 和 prediction id
本地文件在 input 里写成 "@./path" 字符串——server 上传并替换成托管 URL。裸路径原样透传、在模型校验处失败,这是有意设计:一个只是长得像文件名的值绝不应该离开你的机器。
{
"model": "bytedance/seedream-v5.0-pro/edit",
"input": {
"prompt": "replace the background with a sunlit kitchen",
"images": ["@./input.jpg"]
}
}
花费控制
get_price 接受与 run_model 相同的 input,报价不扣费。两个披露字段值得注意:
unpriced_inputs——报价没看到的计费公式变量(如音频时长)at_base_price——为 true 时说明报价已坍缩到模型下限,不代表典型一次运行
get_balance 查看余额。实际扣费金额以运行为准。
长任务
run_model 有 wait_seconds 上限(默认 600)。生成超时后任务在服务端继续——报错给出 prediction id,之后用 get_prediction 接着取。wait_seconds: 0 则只提交不等待。
相关链接
- Server:WaveSpeedAI/mcp-server · npm
@wavespeed/mcp· MCP registryai.wavespeed/mcp - CLI 姊妹项目:WaveSpeedAI/wavespeed-cli
- 模型目录:wavespeed.ai/models
