WaveSpeedAI

在 Cline 里用 WaveSpeed MCP Server 生成图像与视频

给 Cline 加上 WaveSpeed MCP server,agent 获得七个工具:实时目录搜索、逐模型 schema 自省、带本地文件上传的生成、以及花钱前的价格报价。

By WaveSpeedAI1 min read

Cline 原生支持 MCP,而 WaveSpeed MCP server(@wavespeed/mcp,MIT)把整个 wavespeed.ai 平台——图像、视频、音频、3D 生成——变成七个类型化工具。

server 与开源的 wavespeed CLI 共享同一套设计:不硬编码模型列表、一个生成动词由实时 schema 驱动、绝不改写输入、诚实报价。

配置

加到 Cline 的 MCP 设置(cline_mcp_settings.json):

{
  "mcpServers": {
    "wavespeed": {
      "command": "npx",
      "args": ["-y", "@wavespeed/mcp"],
      "env": { "WAVESPEED_API_KEY": "wsk_..." }
    }
  }
}

密钥在 wavespeed.ai/accesskey 获取。如果你已在用 CLI,wavespeed login 的登录态对 server 同样有效,env 可省略。

agent 怎么用它

预期的循环是先读后写:

  1. list_models——按文本或模态搜索实时目录(text-to-imageimage-to-video……)
  2. get_model_schema——模型的真实输入 schema:必填项、属性、默认值
  3. run_model——按 schema 执行;返回输出 URL 和 prediction id

本地文件在 input 里写成 "@./path" 字符串——server 上传并替换成托管 URL。裸路径原样透传、在模型校验处失败,这是有意设计:一个只是长得像文件名的值绝不应该离开你的机器。

{
  "model": "bytedance/seedream-v5.0-pro/edit",
  "input": {
    "prompt": "replace the background with a sunlit kitchen",
    "images": ["@./input.jpg"]
  }
}

花费控制

get_price 接受与 run_model 相同的 input,报价不扣费。两个披露字段值得注意:

  • unpriced_inputs——报价没看到的计费公式变量(如音频时长)
  • at_base_price——为 true 时说明报价已坍缩到模型下限,不代表典型一次运行

get_balance 查看余额。实际扣费金额以运行为准。

长任务

run_modelwait_seconds 上限(默认 600)。生成超时后任务在服务端继续——报错给出 prediction id,之后用 get_prediction 接着取。wait_seconds: 0 则只提交不等待。

相关链接

分享