WaveSpeedAI

Joyai Image Edit 现已登陆WaveSpeedAI

JoyAI Image Edit 根据文字指令对图像进行转换,让您能够修改背景、调整颜色、添加或删除元素等。开箱即用

By WaveSpeedAI2 min read
Wavespeed Ai Joyai Image Edit
Wavespeed Ai Joyai Image EditJoyAI Image Edit 根据文字指令对图像进行转换,让您能够修改背景、调整颜色、添加或删除元素等。开箱即用...
Try it
Joyai Image Edit 现已登陆WaveSpeedAI

JoyAI Image Edit:在WaveSpeedAI上用自然语言指令变换任意照片

JoyAI Image Edit 是一款强大的AI图像编辑模型,让你能够通过纯文本指令变换任意照片。由JD Open Source构建,这款指令引导式编辑模型远不止于基础滤镜和调整——它能够重塑整个场景、应用艺术风格、改变环境、添加奇幻元素,同时保留原始图像的核心结构和构图。现已在 WaveSpeedAI 上线,提供即时推理、无冷启动延迟,以及简单的按需计费定价。

在AI图像编辑工具快速演进的当下,JoyAI Image Edit凭借其深度空间理解能力和想象力驱动的处理方式脱颖而出。你无需使用蒙版、画笔或复杂的选区工具,只需描述你想要的变换效果——模型即可实现。

JoyAI Image Edit 的工作原理

JoyAI Image Edit的核心结合了两套强大的AI系统:一套基于Qwen3VL、参数量达80亿的多模态大语言模型(MLLM),用于理解文本和图像;以及一套参数量达160亿的多模态扩散Transformer(MMDiT),用于生成编辑后的输出。正是这种双模型架构赋予了JoyAI Image Edit理解复杂指令并精准执行的卓越能力。

编辑流程通过开发者所称的”闭环协作”运作,涵盖理解、生成与编辑三个环节。当你提交一张图像并附上”将这个公园变成一片神奇森林,里面有发光的蘑菇和萤火虫”这样的指令时,MLLM首先解析场景——识别物体、空间关系以及整体构图,然后将你的指令分解为可执行的编辑步骤。MMDiT随后接管,生成变换效果,在尊重原始图像结构的同时将你的创意变为现实。

JoyAI Image Edit 有别于传统编辑工具的核心优势:

  • 无需蒙版或选区 — 用自然语言描述变化即可
  • 空间感知 — 模型理解深度、物体关系和场景几何结构
  • 结构保留 — 维持原始构图、主体位置和布局
  • 想象力驱动的输出 — 产出丰富、细致的变换效果,而非仅仅表层调整

模型接受两项输入:你的源图像(通过URL或文件上传)以及描述目标变换效果的文本提示。提示越详细,输出结果就越丰富、越精细。

JoyAI Image Edit 核心功能

  • 空间感知编辑 — JoyAI Image Edit擅长理解图像中各元素的位置关系。它能够移动物体、旋转视角,并以精准度执行特定位置的编辑,这是大多数基于文本的编辑器难以企及的。

  • 艺术风格迁移 — 将任意照片重新想象为水彩画、油画、霓虹赛博朋克、吉卜力工作室风格、像素艺术,或任何你能描述的艺术风格。模型从整体上应用风格,同时保持主体的可识别性。

  • 环境变换 — 切换季节、改变天气、调整时间段,或将场景传送至完全不同的环境。只需一个提示,即可将夏日花园变成白雪皑皑的冬日仙境。

  • 内置提示增强器 — 不确定如何描述你的想法?集成的提示增强器会自动将简单指令扩展为丰富详细的提示,从而产出更生动的效果。

  • 多语言文字渲染 — 借助MLLM主干网络,JoyAI Image Edit能够处理文字密集型场景,包括多语言排版、标识变更和文字叠加,在扩散类模型中具有异乎寻常的准确性。

  • 物体操控 — 在场景中添加、移除、替换或修改单个元素。改变狗的品种、给人像添加帽子,或移除分散注意力的背景元素——一切皆通过文字实现。

JoyAI Image Edit 最佳使用场景

大规模社交媒体内容创作

内容创作者可以将单张产品照片或品牌图像变换为数十种不同变体——每种都有不同的情绪、季节或艺术处理。无需安排多次拍摄,只需使用JoyAI Image Edit从一张原始图像生成夏日海滩版本、秋季变体和节日主题版本。

概念艺术与视觉开发

游戏设计师、电影制作人和创意总监可以通过拍摄参考照片并将其变换为概念艺术,快速探索视觉方向。上传一张城市街道照片,提示JoyAI Image Edit将其渲染为后启示录废土、赛博朋克都市或古代中世纪村庄——在几秒内完成视觉创意的迭代,而非数小时。

电商产品可视化

在线零售商可以将产品置于不同环境中展示,无需重新拍摄。将产品照片的背景从普通工作室背景变换为温馨的客厅、户外露台或时尚的现代办公室。这对于家具、家居装饰和生活方式品牌尤为有价值,因为在这些领域,场景情境直接影响购买决策。

房地产与室内设计

房产经纪人和室内设计师可以向客户展示空间在不同处理方案下的呈现效果。将一个空房间变换为装修完整的居住空间、改变墙壁颜色、更换地板材料,或展示空间在不同季节的面貌——一切都来自对该物业的单张照片。

创意项目的奇幻世界构建

作者、桌游设计师和世界构建者可以将现实世界的参考照片转化为奇幻场景。将一条森林小径变换为拥有生物发光植物的魔法树林,或将城堡遗址变为完全修复的魔法堡垒,配有悬浮塔楼和神秘符文。

品牌形象与营销活动

营销团队可以通过编辑现有素材快速制作活动视觉原型。测试产品在不同配色方案、季节主题或文化背景下的呈现效果,无需为每个变体都动用设计团队。这将创意审核周期从数天缩短至数分钟。

教育与培训材料

教育工作者可以通过将普通照片转化为说明性示例来创作引人入胜的视觉辅助材料。将现代城市景观变换为历史场景重现、通过变换实验室照片来可视化科学概念,或为培训材料创建前后对比场景。

JoyAI Image Edit 在WaveSpeedAI上的定价与API访问

JoyAI Image Edit在WaveSpeedAI上的定价为 每张图像$0.30 — 定价透明直接,无隐藏费用、无订阅要求、无最低消费。

功能详情
价格每张图像$0.30
输入图像(URL或上传)+ 文本提示
输出变换后的图像
冷启动无 — 即时推理
API类型REST API

与FLUX.1 Kontext [pro]基础编辑$0.04/张或Adobe Firefly订阅模式等高端替代方案相比,JoyAI Image Edit的定价体现了其更强大的想象力驱动变换能力,远超简单编辑的范畴。

使用WaveSpeed Python SDK快速上手

import json
import os
import time
from urllib.request import Request, urlopen

api_key = os.environ["WAVESPEED_API_KEY"]
headers = {"Authorization": f"Bearer {api_key}", "Content-Type": "application/json"}
payload = {
    "prompt": "A cinematic ocean wave at sunrise, highly detailed",
    "image": "https://interactive-examples.mdn.mozilla.net/media/cc0-images/painted-hand-298-332.jpg"
}

def request_json(url, data=None):
    request = Request(url, data=data, headers=headers, method="POST" if data else "GET")
    with urlopen(request) as response:
        return json.load(response)

# 1. Submit the prediction.
submit_body = request_json("https://api.wavespeed.ai/api/v3/wavespeed-ai/joyai-image/edit", json.dumps(payload).encode())
task = submit_body.get("data", submit_body)
if not task.get("id"):
    raise RuntimeError("Submission response did not contain a prediction id")
result_url = f"https://api.wavespeed.ai/api/v3/predictions/{task['id']}/result"

# 2. Poll until the prediction finishes.
while True:
    body = request_json(result_url)
    result = body.get("data", body)
    status = result.get("status")
    if status == "completed":
        print(result.get("outputs", []))
        break
    if status in {"failed", "cancelled", "timeout", "deleted"}:
        raise RuntimeError(result)
    time.sleep(2)

WaveSpeedAI处理所有基础设施——无需GPU配置、无需下载模型、无需依赖管理。通过一次简单的API调用,即可即时访问JoyAI Image Edit的全部功能。

如果你正在探索其他图像编辑模型,WaveSpeedAI还提供 Qwen Image EditFireRed Image EditGoogle Gemini Image Edit — 你可以对比结果,为你的特定工作流选择最佳模型。

使用JoyAI Image Edit获得最佳效果的技巧

  1. 描述要具体,而非模糊。 与其说”让它看起来更好”,不如尝试”添加温暖的黄金时段光线,加深阴影,并让天空呈现从深橙到紫色的渐变。“具体性是影响输出质量的最重要因素。

  2. 描述氛围,而非仅仅描述物体。 在提示中加入气氛和情感——“诡异”、“奇幻”、“宁静”、“戏剧性”——为模型提供关键背景,从而塑造整体变换效果。

  3. 用提示增强器快速实现创意。 如果你有粗略的概念但不确定如何表达,从一个简单的提示开始,让内置的提示增强器将其扩展为更详细、更生动的内容。

  4. 明确指定哪些部分应保持不变。 如果你希望主体不变但背景完全改变,请明确说明。例如:“保持人物完全不变,但将背景替换为日落时分的热带海滩。”

  5. 通过渐进式编辑进行迭代。 从大范围变换开始,然后通过后续编辑进行细化。这种方法通常比在单个复杂提示中描述所有内容产生更好的效果。

  6. 提供高质量的源图像。 模型会保留输入的结构和细节——更高分辨率的原始图像为JoyAI Image Edit提供更多可处理的信息,从而产出更清晰、更细致的输出。

关于JoyAI Image Edit的常见问题

JoyAI Image Edit是什么?

JoyAI Image Edit是由JD Open Source开发的指令引导式AI图像编辑模型,能够根据自然语言文本提示变换照片,将80亿参数的多模态语言模型与160亿参数的扩散Transformer相结合,实现具有空间感知能力的想象力驱动编辑。

JoyAI Image Edit在WaveSpeedAI上的费用是多少?

JoyAI Image Edit在WaveSpeedAI上的定价为每张图像$0.30,无订阅费、无最低消费、无冷启动延迟。你只需为生成的图像付费。

我可以通过API使用JoyAI Image Edit吗?

可以。JoyAI Image Edit可通过WaveSpeedAI的REST API和Python SDK访问。你发送一张图像和一个文本提示,即可收到变换后的图像——无需GPU配置或模型托管。

JoyAI Image Edit能执行哪些类型的编辑?

JoyAI Image Edit可处理风格迁移、环境变换、物体添加与移除、色彩调整、光线变化、季节切换、艺术重新构想,以及空间操控(如物体旋转和相机角度变化)。

JoyAI Image Edit与其他AI图像编辑器有何不同?

与简单的修复工具或基于滤镜的工具不同,JoyAI Image Edit采用具有深度空间理解能力的双模型架构。它能够执行复杂的想象力驱动变换——例如将照片变为奇幻场景——同时保持原始图像的构图和结构。大多数基于文本的编辑器只处理表层变化;JoyAI Image Edit则对整张图像进行重新构想。

立即开始使用JoyAI Image Edit编辑图像

准备好用自然语言的力量变换你的图像了吗?在WaveSpeedAI上试用JoyAI Image Edit — 无需配置、无冷启动延迟,按实际使用量付费。上传你的第一张图像,写下提示,亲身感受AI真正理解你的需求时所能实现的可能性。

分享