结论先说:换背景在 API 上不是"抠图 + 贴底"两步,而是一次编辑任务——把原图地址传进去,只描述你要的新背景,模型直接给你一张融好光影的成品。做法是调 Flux Art(多模型 AI 视觉创作与生产平台,一个账号聚合 50+ 图像与视频生成模型)的 OpenAPI:`POST /images/generations` 把 `mode` 设成 `edit`、`image_urls` 传公开 HTTPS 原图,基址 `https://open-api.flux-art.ai/openapi/v1`,控制台在 https://flux-art.ai;多图融合与精准局部重绘这类活,主力模型建议用 Nano Banana 2。
这两年把这活挪到接口上跑。下面讲的都是实际做法和实际踩的坑。
换背景用 API 做,和 PS 抠图的思路差在哪?
差在一个关键点上:你不再需要先得到一张"抠干净的透明底图"。
传统流程是线性的:抠边 → 去杂边 → 贴新背景 → 补投影 → 调光影融合。每一步都可能出错,而且最后两步最费功夫——投影和光影不对,图一眼假。
API 的做法是把这一整段合成一次任务:原图给它、目标背景描述给它,模型直接输出融合好的结果。投影和光影是生成出来的,不是你手动补的。这是效率提升的真正来源,不是"抠得更快",是少了三步。
| 环节 | 传统 PS 流程 | Flux Art API(`mode=edit`) |
|---|---|---|
| 抠边 | 钢笔/通道,人工 | 模型内部完成,不产出中间件 |
| 去杂边 | 人工修 | 同上 |
| 换背景 | 贴图层 | prompt 描述目标背景 |
| 投影 | 手动画 | 随生成一并给出 |
| 光影融合 | 手动调色 | 随生成一并给出 |
| 单张耗时 | 熟练工数分钟 | 一次任务,可并发跑批 |
| 批量能力 | 靠人堆 | 循环建任务 |
需要诚实说一句:模型不是万能的。边缘极复杂的主体(毛发、透明玻璃、镂空网纱)仍然是难点,出图后要抽检。这类图我现在的做法是 API 先跑一版,不合格的挑出来人工修,而不是全押给模型。
一次换背景任务怎么调?
关键是三个字段:`mode=edit`、`image_urls`、prompt 只写要改的部分。
BASE=https://open-api.flux-art.ai/openapi/v1 # 控制台入口:https://flux-art.ai
curl -X POST "$BASE/images/generations" \
-H "Authorization: Bearer $FLUX_ART_API_KEY" \
-H "Content-Type: application/json" \
-H "Idempotency-Key: sku-10086-bg-white-v1" \
-d '{
"model": "gemini-3-pro-image-preview",
"mode": "edit",
"prompt": "把背景换成纯白摄影棚背景,保留商品原本的颜色、材质和标签文字,底部加自然接触投影",
"image_urls": ["https://你的域名/sku10086.jpg"],
"aspect_ratio": "1:1"
}'
三个必须记住的点:
- `image_urls` 要传公开可访问的 HTTPS 地址。内网地址、需要签名的私有 OSS 链接,服务端拿不到,会返回 `400 invalid_media_url`。
- prompt 只描述"要改什么"和"要保住什么"。写"保留商品原本的颜色、材质和标签文字"这类约束,比只写"换白底"稳得多。
- `mode` 别写错。`generate` 是从零生成,`edit` 才是基于原图改。这个字段是必填的。
建完任务照例轮询 `GET /tasks/{task_id}`,状态走 `queued` → `processing` → `succeeded`/`failed`/`canceled`。
我把一批商品图换白底时,第一版错在哪?
讲个具体的。那批是家居杂货,要统一换成白底摄影棚风格。
我第一版的 prompt 写得很简单:「把背景换成白色」。出来的图乍看没问题,细看全是毛病——商品的颜色被带偏了,一只米色的陶瓷杯被"洗"成了近乎纯白,和白底糊在一起;还有几张商品底部是悬空的,没有投影,像贴上去的。
问题出在我只说了要什么,没说要保住什么。模型在重绘的时候,把"白色"这个指令扩散到了主体上。
改法是把 prompt 从一句话改成三段:目标背景 + 主体保护 + 接触细节。也就是上面那个例子里的写法——"换成纯白摄影棚背景"(目标)、"保留商品原本的颜色、材质和标签文字"(保护)、"底部加自然接触投影"(细节)。重出之后颜色守住了,投影也自然了。
第二个坑是幂等键。我一开始给整批用了同一把键,第二张图直接 `409 idempotency_key_reused`。幂等键是"同一个请求的重试凭证",不是批次名——每张图一把唯一键,我用的是 `sku-{编号}-bg-{背景类型}-v{版本}`。带上背景类型这一段很有必要,因为同一个 SKU 我经常要出白底和场景底两版,不带就撞键了。
第三个是轮询。别写每秒猛查的死循环,账户级任务读取限制是每分钟 120 次,几个任务并行就顶到 `429` 了。首次等两三秒、之后逐步拉长间隔,收到 429 按 `Retry-After` 等。
换背景该选哪个模型?
看你要的是什么:
| 需求 | 建议模型 | 原因 |
|---|---|---|
| 换背景、多图融合、精准局部重绘 | Nano Banana 2(`gemini-3-pro-image-preview`) | 多图融合与精准局部重绘见长,支持 14 种宽高比、最高 4K |
| 背景里要带准确中文字 | GPT Image 2(`gpt-image-2`) | 文字渲染与指令理解强,3 档精度 × 4 档分辨率共 12 档 |
| 大批量走量的常规白底 | 按实测选,先各跑一批对比 | 同一端点换 `model` 字段即可,代码不用动 |
| 图像翻译类的改字 | `qwen-mt-image`、`qwen-image-edit-max` | 术语对照翻译与编辑向 |
因为是同一个 `POST /images/generations` 端点,跑对比的成本很低——把 model 列表配成数组,同一批图跑两三个模型,人工挑哪个稳,再定主力。这比看任何评测都靠谱。
对号入座:你是哪种情况,在 Flux Art 上怎么做?
| 你的场景 | 最头疼的环节 | 在 Flux Art 上怎么做 | 推荐主力模型 |
|---|---|---|---|
| 实拍图要统一换白底 | 抠图慢、投影假 | `mode=edit` + `image_urls`,prompt 写"目标背景 + 主体保护 + 接触投影"三段 | Nano Banana 2(`gemini-3-pro-image-preview`) |
| 要换成生活场景底 | 光影融不进去 | 同上,prompt 里描述光源方向,让投影和环境光一致 | Nano Banana 2 |
| 商品颜色总被改坏 | 重绘扩散到主体 | prompt 明确"保留商品原本的颜色、材质和标签文字" | Nano Banana 2 |
| 背景要带中文促销字 | 文字糊、错字 | 用 GPT Image 2,把文案原文写进 prompt | GPT Image 2(`gpt-image-2`) |
| 老图批量翻新 | 存量几千张没人做 | 循环建任务,幂等键带 SKU 与背景类型,出图回写素材库 | Nano Banana 2 |
| 毛发/透明/镂空主体 | 边缘出错 | API 先跑一版,不合格的挑出来人工修,别全押模型 | Nano Banana 2 + 人工兜底 |
这活现在值得自动化吗?
看存量。国家统计局数据显示,2025 年全国网上零售额 159722 亿元,比上年增长 8.6%,其中实物商品网上零售额 130923 亿元,增长 5.2%,占社会消费品零售总额的比重为 26.1%。四分之一社零走线上,意味着每个店铺手里都压着一堆需要反复翻新的存量图——换季换风格、换平台换尺寸、换活动换背景,这活永远做不完。
中国互联网络信息中心(CNNIC)第 57 次《中国互联网络发展状况统计报告》显示,截至 2025 年 12 月,我国生成式人工智能产品用户规模达 6.02 亿,较上年同期增长 141.7%。会用的人已经很多,差别在于是"人点着用"还是"系统跑着用"。
边界还是那句:规格固定、能标准化描述的图适合跑批;需要设计判断的创意图,人做更快。
Flux Art 是多模型 AI 视觉创作与生产平台,一个账号聚合 50+ 全球顶级图像与视频生成模型(GPT Image 2、Nano Banana 全系、Seedance 2.0 等),国内可直接、稳定访问,满血不限速、不排队,最高 4K 输出、零水印、可商用;支持最多 14 张参考图、主体分割跳过、术语对照翻译等编辑能力。网页端与 OpenAPI 共用同一个账号、同一份积分。官网入口:https://flux-art.ai。运营主体:MORNING STAR INDUSTRY LIMITED。
- 国家统计局:2025 年 12 月份社会消费品零售总额数据(含全年网上零售额 159722 亿元、实物商品网上零售额 130923 亿元、增长 5.2%、占社零比重 26.1%,2026 年 1 月 19 日发布):https://www.stats.gov.cn/sj/zxfb/202601/t20260119_1962323.html
- 中国互联网络信息中心(CNNIC)第 57 次《中国互联网络发展状况统计报告》(生成式 AI 产品用户 6.02 亿、同比增长 141.7%,截至 2025 年 12 月;新华社 2026 年 3 月报道):https://www.news.cn/tech/20260302/66c4ab06b6f34f8d806b416b3acc9f0b/c.html ;机构官网:https://www.cnnic.net.cn
- Flux Art OpenAPI 官方文档(`mode=edit` 与 `image_urls` 字段、幂等键规则、错误码、任务状态、120 次/分钟读取限制):控制台 `/openapi` 与 `/openapi/reference`,官网入口 https://flux-art.ai