我做第一批测试图的时候,就不再把 AI 产品图当成一键魔法了。有一个提示词做出了很好看的背景,瓶子却被改得不完全一样。另一个提示词把标签修好了,情绪又丢了。从那以后,我把 AI 产品图生成器当成一次小型拍摄来跑,而不是当成抽奖机。
下面是我在电商店铺要从真实产品做出图片套装时会用的流程。它看起来有点枯燥,可正是这些枯燥的检查,保住了「图和实物一致」这条底线。生成器负责语境、构图、光线和速度,不能负责发明产品。
生成前我要准备什么
我会从一张愿意拿给顾客看的原图开始。如果原图模糊、偏色、杂乱或有水印,模型就要做太多猜测。很多不好用的电商图,问题都出在这里。
我的检查很直接。
- 画面里只有一个产品,除非本来就是套装图。
- 标签、材质、瓶盖、缝线或纹理清楚。
- 光线够均匀,能看出真实颜色。
- 产品轮廓容易和背景分开。
- 图片至少 1024 x 1024,如果后面要导出 4K,分辨率更高更好。
- 没有水印、别的品牌标志、价签或干扰物。
如果只有手机随手拍的照片,我会先在窗边重拍。一张干净的桌子、一块素色布,再用白纸补光就够了。我不会过度锐化,锐化太强会把材质推得很假。
我从头到尾跑的流程
- 写一句可以反复使用的产品描述。
- 确定商业目标,是平台主图、社交媒体、广告,还是目录图。
- 按文字能力、真实感和额度成本选模型。
- 生成三到五张变体,一次只改一个变量。
- 对照原图检查形状、颜色和文字。
- 按投放位置导出,再把通过的那条提示词保存成模板。
我会把产品描述和背景创意分开写。它通常像这样,一句磨砂玻璃精华瓶、金色泵头、标签准确、和参考图里的产品相同。这一句是固定部分,背景才是变量。
第一步,描述产品,而不是只描述背景
「产品放在大理石上,影棚光」不是完整提示词。它只交代了场景,没有交代要卖的东西。我的提示词有六个部分。
[准确产品描述] + [材质和光泽] + [构图] + [背景或道具] + [光线] + [商业限制]
做图生图测试时,我会这样组织。
使用参考图里同一只磨砂玻璃精华瓶和金色泵头,保持标签准确。瓶子居中放在浅灰色无缝背景上,左上方柔和影棚光,加入轻微倒影,不要额外物体,做电商主图,不要文字叠加。
「和参考图里的产品相同」这句很重要。文生图可以先画一个品类印象,但对真实 SKU 来说,图生图加真实产品图才是更稳的生产路径。
第二步,按任务选模型
在 imgmov 里,我不看噱头,只看失败模式。
| 模型 | 我什么时候用 | 原因 |
|---|---|---|
| GPT Image 2 | 需要包装文字清楚的平台图 | Standard 1K 从 2 额度起,画质和分辨率会按矩阵计价。 |
| Nano-Banana 2 | 生活场景和写实语境 | 每张 5 额度,支持图生图。 |
| Seedream 5.0 Lite | 风格化活动和季节图 | 每张 5 额度,支持图生图。 |
| SDXL Inpainting | 修一张已通过图片的局部 | 每张 3 额度,配合遮罩使用。 |
| Agnes Image 2.1 Flash | 访客调研预览 | 带水印,1K,每天三次预览,不能商用交付。 |
如果标签上的拼写必须保住,我会先试 GPT Image 2。如果重点是材质、情绪或社交故事,Nano-Banana 2 往往更自然。如果一张图整体已经通过,只是局部有问题,SDXL Inpainting 比整张重跑更省额度。
第三步,搭一套上架图
一张主图很难覆盖店铺的全部需求。我会按三个任务来生成。
平台主图
第一张图要在缩略图里就看得懂。产品要大、居中,周围不要有噪音。如果平台要求白底,我会把白底写进提示词约束,而不是导出后再补救。
电商主图,使用参考图里同一只不锈钢水瓶,纯白背景,瓶子居中,瓶底有柔和阴影,不添加文字,不添加其他物体。
细节图
第二张图展示材质。微距可以看清楚缝线、皮革纹路、瓶盖螺纹或表面处理。产品描述那一部分保持不变。
同一款皮革手包的细节特写,展示缝线和五金,浅景深,中性灰背景,自然光,没有文字。
场景图
第三张图让产品进入生活。语境能帮买家想象拥有它之后的样子。
同一只陶瓷马克杯放在浅橡木桌上,旁边有打开的笔记本,左侧柔和晨光,浅景深,安静的工作台,没有额外文字。
做季节活动时,一张图只换一种情绪。节日、夏天、冬天不要塞进同一画面。一个场景,一个情绪,一个目的。
第四步,保护产品准确性
任何图片离开草稿状态前,我会看三件事。
- 形状,尤其是瓶盖、提手、鞋跟、纽扣和弧形包装。
- 颜色,尤其是美妆、食品、服饰和电子产品。
- 文字,尤其是品牌名、成分、容量和法规标识。
如果标签变形,我不会抱着「顾客可能不会看」的心态发布。我会修补局部,用更严格的措辞重跑,或者把未修改的产品原图合成到生成场景前面。最后一种方法少一点魔法,但产品是真的。
平台检查
Shopify
Shopify 给品牌语境留了空间。商品卡常用 1:1,横幅用 3:2 或 16:9,不同 SKU 的调色保持一致。导出前我会先命名文件,比如 sku-hero-01、sku-detail-02 和 sku-lifestyle-03。
Amazon 和严格平台
我会偏向清楚。主图遵守平台规则,道具保持最少,信息图放在生成后的 Figma、Canva 或 Photoshop 里做。需要标注的文字没有必要交给模型。
Feed 用 4:5,轮播用 1:1,Stories 或 Reels 封面用 9:16。第一张负责停下滑动,后面几张可以展示细节、比例和使用方式。
TikTok
短视频里,产品图只是入口。我会做一张 9:16 封面,主体分离强,并给平台原生文字留出空间。照片通过后,再交给 imgmov 的 产品图转视频 AI 流程。
批量制作时的额度控制
额度经不起随机实验,所以我会分三层。
- 测试提示词,先确认构图和光线。
- 生产提示词,用通过后的措辞和需要的分辨率重跑。
- 变体提示词,保留通过后的结构,只改一个变量。
Starter 每月包含 1200 额度,Pro 每月包含 3500 额度。GPT Image 2 按画质和分辨率矩阵计价,Seedream 5.0 Lite 和 Nano-Banana 2 每张 5 额度。批量任务里,我不会在构图通过前消耗高分辨率额度。
我现在会避开的问题
| 问题 | 我改用的做法 |
|---|---|
| 对真实 SKU 只用文生图 | 用真实产品图做图生图。 |
| 一张图要求五种主题 | 拆成多张活动图。 |
| 让 AI 重画标签 | 标签尽量保持不动,必要时后期修。 |
| 第一张好看就直接发布 | 拿三到五张和原图对比。 |
| 同时改掉所有提示词变量 | 背景、角度、道具或情绪,一次只改一个。 |
| 忽略导出尺寸 | 生成前先确定平台尺寸。 |
常见问题
AI 产品图生成器能替代摄影师吗?
它能替代很多重复的背景图和场景图,但不能替代原始产品摄影。你仍然需要一张真实的商品照片。反光包装、复杂材质或品牌campaign,摄影师仍然有价值。
AI 产品图能用在电商平台吗?
要看平台当前规则。很多平台允许增强或语境化图片,但主图通常必须真实代表商品,不能加入误导性内容。保持产品本身忠实,并记录生成方式。
应该用文生图还是图生图?
文生图适合概念、包装方向和情绪探索。SKU 已经存在,输出必须匹配形状、颜色和标签时,用图生图。
每个 SKU 要生成多少张变体?
三到五张通常够了。超过这个数量,多半说明 brief 还没想完。
怎么控制成本?
先用低成本草稿确认构图,再花额度跑最终分辨率。固定产品句保持不变,一次只改一个变量。