参考图给图像模型提供了视觉起点,却不会告诉模型哪些细节不可触碰。这个区别很容易被忽略——输出可能保留了产品的整体概念,却改变了比例;可能保留了角色的服装,却丢了脸;可能借用了包装造型,却编造了一个标签。图像看起来依然精致,但对于最初的任务而言,可能已经不可用了。 修正要从生成之前开始。把身份当作一份明确的契约:写下必须存活的细节,为每张参考图分配角色,并分步骤审查结果,而不是简单地问一句“看起来对不对”。 “保持一致性”并不是有用的审查标准。和什么一致?这是首先要回答的问题。 对实体产品而言,身份可能包括轮廓、尺寸、材质、颜色、可见工艺、包装方式,以及部件之间的关系。对反复出现的角色,也许要包含脸型、发型、年龄范围、身体比例、服装,以及一小套可辨识的配饰。品牌主导的图像则可能依赖一套经批准的色调、产品家族、字体处理或构图规则。 把这些细节写下来,放在选择风格或场景之前。然后分成三组: 第一组,核心不可变项。这些是脱离后产品就不再是那个产品、角色就不再是那个角色的属性。比如产品轮廓、角色脸型、品牌主色。任何一次生成都不允许改动。 第二组,可微调但需备案项。允许在合理范围内变化,但变化必须在生成前说明理由,并在审核时重点检查是否越界。例如材质表现、环境光效、局部服装细节。 第三组,完全可变项。比如场景情绪、镜头角度、背景元素。这些可以自由发挥,不影响身份存续。 把模糊的创作偏好变成可检查的清单,审查者就能逐项核对,而不是凭感觉判断。 多张参考图只有在各自提供不同指令时才有用。五张没有标注的图片可能产生五个互相竞争的“中心”。而一份清晰的简报会为每张源图分配一个角色:一张定义主体身份,一张提供构图,一张贡献材质或色调,还有一张环境参考负责引导场景,但不能悄悄替换主体。 你可以把分配写成一段结构化的文本: reference_1: role: 主体身份 preserve: 轮廓, 比例, 材质, 主色 reference_2: role: 构图 borrow: 景深与角度 reference_3: role: 材质与色调 focus: 表面质感, 光感 reference_4: role: 环境背景 limit: 仅提供氛围, 禁止改变主体 生成之后,不要从头到尾反复扫视。先只检查核心不可变项:轮廓对吗?比例对吗?主色对吗?如果这些错了,直接报废,不必看其他。然后检查第二组,确认备案项没有越界。最后才评估第三组的创意表现。这样分道走,才能避免“整体看起来不错”掩盖了关键身份的丢失。 真正有用的身份契约,不是一句“保持一致”,而是具体到可勾选的条目、可分配的角色、可复查的次序。把这一点做到,AI生成的图像才能从“好看但没用”变成“好看且可用”。
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.