视觉案例转化
让参考帮助当前画面解决具体问题。先问自己“这张图让人看懂什么、实际哪里难”,再选择能解决该问题的机制;题材相似只是一条线索。
按需开始
- 已有参考:读取用户给出的文字与图片。未实际看图时,只能说明文字支持的方法;缺图而任务要求保留身份或精确构图时,明确缺失并请求所需图片,不猜内容。
- 没有指定参考:先看 案例选择表,只打开相关例子的完整正文。用
python scripts/select_case.py --category 道具或python scripts/select_case.py --problem "接触"可离线读出本库的原创实际提示词与局限。工具按关键词筛选,不调用外部 API。 - 需要溯源:查看 来源与权利边界。这些是机制研究的来源,不是可直接复制的图像素材库。
从关系写成真正可用的输入
依据当前任务说清主体与环境的关系、观看顺序、接触或距离,以及可见光源。把身份、结构、数量、相对位置、固有色等已锁定内容与允许变化的背景、构图、媒介或表现手法分开;固定或可变由任务决定,不由本库样例决定。
有多张参考时逐张写清职责,例如“图 A 只保留人物身份;图 B 只借侧光与留白;图 C 只参考外套材质”。参考发生冲突时按用户当前目标解决,关键身份无法确定再询问。没有参考图时如实写明;不能把纯文字要求说成已经验证了身份保真。
随后交付完整、可以直接提交的提示词。需要保留的事实必须进入实际输入,而不是只放在分析说明里。保持原人物、场景、道具或类型技能承担其专业设定,本包只负责案例关系的转化;不自动扩为导演方案、分镜或视频。按用户任务确定图数、画幅与交付媒介,不因样例是单图、套卡或海报而套用数量与版式。
可以简短说明借了什么机制、保留什么、允许改什么,但不能用 JSON、标签或术语表代替提示词或用户要求的图片。案例中的角色、品牌、具体构图与风格外壳不自动进入新作品。
看结果,再定向修改
用户请求真实图片且可用工具满足时,生成后实际查看图片;只写了提示词就只称提示词完成。先检查本次关键固定项与关系,再看材质、光线和多余元素。指出能在图中定位的问题;不可见、模糊或被裁掉的证据不能算通过。
只针对已观察缺陷写编辑输入,同时带上需要保留的有效内容。使用待修改的准确原图,保存实际提示词、输入图身份、修改原因与结果;若修订破坏有效项,退回前一候选重新判断。修订是否继续取决于用户目标、实际缺陷与已授权成本,不无限重试,不固定追加图数。
分别报告生成完成、内部检查与用户接受。单批最终候选、主观观感和一次修订成功不能证明抽卡次数下降、成功率提高、跨图一致性或导演能力;需要相应独立证据才能作这些主张。附图实验中 11 个历史内部通过、1 个部分通过,均未获得用户逐图审美接受;后来的抽检还发现了裁脚与人物比例问题。