浏览 AI 知识库
AI 修改图片文字:保护版式并准备人工排版兜底
用一张现有中文知识卡片做实际改字:把底部“先补信息,再生成”改为“先把任务说清楚,再生成”,保护其余插画、标题和四个分区不变。
只改底部一句 CTA,其他 20 多处文字和插画都不能漂移
输入是一张本站已有的 1254 x 1254 中文知识卡片。修改单要求把底部“先补信息,再生成”改为“先把任务说清楚,再生成”;标题、人物、四个分区、箭头、边框和其他文字全部锁定。
这类任务若让模型整图重绘,最常见的结果是目标文字改了,其他中文也跟着错。案例采用‘清理目标区域 -> 重建文字底板 -> 放入可编辑文字层’的兜底路线。
- 一张明确标出保护区的修改单
- 实际 Before/After 图片
- 逐字符和非目标区域核验记录
目标区域改变,其余构图和信息层级保持不动
Before|原始知识卡片

After|重建文字层

在动图之前,先把修改区和保护区写成坐标化要求
| 区域 | 要求 | 验收 |
|---|---|---|
| 修改区 | 底部圆角框内部;替换整句文字 | 新句逐字符一致,无旧字残留 |
| 保护区 1 | 顶部红黑标题与红色下划线 | 位置、颜色、字形不变 |
| 保护区 2 | 中央人物、记事本、铅笔 | 轮廓和颜色不变 |
| 保护区 3 | 四个示例框、箭头和内部文字 | 像素级不随改字重绘 |
| 画布 | 1254 x 1254,不裁切、不扩图 | 尺寸和比例一致 |
| 可编辑交付 | 底板与文字层分开保存 | 后续改字不再重绘整图 |
复杂背景先修底图,规则文字直接交给排版层
- 01
备份原图并记录原句
保存输入文件、尺寸、目标文字和修改原因;不要在唯一原图上覆盖。
中间结果:修改单与原图校验值。 - 02
只清理目标文字
修改区缩到圆角框内部;本例直接重建内部浅色底板,避免旧字和红色下划线残留。
中间结果:无字底板,外框仍保留。 - 03
使用真实文字层
输入完整新句,设置居中、字号与安全边距;不让生成模型猜中文字形。
中间结果:文字可选、可继续编辑。 - 04
前后差异检查
先逐字符读新句,再把前后图叠加;差异超出底部目标区就回退。
最终结果:仅目标区域发生预期变化。
按背景复杂度和文字重要性选择路线
| 现场 | 推荐路线 | 原因 |
|---|---|---|
| 纯色/规则底板上的关键中文 | 人工文字层 | 最快、可校对、可再次编辑 |
| 文字覆盖纸张、墙面等可延展纹理 | AI/修复工具清背景 + 人工文字层 | 让模型只负责无字底图 |
| 文字压在人物、产品或 Logo 上 | 回源文件或精细修图 | 自动修补容易改主体与品牌资产 |
| 一次要改多语言、多尺寸 | 建立版式模板和文本变量 | 避免每个版本重复生成并逐图漂移 |
目标文字正确,不代表这张图已经通过
新句正确,但旁边其他中文出现错字
- 原因
- 整图进入生成流程,保护区没有真正锁定。
- 怎么改
- 回到原图,只处理目标区域;其他文字不得重新生成。
旧字或下划线隐约可见
- 原因
- 只在原文字上覆盖新字,没有先完成无字底板。
- 怎么改
- 扩大到完整文字底板内部重建,再放新文字层。
新句挤出圆角框
- 原因
- 沿用原字号,却没有按新句长度测量。
- 怎么改
- 先定安全区和最大行宽,再调字号或分行;不要压缩字形。
导出图能看,但下次无法再改
- 原因
- 只交付扁平 PNG,没有保留文本层和字体信息。
- 怎么改
- 同时保留可编辑源文件、字体替代说明和导出版本。
逐字符、逐区域、逐文件检查
局部编辑能力会变化,关键文字仍以可编辑排版为准
一手来源OpenAI:Image generation编辑依据本站阶段5案例生成脚本
核对当前图片编辑输入和模型限制;不把模型输出当作文字校对结果。
一手来源C2PA Specifications需要记录图片来源与编辑历史时,可参考内容来源标准。
scripts/generate-stage5-sample-assets.ps1 保存目标区域和文字层生成方法。
