不可编辑 PDF 图纸排版教程(译前 / 译后)¶
概述¶
本教程面向翻译从业人员和排版人员,系统介绍如何使用 Adobe Illustrator 配合 AdtpWord 插件,完成不可编辑 PDF 图纸的文字提取(下图/译前)与译文回填(上图/译后)全流程。
什么是不可编辑 PDF?¶
PDF 图纸按文字类型分为两种:
| 类型 | 特征 | 处理方式 |
|---|---|---|
| 可编辑 PDF | 在 Illustrator 中打开后,文字可被选中并直接修改 | 直接提取文字,合并后导出 |
| 不可编辑 PDF | 文字无法选中编辑 | 需手动打标 → OCR 识别 → 导出 |
不可编辑 PDF 的核心原因:图纸中的文字已经「转曲」(Create Outlines),即文字被转换成了矢量路径/轮廓,不再是文本对象。转曲通常发生在印刷前交付环节,目的是防止字体缺失导致的排版错乱。但也正因如此,这类图纸在 Illustrator 中只能选中文字的局部路径,无法直接编辑内容。
与可编辑 PDF 流程的主要区别¶
| 对比项 | 可编辑 PDF | 不可编辑 PDF |
|---|---|---|
| 文字提取方式 | 直接选择文字对象 | 手动绘制矩形框(打标) |
| 是否需要 OCR | 不需要 | 需要(默认识别源或百度识别源) |
| 翻译前校对 | 核对文字合并结果 | 对照原图截图逐条校对 |
| 译文导入 | 「文字导入」 | 「译文导入」 |
| 表格处理 | 直接调整文字框即可 | 需使用「双语标记工具」处理 |
第一步:图纸预处理¶
1.1 拆分 PDF¶
与可编辑 PDF 完全相同,此处从简。
- 使用 Adobe Acrobat 打开 PDF
- 点击左侧「文档」按钮,展开所有页面缩略图
- 在任意页面上右键 → 提取页面
- 在弹出的对话框中:
- 设置页面范围
- 勾选「提取页面为单独文件」 - 确定后,每张图纸将保存为一个独立 PDF 文件
1.2 用 Illustrator 打开图纸¶
将拆分后的 PDF 文件拖拽到 Illustrator 图标上即可打开。
打开后可以直观确认:放大图纸,尝试选中文字,如果只能选中文字的局部笔画(路径片段),说明这是转曲后的不可编辑 PDF。
基本操作¶
| 操作 | 快捷键 |
|---|---|
| 缩放页面 | Alt + 滚轮 |
| 移动页面 | 空格 + 拖动 |
1.3 另存为 AI 格式¶
⚠️ 重要:打开图纸后的第一件事——另存为
.ai格式。
点击左上角 文件 → 另存为,选择类型为 AI(.ai)。
虽然 Illustrator 可以直接编辑 PDF,但有一定概率导致文件出错。.ai 是 Illustrator 的专有格式,更加稳定可靠。
1.4 调整图纸方向¶
如果图纸是竖向的,需要先旋转为横向:
Ctrl+A全选文档- 在图像上右键 → 旋转,输入角度:
- 向左旋转 90° → 输入90
- 向右旋转 90° → 输入270
- (Illustrator 以逆时针计算角度,右侧水平为 0°) - 调整画板方向:在右侧「属性」标签页中,点击「编辑画板」→「水平」按钮
- 按
ESC退出编辑画板模式
1.5 新建图层并锁定原图¶
⚠️ 关键步骤:所有修改和标注必须在新建图层上进行,原图图层保持不动。
- 在右侧图层面板中,点击「新建图层」按钮,生成「图层 2」
- 锁定图层 1(点击图层旁的锁图标)
- 之后所有打标、标注操作都在图层 2 上完成
为什么要锁定图层 1?
- 图层 1 保留原图不动,仅修改文字部分
- 图纸线条繁多时,锁定底层可显著降低软件卡顿
- 方便后续追溯和校对
第二步:文字打标与导出(译前 / 下图)¶
这是不可编辑 PDF 区别于可编辑 PDF 的最核心步骤。由于文字已转曲无法直接提取,需要手动在每段文字上绘制矩形框进行「打标」。
2.1 矩形打标(核心操作)¶
2.1.1 基础打标¶
- 按
M调出矩形工具 - 在每一段需要翻译的文字上方绘制矩形框,完全盖住文字
- 矩形可以比文字稍大,但不要超出太多(避免覆盖相邻文字)
- 只画需要翻译的文字,不需要翻译的文字不要画框
2.1.2 快速定位技巧¶
| 操作 | 快捷键 |
|---|---|
| 切换到选择工具 | V |
| 平移画布 | 空格 + 拖动 |
| 缩放画面 | Alt + 滚轮 |
| 选中矩形后拖动定位点 | 直接拖动 8 个定位点调整形状 |
两个快捷键配合使用(空格平移 + Alt 缩放),可以快速定位到图纸的任意位置。
2.1.3 复制已有矩形(批量操作)¶
如果遇到重复区域(如多行表格、多处相同尺寸的文字),不需要逐一绘制:
- 选中已画好的矩形框
- 按住
Ctrl+Alt,光标旁出现 + 号 - 拖动即可移动并复制矩形框到新位置
- 重复操作,直到所有文字区域都被矩形覆盖
2.1.4 表格区域批量处理¶
表格每行高度一致,手动逐一绘制效率极低。可以使用对齐与分布功能批量处理:
- 先绘制一个略小于单元格的矩形
- 按住
Ctrl+Alt拖动复制多个矩形(保证每行都有一个) - 全选所有矩形
- 打开右侧「属性」面板:
- 点击「左对齐」
- 点开对齐面板下拉三角,选择「垂直居中分布」
- 矩形将自动均匀铺满每一行单元格 - 框选整列矩形,
Ctrl+Alt复制到右侧列 - 调整矩形大小适配不同宽度的单元格
- 单独零散的单元格单独绘制矩形处理
2.1.5 矩形样式调整¶
默认绘制的矩形可能是白色填充+黑色边框,需要调整为标准样式:
- 在左侧工具栏找到填色和描边两个设置项:
- 上方方块:填充色(控制矩形内部底色)
- 下方方块:描边色(控制矩形外围边框) - 点击互换填色和描边按钮,使填充变为黑色、边框变为白色
- 选中描边色块,点击「无」选项,使边框消失
- 设置完成后,后续绘制的矩形将自动保持此样式
2.1.6 校对覆盖情况¶
Ctrl+A全选所有矩形- 在属性面板中降低不透明度
- 透过半透明矩形,检查是否完整覆盖了所有需翻译的文字
- 确认无误后恢复不透明度
如果图纸文字较多,打标会相当耗时,需要耐心逐处完成。这是不可编辑 PDF 处理中最费时的环节。
2.2 导出矩形到 Word¶
打标完成后,将矩形框信息导出到 Word。
- 在项目文件夹中右键新建一个 Word 文档,双击打开
- 点击顶部「Adtp 载入项」→「Illustrator」→「文档导出」→「从当前打开的文档导出」
- 在弹出的对话框中设置:
| 设置项 | 建议值 | 说明 |
|---|---|---|
| AI 版本 | 选择已安装的 AI 版本 | 与正在使用的 Illustrator 版本对应 |
| 抓取分辨率 | 150–1800 DPI | 不是越高越好,需根据文档尺寸调整:文档越大、文字越小,分辨率需设越高 |
| 导出内容 | 文字或矩形 | 不可编辑图纸必须选此项(不同于可编辑图纸的「仅文字」) |
| 筛选文字 | 取消勾选 | — |
- 点击「确定」,等待导入完成
导出后,Word 中会生成一个两列表格:
- 左列:隐藏的原图截图(供校对参考)
- 右列:待识别的文字区域
这个结构与可编辑 PDF 导出后的效果一致。
2.3 OCR 文字识别¶
图纸中的文字仍是图像形式,需要通过 OCR 将其转为可编辑文本。
2.3.1 准备阶段¶
务必先将 Word 另存为 .doc 格式(文件 → 另存为 → 选择 DOC 格式),否则可能影响识别功能。
2.3.2 识别源选择¶
点击「Adtp 载入项」→「识别设置」旁的小按钮,可选择识别源:
| 识别源 | 支持语种 | 准确度 | 费用 | 适用场景 |
|---|---|---|---|---|
| 默认识别源 | 仅中文 | 一般 | 免费 | 中文图纸的快速识别 |
| 百度识别源 | 汉语、英语等多语种 | 更高 | 约 0.01 元/图框 | 多语种图纸或高精度需求 |
百度识别源配置(如选用):
1. 登录百度云控制台
2. 获取 API Key 和 Secret Key
3. 将两组密钥填入对应输入框
4. 点击「测试 Token」,提示 token 有效即配置成功
百度识别源需要消耗百度云额度,平台也提供免费识别次数可领取。如需自建识别服务器,可前往官网查看教程。
2.3.3 执行识别¶
两种方式:
方式一(逐段):
1. 选中右侧任意几段文字
2. 点击「识别文字」
3. 软件自动识别出对应的文本
方式二(批量,推荐):
1. 点击「提取稿调整」→「识别右列」
2. 软件左下角实时显示识别进度
3. 等待识别全部完成
💡 建议先用默认识别源快速过一遍,对于准确度不够的区域再切换百度识别源重新识别。
2.4 文字校对¶
⚠️ OCR 识别不是 100% 准确,必须逐条校对。
- 对照左侧原图截图,逐条核对右侧识别文字
- 常见问题:
- 上标/下标数字缺失(如 m² 被识别为 m2)
- 形近字误识别
- 特殊符号丢失 - 发现问题直接手动修正
提高准确度的建议:
- 百度识别源的准确度明显高于默认识别源,对质量要求高的稿件优先使用
- 可先批量用默认识别源,再对错误较多的区域切换到百度识别源重新识别
至此,译前(下图)工作完成,Word 文档可交付翻译。
第三步:文字回填(译后 / 上图)¶
翻译完成后,需要将译文回填到 Illustrator 图纸中。
3.1 基础导入¶
- 打开翻译好的 Word 文档和对应的 AI 图纸文件
- 在 Word 的「Adtp 载入项」→「Illustrator」→「译文导入」→「从打开的文档导入」
- 在弹出的对话框中选择模式(如「对照」),其余保持默认
- 点击「确定」,等待操作完成
导入完成后:
- 切换到图层标签页,可以看到译文已放在一个新的译文图层中
- 原图层 2 中的矩形框内容会消失
- 得到的是对照译文(原文在上、译文在下,或左右对照)
3.2 处理表格空间不足(双语标记工具)¶
这是不可编辑 PDF 上图中最关键的差异化步骤。
问题¶
在基础导入后,表格内部的译文往往因为单元格空间狭小而无法完整显示。即使缩小文字,也会变得太小而无法辨认。
解决方案¶
使用 AdtpWord 中的双语标记工具:
- 回到导入前的 AI 图纸
- 在 Word 中,点击「Illustrator」按钮 →「双语标记工具」
- 在图纸中,用双语标记工具将表格类的狭窄区域标红
- 标记完成后,重新导入译文:
- 打开译文文档
- 「Illustrator」→「译文导入」→「从打开的文档导入」
- 选择「对照」
- 勾选「回传译文」
- 在「原文路径」中添加之前提取文字时对应的文档路径
- ⚠️ 原文路径指的就是提取文字的那份文档,不是其他文件
- 其余参数保持不变,点击「确定」
软件会先读取原文内容,再读取译文内容,最后将二者合并导入。
效果:被标红的表格单元格中,英文原文和中文译文会一并导入,使得表格内的文字空间充足可用。
3.3 文字排版调整¶
3.3.1 基础调整¶
- 锁定图层 2(原矩形框图层),译文全部在图层 3 中
Ctrl+A全选译文文字- 在「属性」标签页中适当缩小字号
3.3.2 排版规范¶
与可编辑 PDF 的排版标准保持一致。
| 规范 | 说明 |
|---|---|
| 字号原则 | 在文字能完整显示的前提下,译文字号尽量放大,但不能超过原文字号 |
| 标题突出 | 标题字号适当调大,可使用居中对齐 |
| 表格文字 | 表格内文字应与周围同类文字字号相同 |
| 最小字号 | 文字不可缩得过小,须保证打印后仍可清晰辨认 |
| 对齐方式 | 文字统一保持垂直顶对齐(对齐功能中选择「垂直顶对齐」) |
3.3.3 微调技巧¶
| 操作 | 方法 |
|---|---|
| 水平左对齐/居中/右对齐 | 对齐功能中选择对应水平对齐方式 |
| 垂直顶对齐 | 对 功能中选择「垂直顶对齐」 |
| 微调位置 | 选中文字后按方向键逐像素移动 |
3.3.4 逐区域检查¶
- 逐区域调整文字位置和对齐方式
- 保证所有文字完整显示、无溢出
- 特殊情况允许个别文字略小于周围文字
第四步:输出与合并¶
4.1 导出为 PDF¶
所有文字排版调整完成后,导出最终 PDF:
- 在 Word 的「Adtp 载入项」→「Illustrator」→「文档转换」
- 选择「保存当前打开的文件」
- 导出格式选择 PDF
- 导出完成后,图纸即另存为 PDF 文件
4.2 批量保存¶
如需批量处理多张图纸,可使用:
- 「Illustrator」→「文档转换」→「保存打开的文件」→ 批量保存为 AI 或 PDF
4.3 合并 PDF¶
由于处理前已将原 PDF 拆分为单页文件,完成后需重新合并:
- 在文件夹中选中所有处理后的 PDF 文件
- 右键 → 在 Acrobat 中合并
- 合并完成后即为最终译文稿件
快捷键速查表¶
Illustrator 常用快捷键¶
| 快捷键 | 功能 |
|---|---|
Alt + 滚轮 |
缩放页面 |
空格 + 拖动 |
移动页面 |
Ctrl + A |
全选 |
Ctrl + X |
剪切 |
Ctrl + F |
按原位置粘贴 |
Ctrl + V |
粘贴 |
Ctrl + Tab |
切换打开的文档 |
Ctrl + Alt + 拖动 |
移动并复制对象 |
M |
矩形工具 |
V |
选择工具 |
T |
文字工具 |
Ctrl + Shift + , |
缩小字号 |
Ctrl + Shift + . |
放大字号 |
| 方向键 | 微调选中对象位置 |
跨软件操作¶
| 快捷键 | 功能 |
|---|---|
Alt + Tab |
切换应用程序窗口 |
Ctrl + C |
复制 |
Ctrl + V |
粘贴 |
流程对比总览¶
可编辑 PDF 流程:
拆分 → 旋转 → 分离文字图层 → 合并文字 → 文字导出 → 翻译 → 文字导入 → 排版 → 输出 PDF
不可编辑 PDF 流程:
拆分 → 旋转 → 新建图层/锁定原图 → 矩形打标 → 文档导出 → OCR识别 → 校对
↓
输出 PDF ← 排版调整 ← 译文导入(含双语标记) ← 翻译 ←──────────────┘
| 阶段 | 可编辑 PDF | 不可编辑 PDF |
|---|---|---|
| 文字提取 | 直接选中文字对象 | 手动绘制矩形打标 |
| 导出方式 | 文字导出 | 文字或矩形 |
| 是否需要 OCR | ❌ 不需要 | ✅ 需要 |
| 校对重点 | 文字合并结果 | OCR 识别准确度 |
| 表格处理 | 直接调整文字框 | 双语标记工具标红后重新导入 |
| 导入方式 | 文字导入 | 译文导入 |
常见问题¶
Q1:为什么不可编辑 PDF 比可编辑 PDF 耗时更多?¶
不可编辑 PDF 需要手动为每段文字绘制矩形框(打标),图纸文字越多,打标越费时。此外还需 OCR 识别和校对,增加了额外环节。
Q2:默认识别源和百度识别源怎么选?¶
- 中文图纸、时间紧 → 默认识别源,速度快、免费
- 多语种、精度要求高 → 百度识别源,准确度高、每框约 1 分钱
- 混合策略:先用默认源批量识别,对错误多的区域切换到百度源
Q3:OCR 识别后还需要校对吗?¶
必须校对。 OCR 不是 100% 准确,常见的错误包括:
- 上标/下标丢失(m² → m2)
- 形近字混淆
- 特殊符号遗漏
务必对照左侧原图截图逐条核对。
Q4:表格里的译文放不下怎么办?¶
这就是双语标记工具的使用场景。在导入译文前,先用双语标记工具将表格区域标红,然后重新导入时勾选「回传译文」并指定原文路径。这样原文和译文会一起放入单元格,空间就够用了。
Q5:打标时矩形框太大或太小有什么影响?¶
- 矩形框太大:可能覆盖到相邻文字,导致 OCR 识别出多余内容
- 矩形框太小:可能漏掉部分文字,导致 OCR 不完整
- 建议:矩形比文字稍大,完整覆盖但不超出太多