不可编辑 PDF 图纸排版教程(译前 / 译后)

概述

本教程面向翻译从业人员和排版人员,系统介绍如何使用 Adobe Illustrator 配合 AdtpWord 插件,完成不可编辑 PDF 图纸的文字提取(下图/译前)与译文回填(上图/译后)全流程。

什么是不可编辑 PDF?

PDF 图纸按文字类型分为两种:

类型 特征 处理方式
可编辑 PDF 在 Illustrator 中打开后,文字可被选中并直接修改 直接提取文字,合并后导出
不可编辑 PDF 文字无法选中编辑 需手动打标 → OCR 识别 → 导出

不可编辑 PDF 的核心原因:图纸中的文字已经「转曲」(Create Outlines),即文字被转换成了矢量路径/轮廓,不再是文本对象。转曲通常发生在印刷前交付环节,目的是防止字体缺失导致的排版错乱。但也正因如此,这类图纸在 Illustrator 中只能选中文字的局部路径,无法直接编辑内容。

与可编辑 PDF 流程的主要区别

对比项 可编辑 PDF 不可编辑 PDF
文字提取方式 直接选择文字对象 手动绘制矩形框(打标)
是否需要 OCR 不需要 需要(默认识别源或百度识别源)
翻译前校对 核对文字合并结果 对照原图截图逐条校对
译文导入 「文字导入」 「译文导入」
表格处理 直接调整文字框即可 需使用「双语标记工具」处理

第一步:图纸预处理

1.1 拆分 PDF

与可编辑 PDF 完全相同,此处从简。

  1. 使用 Adobe Acrobat 打开 PDF
  2. 点击左侧「文档」按钮,展开所有页面缩略图
  3. 在任意页面上右键 → 提取页面
  4. 在弹出的对话框中:
    - 设置页面范围
    - 勾选「提取页面为单独文件」
  5. 确定后,每张图纸将保存为一个独立 PDF 文件

1.2 用 Illustrator 打开图纸

将拆分后的 PDF 文件拖拽到 Illustrator 图标上即可打开。

打开后可以直观确认:放大图纸,尝试选中文字,如果只能选中文字的局部笔画(路径片段),说明这是转曲后的不可编辑 PDF

基本操作

操作 快捷键
缩放页面 Alt + 滚轮
移动页面 空格 + 拖动

1.3 另存为 AI 格式

⚠️ 重要:打开图纸后的第一件事——另存为 .ai 格式。

点击左上角 文件 → 另存为,选择类型为 AI(.ai)

虽然 Illustrator 可以直接编辑 PDF,但有一定概率导致文件出错。.ai 是 Illustrator 的专有格式,更加稳定可靠。

1.4 调整图纸方向

如果图纸是竖向的,需要先旋转为横向:

  1. Ctrl + A 全选文档
  2. 在图像上右键 → 旋转,输入角度:
    - 向左旋转 90° → 输入 90
    - 向右旋转 90° → 输入 270
    - (Illustrator 以逆时针计算角度,右侧水平为 0°)
  3. 调整画板方向:在右侧「属性」标签页中,点击「编辑画板」→「水平」按钮
  4. ESC 退出编辑画板模式

1.5 新建图层并锁定原图

⚠️ 关键步骤:所有修改和标注必须在新建图层上进行,原图图层保持不动。

  1. 在右侧图层面板中,点击「新建图层」按钮,生成「图层 2」
  2. 锁定图层 1(点击图层旁的锁图标)
  3. 之后所有打标、标注操作都在图层 2 上完成

为什么要锁定图层 1?
- 图层 1 保留原图不动,仅修改文字部分
- 图纸线条繁多时,锁定底层可显著降低软件卡顿
- 方便后续追溯和校对


第二步:文字打标与导出(译前 / 下图)

这是不可编辑 PDF 区别于可编辑 PDF 的最核心步骤。由于文字已转曲无法直接提取,需要手动在每段文字上绘制矩形框进行「打标」。

2.1 矩形打标(核心操作)

2.1.1 基础打标

  1. M 调出矩形工具
  2. 在每一段需要翻译的文字上方绘制矩形框,完全盖住文字
    - 矩形可以比文字稍大,但不要超出太多(避免覆盖相邻文字)
    - 只画需要翻译的文字,不需要翻译的文字不要画框

2.1.2 快速定位技巧

操作 快捷键
切换到选择工具 V
平移画布 空格 + 拖动
缩放画面 Alt + 滚轮
选中矩形后拖动定位点 直接拖动 8 个定位点调整形状

两个快捷键配合使用(空格平移 + Alt 缩放),可以快速定位到图纸的任意位置。

2.1.3 复制已有矩形(批量操作)

如果遇到重复区域(如多行表格、多处相同尺寸的文字),不需要逐一绘制:

  1. 选中已画好的矩形框
  2. 按住 Ctrl + Alt,光标旁出现 +
  3. 拖动即可移动并复制矩形框到新位置
  4. 重复操作,直到所有文字区域都被矩形覆盖

2.1.4 表格区域批量处理

表格每行高度一致,手动逐一绘制效率极低。可以使用对齐与分布功能批量处理:

  1. 先绘制一个略小于单元格的矩形
  2. 按住 Ctrl + Alt 拖动复制多个矩形(保证每行都有一个)
  3. 全选所有矩形
  4. 打开右侧「属性」面板:
    - 点击「左对齐
    - 点开对齐面板下拉三角,选择「垂直居中分布
    - 矩形将自动均匀铺满每一行单元格
  5. 框选整列矩形,Ctrl + Alt 复制到右侧列
  6. 调整矩形大小适配不同宽度的单元格
  7. 单独零散的单元格单独绘制矩形处理

2.1.5 矩形样式调整

默认绘制的矩形可能是白色填充+黑色边框,需要调整为标准样式:

  1. 在左侧工具栏找到填色和描边两个设置项:
    - 上方方块:填充色(控制矩形内部底色)
    - 下方方块:描边色(控制矩形外围边框)
  2. 点击互换填色和描边按钮,使填充变为黑色、边框变为白色
  3. 选中描边色块,点击「」选项,使边框消失
  4. 设置完成后,后续绘制的矩形将自动保持此样式

2.1.6 校对覆盖情况

  1. Ctrl + A 全选所有矩形
  2. 在属性面板中降低不透明度
  3. 透过半透明矩形,检查是否完整覆盖了所有需翻译的文字
  4. 确认无误后恢复不透明度

如果图纸文字较多,打标会相当耗时,需要耐心逐处完成。这是不可编辑 PDF 处理中最费时的环节。

2.2 导出矩形到 Word

打标完成后,将矩形框信息导出到 Word。

  1. 在项目文件夹中右键新建一个 Word 文档,双击打开
  2. 点击顶部「Adtp 载入项」→「Illustrator」→「文档导出」→「从当前打开的文档导出
  3. 在弹出的对话框中设置:
设置项 建议值 说明
AI 版本 选择已安装的 AI 版本 与正在使用的 Illustrator 版本对应
抓取分辨率 150–1800 DPI 不是越高越好,需根据文档尺寸调整:文档越大、文字越小,分辨率需设越高
导出内容 文字或矩形 不可编辑图纸必须选此项(不同于可编辑图纸的「仅文字」)
筛选文字 取消勾选
  1. 点击「确定」,等待导入完成

导出后,Word 中会生成一个两列表格
- 左列:隐藏的原图截图(供校对参考)
- 右列:待识别的文字区域

这个结构与可编辑 PDF 导出后的效果一致。

2.3 OCR 文字识别

图纸中的文字仍是图像形式,需要通过 OCR 将其转为可编辑文本。

2.3.1 准备阶段

务必先将 Word 另存为 .doc 格式(文件 → 另存为 → 选择 DOC 格式),否则可能影响识别功能。

2.3.2 识别源选择

点击「Adtp 载入项」→「识别设置」旁的小按钮,可选择识别源:

识别源 支持语种 准确度 费用 适用场景
默认识别源 仅中文 一般 免费 中文图纸的快速识别
百度识别源 汉语、英语等多语种 更高 约 0.01 元/图框 多语种图纸或高精度需求

百度识别源配置(如选用):
1. 登录百度云控制台
2. 获取 API KeySecret Key
3. 将两组密钥填入对应输入框
4. 点击「测试 Token」,提示 token 有效即配置成功

百度识别源需要消耗百度云额度,平台也提供免费识别次数可领取。如需自建识别服务器,可前往官网查看教程。

2.3.3 执行识别

两种方式:

方式一(逐段)
1. 选中右侧任意几段文字
2. 点击「识别文字
3. 软件自动识别出对应的文本

方式二(批量,推荐)
1. 点击「提取稿调整」→「识别右列
2. 软件左下角实时显示识别进度
3. 等待识别全部完成

💡 建议先用默认识别源快速过一遍,对于准确度不够的区域再切换百度识别源重新识别。

2.4 文字校对

⚠️ OCR 识别不是 100% 准确,必须逐条校对。

  1. 对照左侧原图截图,逐条核对右侧识别文字
  2. 常见问题:
    - 上标/下标数字缺失(如 m² 被识别为 m2)
    - 形近字误识别
    - 特殊符号丢失
  3. 发现问题直接手动修正

提高准确度的建议
- 百度识别源的准确度明显高于默认识别源,对质量要求高的稿件优先使用
- 可先批量用默认识别源,再对错误较多的区域切换到百度识别源重新识别

至此,译前(下图)工作完成,Word 文档可交付翻译。


第三步:文字回填(译后 / 上图)

翻译完成后,需要将译文回填到 Illustrator 图纸中。

3.1 基础导入

  1. 打开翻译好的 Word 文档和对应的 AI 图纸文件
  2. 在 Word 的「Adtp 载入项」→「Illustrator」→「译文导入」→「从打开的文档导入
  3. 在弹出的对话框中选择模式(如「对照」),其余保持默认
  4. 点击「确定」,等待操作完成

导入完成后:
- 切换到图层标签页,可以看到译文已放在一个新的译文图层
- 原图层 2 中的矩形框内容会消失
- 得到的是对照译文(原文在上、译文在下,或左右对照)

3.2 处理表格空间不足(双语标记工具)

这是不可编辑 PDF 上图中最关键的差异化步骤。

问题

在基础导入后,表格内部的译文往往因为单元格空间狭小而无法完整显示。即使缩小文字,也会变得太小而无法辨认。

解决方案

使用 AdtpWord 中的双语标记工具

  1. 回到导入前的 AI 图纸
  2. 在 Word 中,点击「Illustrator」按钮 →「双语标记工具
  3. 在图纸中,用双语标记工具将表格类的狭窄区域标红
  4. 标记完成后,重新导入译文
    - 打开译文文档
    - 「Illustrator」→「译文导入」→「从打开的文档导入
    - 选择「对照
    - 勾选「回传译文」
    - 在「原文路径」中添加之前提取文字时对应的文档路径
    - ⚠️ 原文路径指的就是提取文字的那份文档,不是其他文件
    - 其余参数保持不变,点击「确定

软件会先读取原文内容,再读取译文内容,最后将二者合并导入。

效果:被标红的表格单元格中,英文原文和中文译文会一并导入,使得表格内的文字空间充足可用。

3.3 文字排版调整

3.3.1 基础调整

  1. 锁定图层 2(原矩形框图层),译文全部在图层 3 中
  2. Ctrl + A 全选译文文字
  3. 在「属性」标签页中适当缩小字号

3.3.2 排版规范

与可编辑 PDF 的排版标准保持一致。

规范 说明
字号原则 在文字能完整显示的前提下,译文字号尽量放大,但不能超过原文字号
标题突出 标题字号适当调大,可使用居中对齐
表格文字 表格内文字应与周围同类文字字号相同
最小字号 文字不可缩得过小,须保证打印后仍可清晰辨认
对齐方式 文字统一保持垂直顶对齐(对齐功能中选择「垂直顶对齐」)

3.3.3 微调技巧

操作 方法
水平左对齐/居中/右对齐 对齐功能中选择对应水平对齐方式
垂直顶对齐 对 功能中选择「垂直顶对齐」
微调位置 选中文字后按方向键逐像素移动

3.3.4 逐区域检查

  1. 逐区域调整文字位置和对齐方式
  2. 保证所有文字完整显示、无溢出
  3. 特殊情况允许个别文字略小于周围文字

第四步:输出与合并

4.1 导出为 PDF

所有文字排版调整完成后,导出最终 PDF:

  1. 在 Word 的「Adtp 载入项」→「Illustrator」→「文档转换
  2. 选择「保存当前打开的文件
  3. 导出格式选择 PDF
  4. 导出完成后,图纸即另存为 PDF 文件

4.2 批量保存

如需批量处理多张图纸,可使用:
- 「Illustrator」→「文档转换」→「保存打开的文件」→ 批量保存为 AI 或 PDF

4.3 合并 PDF

由于处理前已将原 PDF 拆分为单页文件,完成后需重新合并:

  1. 在文件夹中选中所有处理后的 PDF 文件
  2. 右键 → 在 Acrobat 中合并
  3. 合并完成后即为最终译文稿件

快捷键速查表

Illustrator 常用快捷键

快捷键 功能
Alt + 滚轮 缩放页面
空格 + 拖动 移动页面
Ctrl + A 全选
Ctrl + X 剪切
Ctrl + F 按原位置粘贴
Ctrl + V 粘贴
Ctrl + Tab 切换打开的文档
Ctrl + Alt + 拖动 移动并复制对象
M 矩形工具
V 选择工具
T 文字工具
Ctrl + Shift + , 缩小字号
Ctrl + Shift + . 放大字号
方向键 微调选中对象位置

跨软件操作

快捷键 功能
Alt + Tab 切换应用程序窗口
Ctrl + C 复制
Ctrl + V 粘贴

流程对比总览

可编辑 PDF 流程:
  拆分 → 旋转 → 分离文字图层 → 合并文字 → 文字导出 → 翻译 → 文字导入 → 排版 → 输出 PDF

不可编辑 PDF 流程:
  拆分 → 旋转 → 新建图层/锁定原图 → 矩形打标 → 文档导出 → OCR识别 → 校对
                                                                          ↓
  输出 PDF ← 排版调整 ← 译文导入(含双语标记) ← 翻译 ←──────────────┘
阶段 可编辑 PDF 不可编辑 PDF
文字提取 直接选中文字对象 手动绘制矩形打标
导出方式 文字导出 文字或矩形
是否需要 OCR ❌ 不需要 ✅ 需要
校对重点 文字合并结果 OCR 识别准确度
表格处理 直接调整文字框 双语标记工具标红后重新导入
导入方式 文字导入 译文导入

常见问题

Q1:为什么不可编辑 PDF 比可编辑 PDF 耗时更多?

不可编辑 PDF 需要手动为每段文字绘制矩形框(打标),图纸文字越多,打标越费时。此外还需 OCR 识别和校对,增加了额外环节。

Q2:默认识别源和百度识别源怎么选?

  • 中文图纸、时间紧 → 默认识别源,速度快、免费
  • 多语种、精度要求高 → 百度识别源,准确度高、每框约 1 分钱
  • 混合策略:先用默认源批量识别,对错误多的区域切换到百度源

Q3:OCR 识别后还需要校对吗?

必须校对。 OCR 不是 100% 准确,常见的错误包括:
- 上标/下标丢失(m² → m2)
- 形近字混淆
- 特殊符号遗漏

务必对照左侧原图截图逐条核对。

Q4:表格里的译文放不下怎么办?

这就是双语标记工具的使用场景。在导入译文前,先用双语标记工具将表格区域标红,然后重新导入时勾选「回传译文」并指定原文路径。这样原文和译文会一起放入单元格,空间就够用了。

Q5:打标时矩形框太大或太小有什么影响?

  • 矩形框太大:可能覆盖到相邻文字,导致 OCR 识别出多余内容
  • 矩形框太小:可能漏掉部分文字,导致 OCR 不完整
  • 建议:矩形比文字稍大,完整覆盖但不超出太多

相关文档