PDF 小说翻译后格式乱,通常不是一个“翻译按钮”能完全解决的问题。小说 PDF 最影响阅读的往往是章节标题、段落空行、对话换行、页眉页脚和扫描识别质量。更稳的办法是先用一页有代表性的正文试译,确认版式和阅读感,再继续处理整份文档。
先区分:是 PDF 源文件问题,还是翻译后需要复核
如果原始 PDF 本身就是扫描件、文字倾斜、底纹很重,或每页都有密集页眉页脚,识别阶段就可能让正文分段不够准确。相反,如果 PDF 的文字层清晰、章节和对话换行规整,翻译后的检查重点更多是文字变长后是否仍便于连续阅读。
- 扫描文字模糊:先挑一页测试识别是否完整。
- 双栏或插图很多:重点看阅读顺序、图注和空白区域。
- 章节标题明显:检查标题有没有和正文混在一起。
- 对话密集:检查引号、破折号和换行是否仍然容易辨认。
- 页眉页脚重复:确认书名、页码、出版社信息没有打断正文。
试译页不要随便挑:选这一类页面更有参考价值
目录、版权页和只有一句短文的页面并不能代表整份小说。更建议选一页同时包含章节标题、2 到 3 段叙述、人物对话和一个或两个名字的正文。这样能同时看出段落是否完整、称谓是否容易复核,以及中文长度变化后页面是否仍好读。
如果同一本书前后风格差异很大,例如开头是叙述、后面有大量书信或诗歌,可以分别试一页。工具适合先帮你理解和整理,不应替代最终的文学编辑判断。
翻译后按这个清单检查,避免“能看但不好读”
- 从章节标题开始向下读,确认没有出现明显跳段或正文顺序错乱。
- 快速浏览对话,确认每一轮说话没有挤成一大段。
- 检查页眉、页脚和脚注是否被当作正文反复出现。
- 抽查人物名、地点名和反复出现的称谓,标记需要人工统一的地方。
- 对重点章节做双语复核,尤其是情节转折、人物关系和关键信息。
什么时候应该停止整份处理,改为人工处理
如果试译页出现大量 OCR 漏字、对话结构很难辨认,或你需要正式出版、投稿、商用和公开传播,就不应该把机器翻译结果直接当终稿。前者需要先改善源文件或重新获取清晰版本;后者则需要有版权或授权,并由人工译者和编辑继续处理。
下一步怎么做
可以先打开 英文小说 PDF / Word 文档翻译成中文 页面,按一页真实正文试译。需要了解通用版式保留能力,可继续看 PDF 翻译保留排版;如果源文件是 Word 稿件,则参考 Word 文档翻译。