如何给扫描版日语 PDF 添加假名
2026-07-31
可以,不必重新手打一遍,就能给扫描版日语 PDF 添加假名。把 PDF 上传到 Mooon,它会直接读取页面上看得到的日文,按照自然阅读顺序重建内容,并生成一份可编辑的 Mooon Doc。点击添加全文假名,整份文档的读音就会出现在对应字词上方。
为什么大多数 PDF 假名工具处理不了扫描件
大多数假名生成器只接受粘贴进去的日语文字。即使有些工具声称支持 PDF,底层也往往只是提取文件自带的文字层。这种方法只有面对极少数异常干净、规范的 PDF 时才有机会奏效;即使文件足够规范,文字层中储存的顺序也不能保证提取算法会按照人真正阅读页面的顺序处理。
扫描版 PDF 根本没有文字层。即使不是扫描件,日语 PDF 也经常包含竖排、特殊编码、图文混排或不规则版面,普通提取得到的内容很容易缺失或顺序错乱。
Mooon 不依赖这层隐藏文字,而是直接读取页面上实际呈现的字符、栏位和版面,再按照人类自然阅读顺序重建内容。这种视觉识别通常被称为 OCR,但你不需要另开 OCR 工具,也不用处理一份散乱的识别结果。
从扫描件到可编辑假名
- 上传扫描版 PDF。 不必事先提取或重打文字。
- Mooon 自动读取并重建页面。 竖排、分栏、手写和其他复杂版面会变成一份符合自然阅读顺序的连续文档。
- 结果以 Mooon Doc 打开。 识别出的正文可以编辑,字符认错时直接在上下文中修改。
- 点击添加全文假名。 Mooon 会为重建后的整份文档加入读音。
- 检查疑难读音。 人名或字词读音不合适时,直接在出现的位置修改。
整个过程始终围绕同一份文档完成。你不必把原始识别文字从 OCR 工具搬到假名生成器,再搬进编辑器,并在过程中不断丢失结构和已经完成的修改。
文字识别是基础,假名才是这里的结果
扫描页面变成 Mooon Doc 中可靠的正文后,Mooon 才能为整份文档注音。它使用自建日语词典加强人名、地名、量词和专业词等疑难读音。原文字符错了就修改正文,读音错了就修改假名,两种修正都不需要重新生成整页。
同一份 PDF 也可以在原文旁保留逐段翻译和音频。这些能力仍然属于同一份文档,但这篇文章最核心的结果很简单:一份普通假名生成器根本读不了的扫描件,变成了带全文假名、可以继续修改的文档。
常见问题
PDF 里完全不能划选文字,也能添加假名吗?
可以。Mooon 会读取页面上看得到的日文,将它变成可编辑正文,再由你添加全文假名。
竖排扫描页也能处理吗?
可以。Mooon 会先识别栏位和阅读顺序,再把内容重建为自然的横向文本流。
识别错误的字符可以修改吗?
可以。Mooon Doc 中的正文可以编辑。
人名读音错误可以修改吗?
可以。你可以修改字词或人名的假名,不必重新生成整份文档。
原始扫描文件会被修改吗?
不会。Mooon 会创建一份独立的 Mooon Doc,原始 PDF 保持不变。
给其他工具读不了的扫描件添加假名
上传扫描件,让 Mooon 重建页面,再一键添加全文假名。