← 返回首页

Google Translate 能翻扫描版 PDF 吗?能翻什么、翻不了什么

我们把扫描版 PDF 拖进 Google Translate 的文档翻译,它直接拒收了。这篇说明原因,以及真正能翻扫描件的做法。

·6 分钟读完

用 Google Translate(谷歌翻译)翻扫描件时被拦住,不是你操作有问题。我们把《美国居民膳食指南》的一页扫描件上传到 Google Translate 网页版的“文档”标签页,没有拿到译文,也没有任何识别结果,只在角落弹出一句提示:

Google Translate
Google Translate,上传扫描页之后:“Can't translate scanned PDFs”(无法翻译扫描版 PDF)。 左右滑动对比,点击放大。

提示写得很明确:Google 自己认出了这是扫描件,然后就停下了。所以“Google Translate 能不能翻扫描版 PDF”的答案是:不能直接翻。原因只有一个,它不做 OCR。

为什么 Google Translate 读不了扫描版 PDF

Google Translate 的文档功能只读取 PDF 里已有的文字层。从 Word 导出、由软件生成的电子版 PDF 都有这一层,也就是页面背后真实存在的字符。Google 读出这些字符,翻译后再交回一份文件。

扫描版 PDF 没有文字层。它本质上是一张页面照片,对软件来说每个字都只是图片里的像素。要把图片变回文字,需要 OCR(光学字符识别),而 Google Translate 的文档标签页不会对上传的文件做 OCR。没有文字层,也不会自己生成,它就没有东西可翻。

先判断一下:你的文件是不是扫描件

打开 PDF,用鼠标选一句话。能一个字一个字地选中,说明有文字层,Google Translate 大概能处理;一选就选中整页,或者什么都选不中,那就是扫描件,Google 会拒收。

什么时候能翻,什么时候不行

  • 有文字层的电子版 PDF:文档标签页能翻。分栏和插图一般能保住,公式和表格容易出问题,效果可以看我们的并排实测。
  • 扫描件或纯图片 PDF:直接拒收。没有文字层,它也不会对图片做 OCR。
  • 单张照片:手机上的 Google Translate App 可以用相机或图片模式识别文字,适合路牌、菜单这类短文本,拿不回一份版式完整的文档。

所以,如果你手上是扫描版的合同、证书或成绩单,文档标签页这条路走不通,拍照翻译也给不了你一份排版完整的文件。

用 Google Translate 要三步,用 Reglyph 一步

Google Translate 也不是完全没法翻扫描件,只是要先把 OCR 这一步补上,翻完还要自己收拾版式。两种做法放在一起比较:

Google TranslateReglyph
直接上传扫描件会被拒收,提示“Can't translate scanned PDFs”可以,手机拍的照片也行
不用另外做 OCR要先用 OCR 工具(比如 Acrobat 的“识别文本”)转成带文字的 PDF 或 Word自动识别
翻完不用自己修版式表格、印章、签名栏常常错位或丢失,要对照原件手动修译文排回原来的位置
一共几步3 步:OCR → 上传翻译 → 修版式1 步:上传
需要的工具OCR 工具、Google Translate,往往还要 Word只有 Reglyph

只想看懂一页短文件的意思,Google Translate 这条路也能走通。页数多、结构复杂的文件,比如大多数正式材料,第 3 步最费时间,也最容易出错。

Reglyph 把这三步合成了一步:识别扫描件上的文字,翻译后再排回原来的位置,表格、分栏、插图、印章和数字都留在原处。每天 5 页免费,直接上传试试。

简单说

Google Translate 能翻扫描版 PDF 吗?不能直接翻。它的文档功能只读已有文字层的 PDF,不会对扫描件做 OCR,所以纯图片文档会被拒收。你可以先自己做 OCR 再翻,但版式会丢,需要重新排。想省掉这些步骤,可以用专门处理扫描件的翻译工具,一次完成识别、翻译和排版。

常见问题

Google Translate 能翻扫描版 PDF 吗?

不能直接翻。Google Translate 的文档功能只读取已有文字层的 PDF,也不会对上传的文件做 OCR。扫描版 PDF 是没有文字层的图片,所以会被拒收,提示“Can't translate scanned PDFs”。需要先做 OCR,或者使用能自动识别扫描件的工具。

为什么 Google Translate 提示无法翻译我的 PDF?

多半是因为你的 PDF 是扫描件,也就是一张没有文字层的页面图片。Google Translate 读不到字符,也不会自己把图片转成文字,所以只给出无法翻译的提示,不会生成译文文件。

怎样让 Google Translate 处理扫描件?

先用 OCR 工具(比如 Acrobat 的“识别文本”或免费的在线 OCR)把扫描件转成带文字的 PDF 或 Word 文件,再上传到 Google Translate。缺点是原来的版式会丢失,表格和分栏需要自己重新排。

有没有不丢版式就能翻译扫描件的办法?

有。用专门处理扫描件的翻译工具,它会识别页面文字、翻译,再把译文排回原来的位置。Reglyph 可以直接上传扫描版 PDF,下载回来的译文里表格、插图和印章都还在原处。

按语言查看

使用指南

每天前 5 页免费,无需信用卡;付费方案 $3 起。