十年前,在外文文本中遇到一个不熟悉的单词,意味着停下来、打开词典、手动搜索、然后找回原来看到哪里。如果这段文字是一个实物——菜单、路标、产品标签——阻力就更大了。OCR和拍照翻译应用消除了大部分这种阻力。以下是它们如何改变语言学习。
OCR对语言学习者意味着什么
OCR代表光学字符识别——将文字图像转换为机器可读文本的技术。对语言学习者来说,这意味着将手机摄像头对准任何语言的任何文字,将其转换为翻译应用可以处理的内容。
在手机上实现实用OCR之前,拍照翻译既慢又不可靠。Google Translate、Microsoft Lens和TransLearn等应用中的现代OCR已足够快,可以实时使用——你对准,它识别,你得到翻译。
真实世界的文字作为学习资源
OCR带来的最重要变化是将真实世界的文字转变为学习资源。语言学习者现在可以从以下内容获取词汇:
- 目标语言的餐厅菜单
- 街道标识和公告
- 产品包装和标签
- 在目标国家找到的报纸和杂志
- 没有数字版的实体书籍
- 名片、传单和手写便条
这是一个质的变化。以前,学习者只能学习精心编排的材料。现在,目标语言的整个实体环境都成了学习材料。
拍照翻译的实际使用方式
你打开翻译应用中的相机功能,对准文字,应用要么实时叠加翻译(Google Translate的AR模式),要么拍摄图像供逐词点击翻译。不同应用处理方式各异:
Google Translate(相机模式):实时叠加翻译。最适合快速理解不熟悉的文字,不会自动保存词汇。
TransLearn(拍照捕捉):拍下文字,然后点击单个单词进行翻译。单词可以直接保存到词汇列表中,通过推送通知复习。比实时叠加模式更适合有意识地积累词汇。
Microsoft Lens:干净地捕捉并OCR文档。最适合文章或整页等较长文本,可导出到Word或OneNote做进一步处理。
实体书的OCR应用
许多有价值的语言学习文本只有实体形式:老文学作品、绝版分级读物、参考书。OCR让你拍摄书页并从中创建可读的数字文本。质量取决于字体和图像质量,但现代OCR能可靠地处理大多数印刷书籍。
拍照翻译的局限性
OCR翻译在处理单个词语和简单句子方面表现不错,但在以下情况下可靠性降低:
- 高度风格化或装饰性字体
- 手写文字(在改进中,但仍不完美)
- 低对比度文字(浅色背景上的浅色文字)
- 非常小的文字
- 混有文字和图片的复杂页面布局
对学习者而言,实际意义是:相信拍照翻译处理词语和短语,对异常结果进行核实,不要单独依赖它处理重要文件。
拍照翻译作为词汇积累工具
拍照翻译最有效的语言学习用途是保存词汇。当你点击一个翻译好的单词并保存到词汇列表时,该单词就进入你的复习队列,并通过间隔重复得到强化。随着时间推移,习惯性通过拍照翻译保存单词的学习者,会建立一个与真实世界语境深度关联的词汇列表——这使记忆比从通用单词列表中学习更为持久。