图片工具 / 28

图片转文字(OCR)

在浏览器中从照片或屏幕截图中提取文字,支持十二种语言,且无需上传。

图片转文字(OCR): TOEA运行一个编译为WebAssembly的完整光学字符识别引擎,读取图片中的字符,并将各行重新组合成段落,让结果读起来像普通文章。 完全在浏览器中本地运行,文件不会上传到服务器。

使用次数
在浏览器中
费用
免费·无需注册
可用性
可直接使用
图片→文本工作台本地处理

完全在浏览器中运行

↥
选择图片

PNG, JPG, WebP, or BMP · 最大30 MB,绝不会上传

选择语言

开始识别前,请选择文本所使用的语言。语言模型提供字符集和词汇,识别引擎会据此核对猜测结果,因此在法语页面上选择英语会丢失或弄乱重音符号,而拉丁字母模型会把中文、日文、韩文、阿拉伯文或俄文文本识别成乱码。对于混合多种语言的页面,请选择主要语言,并预期其他语言会出现错误。

检查合并后的段落

将行合并为段落时,行尾连字符会被视为单词断行并删除,因此真正的复合词如果在那里断开,例如well-后接known,合并后会变成wellknown。各行会用空格连接,这也会在中文或日文文本的每个换行处加入不应存在的空格。对于这些语言,以及表格、列表、地址和代码等换行具有意义的内容,请关闭此选项。对于扫描版PDF,请使用PDF OCR。

使用方法

  1. 选择图片。
  2. 选择文字所使用的语言。
  3. 阅读结果,然后复制或下载。

隐私与限制

您的文件绝不会被上传。识别引擎和语言模型只需下载一次,大小约为10 MB,随后由浏览器缓存;之后所有处理都在您自己的设备上运行。在线OCR服务则相反:它们需要获取您的文档。

相关工具

常见问题

为什么第一次运行速度较慢?

首次运行时需要下载引擎和语言模型,大小约为10 MB。之后浏览器会将它们缓存起来,后续运行会立即开始。

识别准确吗?

清晰的屏幕截图通常几乎可以完美识别。手机拍摄的倾斜页面,或较小、模糊的文字,都会出现错误。结果上方的置信度分数会告诉您当前结果的可靠程度,而且始终建议对照原图检查一遍。

可以识别手写文字吗?

不可以。该引擎使用印刷字体进行训练;手写文字是另一类问题,识别结果会毫无意义。

怎样才能改善结果?

增加像素、让文字更平直并提高对比度。请裁剪到只保留文字的区域,并尽量正对页面拍摄,而不要从倾斜角度拍摄。

免费工具·使用在浏览器中次·无需账户