图片工具 / 28
图片转文字(OCR)
在浏览器中从照片或屏幕截图中提取文字,支持十二种语言,且无需上传。
图片转文字(OCR): TOEA运行一个编译为WebAssembly的完整光学字符识别引擎,读取图片中的字符,并将各行重新组合成段落,让结果读起来像普通文章。 完全在浏览器中本地运行,文件不会上传到服务器。
- 类别
- 图片工具
- 使用次数
- 在浏览器中
- 费用
- 免费·无需注册
- 可用性
- 可直接使用
完全在浏览器中运行
PNG, JPG, WebP, or BMP · 最大30 MB,绝不会上传
选择语言
开始识别前,请选择文本所使用的语言。语言模型提供字符集和词汇,识别引擎会据此核对猜测结果,因此在法语页面上选择英语会丢失或弄乱重音符号,而拉丁字母模型会把中文、日文、韩文、阿拉伯文或俄文文本识别成乱码。对于混合多种语言的页面,请选择主要语言,并预期其他语言会出现错误。
检查合并后的段落
将行合并为段落时,行尾连字符会被视为单词断行并删除,因此真正的复合词如果在那里断开,例如well-后接known,合并后会变成wellknown。各行会用空格连接,这也会在中文或日文文本的每个换行处加入不应存在的空格。对于这些语言,以及表格、列表、地址和代码等换行具有意义的内容,请关闭此选项。对于扫描版PDF,请使用PDF OCR。
使用方法
- 选择图片。
- 选择文字所使用的语言。
- 阅读结果,然后复制或下载。
隐私与限制
您的文件绝不会被上传。识别引擎和语言模型只需下载一次,大小约为10 MB,随后由浏览器缓存;之后所有处理都在您自己的设备上运行。在线OCR服务则相反:它们需要获取您的文档。
相关工具
常见问题
为什么第一次运行速度较慢?
首次运行时需要下载引擎和语言模型,大小约为10 MB。之后浏览器会将它们缓存起来,后续运行会立即开始。
识别准确吗?
清晰的屏幕截图通常几乎可以完美识别。手机拍摄的倾斜页面,或较小、模糊的文字,都会出现错误。结果上方的置信度分数会告诉您当前结果的可靠程度,而且始终建议对照原图检查一遍。
可以识别手写文字吗?
不可以。该引擎使用印刷字体进行训练;手写文字是另一类问题,识别结果会毫无意义。
怎样才能改善结果?
增加像素、让文字更平直并提高对比度。请裁剪到只保留文字的区域,并尽量正对页面拍摄,而不要从倾斜角度拍摄。
免费工具·使用在浏览器中次·无需账户