【图片转文字】是一个免费的在线 OCR 工具,可以提取图片、截图或照片中的文字,转换成你能复制、编辑和下载的文本。整个识别过程都在你的浏览器中完成,图片不会上传到任何服务器。
图片转文字 · OCR
TXT
0 字符图片在你的浏览器中处理,不会上传到服务器。处理身份证、账单、合约这类文件也能放心使用。
Ctrl + V 粘贴。识别完成后,图片上会用绿框标出读到的每一行文字。如果有整段文字没有被框住,说明那个区域识别失败了——通常是因为倾斜、字太小或背景太杂乱。
| 项目 | 支持范围 |
|---|---|
| 图片格式 | JPG、PNG、WebP、GIF、BMP |
| 文件大小 | 每张最多 12 MB |
| 语言 | 简体中文、繁体中文、英文、马来文、日文 |
第一次选择某个语言时,浏览器会下载对应的语言包(中文约 10–15 MB),所以第一次会比较慢。下载完成后,同一次浏览会话内再次识别会快很多。
马来西亚常见的中英巫混排文件(例如政府表格、水电账单)建议分两次处理:中文部分选「简体中文 + 英文」,马来文部分选「马来文」,比一次全选准确得多。
这个工具使用开源的 Tesseract.js 引擎,整个识别过程都在你的浏览器中运行,图片和识别出的文字都不会上传到任何服务器,我们也无从知道你处理过什么内容。
所以即使要处理身份证(MyKad)、银行月结单、发票、医疗记录或合约这类敏感文件,也不必担心资料交给第三方。(附带好处:语言包下载后,离线也能使用。)
OCR 的全称是 Optical Character Recognition,中文称为「光学字符识别」。简单来说,就是把图片中「画」出来的文字形状,还原成电脑真正读得懂、可以复制的文字。
对电脑而言,一张拍着文件的照片和一张风景照没有区别,都只是一堆像素。OCR 做的事情就是把这些像素重新变回字符——书本的某一页、白板上的笔记、PDF 截图、发票、菜单,过去必须重新打一遍,现在点一下就能提取出来。
需要注意的是,OCR 主要是为印刷体设计的,手写文字的准确度会低很多,中文的行书、草书几乎无法识别。
完全免费,不需要注册,也没有次数限制。因为识别在你的浏览器中完成,我们不需要负担服务器成本,所以能持续免费开放。
不会。这个工具使用 Tesseract.js,所有处理都在你的浏览器中运行,图片和识别结果都不会发送到任何服务器。
支持。在语言选项中选择「马来文 Bahasa Melayu」即可。如果文件是中英巫混排,建议分两次识别,准确度会明显更高。
这个工具本身只处理图片,不过我们有另一个【PDF 转文字】工具专门处理 PDF——有文字层的 PDF 秒出,扫描件会自动用 OCR,不必自己逐页截图。
先试着开启「自动放大小字」,并且只选择图片真正用到的语言。如果仍不理想,通常是图片倾斜、太暗或字太小——重新拍一张正面、光线均匀的照片,改善会非常明显。
第一次需要下载语言包(中文约 10–15 MB)和识别引擎。下载完成后,同一次浏览会话内再次识别会快很多。