图片转文字(在线 OCR 文字识别)

图片转文字(在线 OCR 文字识别)

【图片转文字】是一个免费的在线 OCR 工具,可以提取图片、截图或照片中的文字,转换成你能复制、编辑和下载的文本。整个识别过程都在你的浏览器中完成,图片不会上传到任何服务器。

图片转文字 · OCR

把图片拖到这里,或点击选择 支持 JPG、PNG、WebP、GIF、BMP。也可以直接按 Ctrl + V 粘贴截图。
待识别的图片预览

TXT

0 字符
0%

图片在你的浏览器中处理,不会上传到服务器。处理身份证、账单、合约这类文件也能放心使用。

要转成文字的是一份 PDF?用【PDF 转文字】—— 有文字层的 PDF 秒出,扫描件会自动用 OCR,不必自己逐页截图。

使用方法

  1. 放入图片 — 点击拖放区选择图片、直接把图片拖进来,或截图后按 Ctrl + V 粘贴。
  2. 选择图片中的语言 — 语言选得越准确,识别结果越好。
  3. 点击「开始识别」 — 完成后右侧会显示文字,你可以直接编辑、复制,或下载成 .txt 文件。

识别完成后,图片上会用绿框标出读到的每一行文字。如果有整段文字没有被框住,说明那个区域识别失败了——通常是因为倾斜、字太小或背景太杂乱。

支持的格式与语言

项目 支持范围
图片格式 JPG、PNG、WebP、GIF、BMP
文件大小 每张最多 12 MB
语言 简体中文、繁体中文、英文、马来文、日文

第一次选择某个语言时,浏览器会下载对应的语言包(中文约 10–15 MB),所以第一次会比较慢。下载完成后,同一次浏览会话内再次识别会快很多。

提高识别准确度的五个技巧

  1. 拍正一点 — OCR 对倾斜的文字非常敏感。让镜头与纸面平行,效果比任何后期处理都好。
  2. 光线均匀 — 避开阴影、反光和闪光灯光斑,这是中文识别最常见的失败原因。
  3. 字越大越准 — 图片中每个字最好有 20 像素以上的高度。字太小时请开启「自动放大小字」,工具会先放大再识别。
  4. 背景越干净越好 — 花纹底图、水印、表格线都会造成误判。可以先裁掉不需要的部分。
  5. 不要贪心选语言 — 只选图片真正用到的语言。同时选简体和繁体,反而会让两者都变差。

马来西亚常见的中英巫混排文件(例如政府表格、水电账单)建议分两次处理:中文部分选「简体中文 + 英文」,马来文部分选「马来文」,比一次全选准确得多。

你的图片不会离开这台设备

这个工具使用开源的 Tesseract.js 引擎,整个识别过程都在你的浏览器中运行,图片和识别出的文字都不会上传到任何服务器,我们也无从知道你处理过什么内容。

所以即使要处理身份证(MyKad)、银行月结单、发票、医疗记录或合约这类敏感文件,也不必担心资料交给第三方。(附带好处:语言包下载后,离线也能使用。)

OCR 是什么?

OCR 的全称是 Optical Character Recognition,中文称为「光学字符识别」。简单来说,就是把图片中「画」出来的文字形状,还原成电脑真正读得懂、可以复制的文字。

对电脑而言,一张拍着文件的照片和一张风景照没有区别,都只是一堆像素。OCR 做的事情就是把这些像素重新变回字符——书本的某一页、白板上的笔记、PDF 截图、发票、菜单,过去必须重新打一遍,现在点一下就能提取出来。

需要注意的是,OCR 主要是为印刷体设计的,手写文字的准确度会低很多,中文的行书、草书几乎无法识别。

常见问题

图片转文字需要付费吗?要注册吗?

完全免费,不需要注册,也没有次数限制。因为识别在你的浏览器中完成,我们不需要负担服务器成本,所以能持续免费开放。

我的图片会被上传或被别人看到吗?

不会。这个工具使用 Tesseract.js,所有处理都在你的浏览器中运行,图片和识别结果都不会发送到任何服务器。

支持马来文吗?

支持。在语言选项中选择「马来文 Bahasa Melayu」即可。如果文件是中英巫混排,建议分两次识别,准确度会明显更高。

支持 PDF 吗?

这个工具本身只处理图片,不过我们有另一个【PDF 转文字】工具专门处理 PDF——有文字层的 PDF 秒出,扫描件会自动用 OCR,不必自己逐页截图。

识别结果不准确怎么办?

先试着开启「自动放大小字」,并且只选择图片真正用到的语言。如果仍不理想,通常是图片倾斜、太暗或字太小——重新拍一张正面、光线均匀的照片,改善会非常明显。

为什么第一次识别要等这么久?

第一次需要下载语言包(中文约 10–15 MB)和识别引擎。下载完成后,同一次浏览会话内再次识别会快很多。

其他你可能用得上的工具