【圖片轉文字】係一個免費嘅線上 OCR 工具,可以將圖片、截圖或者相片入面嘅文字抽取出嚟,變成你可以複製、編輯同下載嘅文字。成個識別過程喺你部機嘅瀏覽器完成,圖片唔會上載到任何伺服器。
圖片轉文字 · OCR
TXT
0 字元圖片喺你部機嘅瀏覽器處理,唔會上載到伺服器。處理身分證、單據、合約呢類文件都用得安心。
Ctrl + V 貼上。識別完之後,圖片上面會用綠色框標示佢讀到嘅每一行文字。如果有成段字冇被框住,即係嗰度識別失敗咗——通常係傾斜、太細或者背景太花。
| 項目 | 支援範圍 |
|---|---|
| 圖片格式 | JPG、PNG、WebP、GIF、BMP |
| 檔案大小 | 每張最多 12 MB |
| 語言 | 繁體中文、簡體中文、英文、日文、韓文 |
第一次揀某個語言,瀏覽器會下載對應嘅語言檔(中文大約 10–15 MB),所以第一次會慢啲。下載完之後同一次 session 內再識別就快好多。
呢個工具用開源嘅 Tesseract.js 引擎,整個識別過程都喺你部機嘅瀏覽器行,圖片同識別出嚟嘅文字都唔會上載去任何伺服器,我哋亦都睇唔到你處理過咩。
所以就算你要處理身分證、銀行月結單、單據、醫療紀錄或者合約呢啲敏感文件,都唔使擔心資料交咗畀第三方。(副作用:語言檔下載咗之後,其實斷網都用得。)
OCR 全寫係 Optical Character Recognition,中文叫「光學字元識別」。簡單講,就係將圖片入面「畫」出嚟嘅文字形狀,分析返做電腦真正讀得明、複製得到嘅文字。
對電腦嚟講,一張影住文件嘅相同一張風景相冇分別,都係一堆像素。OCR 做嘅就係將呢啲像素還原做字元——書入面一版、白板上嘅筆記、PDF 截圖、收據、餐牌,以前要自己打返一次,而家撳一撳就抽得出。
要留意 OCR 主要係為印刷體設計,手寫字準確度會低好多,尤其係中文行書草書,基本上識別唔到。
完全免費,唔使註冊,亦冇次數限制。因為識別喺你部機嘅瀏覽器完成,我哋唔使負擔伺服器成本,所以可以一直免費開放。
唔會。呢個工具用 Tesseract.js,所有處理都喺你部機嘅瀏覽器行,圖片同識別結果都唔會傳去任何伺服器。
呢個工具本身只處理圖片,不過我哋有另一個【PDF 轉文字】工具專門處理 PDF——有文字層嘅 PDF 秒出,掃描件會自動用 OCR,唔使你自己逐頁截圖。
先試吓開「自動放大細字」,同埋淨係揀圖片真正用到嘅語言。如果仲係唔得,通常係圖片傾斜、太暗或者字太細——重新影一張正面、光線平均嘅相,改善會好明顯。
可以試,但準確度好參差。呢類 OCR 引擎主要為印刷體訓練,工整嘅正楷手寫字有機會讀到部分,行書草書就基本上識別唔到。
第一次要下載語言檔(中文大約 10–15 MB)同識別引擎。下載完之後,同一次 session 內再識別會快好多。