Image to Text
圖片轉文字 OCR
把截圖、拍下來的文件或掃描檔裡的字抓出來,變成可以複製、可以搜尋的文字。 支援繁中、簡中、英日韓,全部在你的瀏覽器裡完成,圖片不會上傳。
- 01放圖片截圖、拍下來的文件、掃描檔都可以,一次放很多張。
- 02選語言繁中、繁中+英文、英文、簡中、日文、韓文。
- 03辨識在你的電腦上跑,看得到進度。
- 04複製或下載一鍵複製全部,或存成 TXT。
圖片轉文字
載入工具
這個工具可以做什麼
可以用在什麼地方
- 把紙本文件、合約、講義拍下來轉成可以編輯、可以搜尋的文字。
- 截圖裡不能複製的文字(PDF 轉圖、簡報、看板、錯誤訊息)。
- 書本或筆記的內容轉成文字檔存檔。
- 收據、名片、標籤上的字。
辨識品質
- 用 Tesseract(Apache-2.0 授權)的瀏覽器版本,支援繁中、簡中、英文、日文、韓文。
- 中文字之間被插進去的空白會自動清掉,直接複製就能用。
- 每一行都有信心度,雜訊行可以用滑桿一次濾掉。
- 會告訴你這次辨識的品質好不好 —— 品質差通常是原圖太小、歪斜或模糊,重拍比調參數有效。
在哪裡處理
- 全部在你的瀏覽器裡完成,圖片不會上傳到任何伺服器。
- 文件類的內容常常有個資或商業機密,這點比辨識率更重要。
- 不用註冊、沒有張數限制。
- 語言資料下載過就留在瀏覽器裡,之後再用不必重新下載。
常見問題
- 圖片會上傳嗎?
- 不會。辨識引擎與語言資料是下載到你的瀏覽器裡執行的,圖片本身從頭到尾沒有離開這台電腦。
- 辨識得不準怎麼辦?
- 先確認選對語言了 —— 中英夾雜的文件用「繁體中文 + 英文」差很多。再來是原圖:文字愈大愈清楚愈好,拍的時候盡量正對、不要歪斜、光線平均、不要有陰影。太小的字放大再拍會比放大圖檔有效。
- 為什麼中文比英文慢、也比較容易出錯?
- 中文的字集有好幾千個字,模型與語言資料都比英文大得多,運算量也大。這是所有 OCR 都會遇到的情況,不是這個工具特有的。
- 可以辨識手寫字嗎?
- 幾乎不行。Tesseract 是針對印刷體訓練的,手寫的辨識率很低。
- 排版會保留嗎?
- 會保留斷行,但不會保留表格、欄位與字體樣式。輸出是純文字。
- 可以直接轉 PDF 嗎?
- 目前吃的是圖片。PDF 請先用站上的「PDF 工具」把頁面轉成圖片,再放進來辨識。
- 第一次很慢是正常的嗎?
- 是。第一次要下載辨識核心(約 4 MB)與語言資料(英文 11 MB、繁體中文 27 MB),之後瀏覽器會留著,再用就快很多。中文的資料比較大,第一次請耐心等一下。
辨識結果可能有誤,重要文件請對照原圖再使用。
請只處理你有權使用的圖片。