Image to Text

圖片轉文字 OCR

更新紀錄

  1. V1.02026-09-24

    • 新增線上工具:圖片轉文字 OCR

把截圖、拍下來的文件或掃描檔裡的字抓出來,變成可以複製、可以搜尋的文字。 支援繁中、簡中、英日韓,全部在你的瀏覽器裡完成,圖片不會上傳。

  1. 01放圖片截圖、拍下來的文件、掃描檔都可以,一次放很多張。
  2. 02選語言繁中、繁中+英文、英文、簡中、日文、韓文。
  3. 03辨識在你的電腦上跑,看得到進度。
  4. 04複製或下載一鍵複製全部,或存成 TXT。

圖片轉文字

載入工具

這個工具可以做什麼

可以用在什麼地方

  • 把紙本文件、合約、講義拍下來轉成可以編輯、可以搜尋的文字。
  • 截圖裡不能複製的文字(PDF 轉圖、簡報、看板、錯誤訊息)。
  • 書本或筆記的內容轉成文字檔存檔。
  • 收據、名片、標籤上的字。

辨識品質

  • 用 Tesseract(Apache-2.0 授權)的瀏覽器版本,支援繁中、簡中、英文、日文、韓文。
  • 中文字之間被插進去的空白會自動清掉,直接複製就能用。
  • 每一行都有信心度,雜訊行可以用滑桿一次濾掉。
  • 會告訴你這次辨識的品質好不好 —— 品質差通常是原圖太小、歪斜或模糊,重拍比調參數有效。

在哪裡處理

  • 全部在你的瀏覽器裡完成,圖片不會上傳到任何伺服器。
  • 文件類的內容常常有個資或商業機密,這點比辨識率更重要。
  • 不用註冊、沒有張數限制。
  • 語言資料下載過就留在瀏覽器裡,之後再用不必重新下載。

常見問題

圖片會上傳嗎?
不會。辨識引擎與語言資料是下載到你的瀏覽器裡執行的,圖片本身從頭到尾沒有離開這台電腦。
辨識得不準怎麼辦?
先確認選對語言了 —— 中英夾雜的文件用「繁體中文 + 英文」差很多。再來是原圖:文字愈大愈清楚愈好,拍的時候盡量正對、不要歪斜、光線平均、不要有陰影。太小的字放大再拍會比放大圖檔有效。
為什麼中文比英文慢、也比較容易出錯?
中文的字集有好幾千個字,模型與語言資料都比英文大得多,運算量也大。這是所有 OCR 都會遇到的情況,不是這個工具特有的。
可以辨識手寫字嗎?
幾乎不行。Tesseract 是針對印刷體訓練的,手寫的辨識率很低。
排版會保留嗎?
會保留斷行,但不會保留表格、欄位與字體樣式。輸出是純文字。
可以直接轉 PDF 嗎?
目前吃的是圖片。PDF 請先用站上的「PDF 工具」把頁面轉成圖片,再放進來辨識。
第一次很慢是正常的嗎?
是。第一次要下載辨識核心(約 4 MB)與語言資料(英文 11 MB、繁體中文 27 MB),之後瀏覽器會留著,再用就快很多。中文的資料比較大,第一次請耐心等一下。

辨識結果可能有誤,重要文件請對照原圖再使用。
請只處理你有權使用的圖片。