需要把收據、公告、截圖、菜單或掃描頁面的文字帶走時,直接上傳圖片即可。OCR 會建立可編輯的草稿,方便複製、引用或重複使用,不必重新打字。
OCR 引擎會先在瀏覽器中載入您選擇的語言模型,再讀取圖片文字。讓語言設定貼近圖片內容,可以讓姓名、重音符號、假名或中文字得到更乾淨的辨識結果。
辨識前可旋轉側向文字,或切換原始色彩、灰階與高對比。校對階段會標出信心較低、建議核對的區域,但不會自動改字;請逐行修正草稿後再複製或下載。
關於這個主題的常見疑問與實用解答。
選擇或拖入圖片,挑好辨識語言,工具就會在瀏覽器裡讀取圖片。結果會以校對草稿呈現,可以逐行修改,再複製、下載成 .txt 檔或分享。之後想數字數或字元數,把文字貼進「文字統計」即可。
支援 JPG、PNG、WebP、BMP、TIFF、GIF,一次處理一張圖片。檔案上限 10 MB,圖片本身最多 25 百萬像素;超過時會顯示該圖實際的像素尺寸並要求換一張。
選和圖片上文字相符的語言:英文、繁體中文、簡體中文、日文、韓文、西班牙文或法文。中英夾雜的頁面請選「英文 + 繁體中文」或「英文 + 簡體中文」,一次讀取兩種文字。辨識開始前會先把語言模型載入瀏覽器,因此第一次使用某個語言會比較久。
不太可靠。辨識模型是以印刷體與電腦字型訓練的,因此列印文件、截圖、招牌、收據與書頁的效果最好。手寫筆記(尤其連筆或字跡不工整時)常會漏字或認錯,任何前處理選項都改變不了這一點。
不會。辨識完全在你的瀏覽器裡進行,圖片不會離開裝置,也不會被送到任何地方。唯一會從網路取得的是語言模型,流量方向是往瀏覽器來,而不是把圖片送出去。
不行,這個工具只接受圖片。如果 PDF 本身已有文字層,用「PDF 轉文字」可以直接取出文字、不需要 OCR。若是掃描或純圖片的 PDF,請先把該頁匯出或截成圖片,再拿到這裡辨識。
先確認辨識語言選對了,再把歪斜的頁面旋轉正,並在原始色彩、灰階與高對比之間切換後重新辨識;文字清晰、對比高時效果最好。校對階段會標出信心最低的區域並顯示信心分數,但不會自動替你修正,請逐行編輯草稿。排版也不會還原:分欄、表格與圖片都會以純文字輸出。