截圖轉文字
不能複製的網頁、視頻字幕、聊天記錄截圖粘貼進來,幾秒得到可編輯文本。
使用指南
圖片文字識別(OCR)用於把截圖、照片、掃描圖裏的印刷文字識別成可以編輯和複製的文本。識別引擎 tesseract.js 直接在瀏覽器裏運行:可以一次拖入多張圖片排成隊列,也可以直接 Ctrl+V 粘貼剛截的圖;每張識別完都給出置信度百分比,結果框裏可以順手改錯再複製或下載。
更新於 2026-09-09约 4 分钟读完
圖片文字識別(OCR)用於把截圖、照片、掃描圖裏的印刷文字識別成可以編輯和複製的文本。識別引擎 tesseract.js 直接在瀏覽器裏運行:可以一次拖入多張圖片排成隊列,也可以直接 Ctrl+V 粘貼剛截的圖;每張識別完都給出置信度百分比,結果框裏可以順手改錯再複製或下載。
它只處理圖片。掃描件 PDF 請用「PDF 文字識別」,那邊逐頁渲染並能輸出可搜索 PDF;想對比兩種引擎的結果,「雙引擎 OCR 對比」走在線接口,隱私特性不同。
| 輸入 | 輸出 | 説明 |
|---|---|---|
微信聊天截图(中英混排).png |
简中+英 → 可编辑文本,置信度约 90% |
屏幕截圖字體規整,效果最好 |
英文发票照片,选「仅英文」 |
比中英混合更少误识别 |
單一語言選對應單語包更準 |
手写笔记 / 竖排古籍图 |
大量错字或「未识别到文字」 |
引擎面向印刷體橫排文本 |
不能複製的網頁、視頻字幕、聊天記錄截圖粘貼進來,幾秒得到可編輯文本。
手機拍的課件批量拖入,逐張識別後打包下載 TXT 做筆記。
合同、證件類圖片需要提取文字但不希望經過服務器,本地識別正合適。
第一次要加載識別引擎並讀取語言包,進度條會顯示「加載識別引擎」「下載語言包」階段;之後的圖片複用同一識別進程,只剩「識別文字」一步。
先檢查「識別語言」是否與圖片文字一致,再確認圖片清晰、文字為橫排印刷體;改好後點「開始識別」只會重跑失敗或等待中的圖片。
手寫識別率很低,不建議依賴;表格只輸出按行排列的文字,不還原單元格。文字型 PDF 裏的表格可以試「PDF 轉 Excel」。
圖片在瀏覽器本地識別,不會上傳到任何服務器。識別引擎與簡中/英文語言包隨站點自託管,首次使用會從本站下載;選擇繁體中文或日文時語言包從 tesseract.js 的默認公共 CDN 下載。這些請求只獲取引擎與語言文件,不包含你的圖片內容。
更新於 2026-09-09
本地識別圖片中的文字,支持中英日多語言、批量隊列、結果可編輯導出
此工具尚未完整翻譯,部分內容使用源文或回退語言。
支持拖放、點擊選擇、Ctrl+V 粘貼截圖;可批量添加