截图转文字
不能复制的网页、视频字幕、聊天记录截图粘贴进来,几秒得到可编辑文本。
使用指南
图片文字识别(OCR)用于把截图、照片、扫描图里的印刷文字识别成可以编辑和复制的文本。识别引擎 tesseract.js 直接在浏览器里运行:可以一次拖入多张图片排成队列,也可以直接 Ctrl+V 粘贴刚截的图;每张识别完都给出置信度百分比,结果框里可以顺手改错再复制或下载。
更新于 2026-09-09约 4 分钟读完
图片文字识别(OCR)用于把截图、照片、扫描图里的印刷文字识别成可以编辑和复制的文本。识别引擎 tesseract.js 直接在浏览器里运行:可以一次拖入多张图片排成队列,也可以直接 Ctrl+V 粘贴刚截的图;每张识别完都给出置信度百分比,结果框里可以顺手改错再复制或下载。
它只处理图片。扫描件 PDF 请用「PDF 文字识别」,那边逐页渲染并能输出可搜索 PDF;想对比两种引擎的结果,「双引擎 OCR 对比」走在线接口,隐私特性不同。
| 输入 | 输出 | 说明 |
|---|---|---|
微信聊天截图(中英混排).png |
简中+英 → 可编辑文本,置信度约 90% |
屏幕截图字体规整,效果最好 |
英文发票照片,选「仅英文」 |
比中英混合更少误识别 |
单一语言选对应单语包更准 |
手写笔记 / 竖排古籍图 |
大量错字或「未识别到文字」 |
引擎面向印刷体横排文本 |
不能复制的网页、视频字幕、聊天记录截图粘贴进来,几秒得到可编辑文本。
手机拍的课件批量拖入,逐张识别后打包下载 TXT 做笔记。
合同、证件类图片需要提取文字但不希望经过服务器,本地识别正合适。
第一次要加载识别引擎并读取语言包,进度条会显示「加载识别引擎」「下载语言包」阶段;之后的图片复用同一识别进程,只剩「识别文字」一步。
先检查「识别语言」是否与图片文字一致,再确认图片清晰、文字为横排印刷体;改好后点「开始识别」只会重跑失败或等待中的图片。
手写识别率很低,不建议依赖;表格只输出按行排列的文字,不还原单元格。文字型 PDF 里的表格可以试「PDF 转 Excel」。
图片在浏览器本地识别,不会上传到任何服务器。识别引擎与简中/英文语言包随站点自托管,首次使用会从本站下载;选择繁体中文或日文时语言包从 tesseract.js 的默认公共 CDN 下载。这些请求只获取引擎与语言文件,不包含你的图片内容。
更新于 2026-09-09
本地识别图片中的文字,支持中英日多语言、批量队列、结果可编辑导出
支持拖放、点击选择、Ctrl+V 粘贴截图;可批量添加