需要把收据、公告、截图、菜单或扫描页面的文字带走时,直接上传图片即可。OCR 会建立可编辑的草稿,方便复制、引用或重复使用,不必重新打字。
OCR 引擎会先在浏览器中载入你选择的语言模型,再读取图片文字。让语言设置贴近图片内容,可以让姓名、重音符号、假名或中文字符得到更干净的识别结果。
识别前可旋转侧向文字,或切换原始色彩、灰度与高对比度。校对阶段会标出置信度较低、建议核对的区域,但不会自动改字;请逐行修正草稿后再复制或下载。
关于这个主题的常见疑问与实用解答。
选择或拖入图片,挑好识别语言,工具就会在浏览器里读取图片。结果会以校对草稿呈现,可以逐行修改,再复制、下载成 .txt 文件或分享。之后想数字数或字符数,把文字粘贴进“文字统计”即可。
支持 JPG、PNG、WebP、BMP、TIFF、GIF,一次处理一张图片。文件上限 10 MB,图片本身最多 25 百万像素;超过时会显示该图实际的像素尺寸并要求换一张。
选和图片上文字相符的语言:英文、繁体中文、简体中文、日文、韩文、西班牙文或法文。中英夹杂的页面请选“英文 + 繁体中文”或“英文 + 简体中文”,一次读取两种文字。识别开始前会先把语言模型载入浏览器,因此第一次使用某个语言会比较久。
不太可靠。识别模型是以印刷体与电脑字体训练的,因此打印文件、截图、招牌、收据与书页的效果最好。手写笔记(尤其连笔或字迹不工整时)常会漏字或认错,任何预处理选项都改变不了这一点。
不会。识别完全在你的浏览器里进行,图片不会离开设备,也不会被送到任何地方。唯一会从网络取得的是语言模型,流量方向是往浏览器来,而不是把图片送出去。
不行,这个工具只接受图片。如果 PDF 本身已有文字层,用“PDF 转文字”可以直接取出文字、不需要 OCR。若是扫描或纯图片的 PDF,请先把该页导出或截成图片,再拿到这里识别。
先确认识别语言选对了,再把歪斜的页面旋转正,并在原始色彩、灰度与高对比度之间切换后重新识别;文字清晰、对比高时效果最好。校对阶段会标出信心最低的区域并显示信心分数,但不会自动替你修正,请逐行编辑草稿。排版也不会还原:分栏、表格与图片都会以纯文字输出。