图片 OCR 文字识别(中文 / 英文在线提取)

拖入图片到这里
或点击选择,文字越清晰识别越准
JPG / PNG / WebP / BMP · 单张最大 40 MB
上传图片开始使用
支持中文、英文与中英文混排识别
首次识别需要下载语言数据,之后会被浏览器缓存;中英文混排使用 chi_sim + eng 组合模型
识别前会自动完成缩放、倾斜校正与增强;截图、网页等版面串行或漏字时,切换模式可明显改善
字符数 0 行数 0 平均置信度
隐私说明:识别在浏览器本地完成,图片不会上传服务器。

上传图片本地识别中文、英文与中英文混排,自动缩放纠偏与增强,结果可编辑、复制或下载 TXT

图片 OCR 文字识别:把图片里的文字提取成可编辑文本

截图里的一段说明、拍下来的合同条款、扫描件上的一段正文,想把它们变成可以编辑、搜索、复制的文字,就需要 OCR。本工具把识别能力放进网页,上传图片即可得到可编辑文本,识别过程在浏览器本地完成,图片不会上传服务器。

支持的语言

可选自动识别、中文、英文与中英文四种语言设置。如果确定图片只有中文或只有英文,选择对应单项通常比中英文混合识别更准也更快;不确定时用自动识别,工具会根据情况选择中英文组合模型。首次使用某种语言时需要下载识别语言数据,之后浏览器会缓存,再次识别无需重复下载。

识别模式的选择

识别模式分四档:自动适用于大多数情况;文档文章适合排版规整的正文;截图网页适合屏幕截图与网页长图;单行文字适合只有一行内容的图片(例如验证码、标题条)。截图或网页版面出现串行、漏字时,切换模式往往能明显改善结果。页面在识别前会自动完成缩放、倾斜校正与图像增强,因此手机翻拍、轻微倾斜的图片也能得到较好的结果。

效果不理想时怎么办

识别完成后可以点「重新识别」,工具会依次换用不同的增强策略(如自动增强、高对比度、二值化、白底黑字优化、锐化、原图不做增强)再次识别,不需要重新上传图片,适合在原图质量一般时多试几次挑最好的结果。如果仍然识别不到文字,页面会明确提示未识别到文字,建议换用更清晰、文字更大的图片。为减少误判,低置信度的行以及字符极少且置信度低的碎片会被过滤,避免对无文字图片输出无意义的乱码。

结果编辑与导出

识别结果会显示在文本框中并可以直接修改:识别错的字改掉、多余的分行删掉、按需要重新分段都可以。下方同时给出字符数、行数与平均置信度,便于快速判断结果是否可靠。点「复制文字」把当前内容复制到剪贴板,点「下载 TXT」导出为文本文件——注意下载的是你当前编辑后的内容,而不是识别的原始结果,所以可以先把格式整理好再导出。另有「清空结果」可一键重置文本框。

异常情况处理

当前浏览器不支持运行 OCR 时(需要较新的 Chrome、Edge、Firefox 或 Safari),会给出浏览器提示;识别引擎或语言数据加载失败时,会提示检查网络后重试;识别正在进行时再次点击会被拦截并提示稍候;未上传图片就点击识别会提示先上传图片;识别过程中可以取消。

识别更准的建议

  • 尽量使用文字清晰、光线均匀、正向摆放的图片。
  • 截图优于手机翻拍,能减少摩尔纹与镜头畸变。
  • 拍摄文档时让文字占满画面,避免文字过小。
  • 竖排文字、艺术字、手写体、强水印与极低对比度的图片识别率会明显下降。

使用场景与隐私

适合提取截图中的说明文字、整理扫描合同与票据、把纸质资料转成可搜索文本、从图片报告中复制数据等场景。识别引擎与语言数据在浏览器本地运行,图片不会上传服务器,也不会被保存。

在线图片 OCR:把截图与扫描件转成可编辑文字

上传图片即可在浏览器本地识别文字,支持中文、英文与中英文混排,并提供多种识别模式与预处理策略,识别结果可直接编辑、复制或下载为 TXT。
  • 语言可选自动识别、中文、英文与中英文组合模型,混排内容使用 chi_sim 与 eng
  • 识别模式分自动、文档文章、截图网页与单行文字,版面串行或漏字时可切换
  • 识别前自动缩放、倾斜校正与图像增强,提升低质量图片的识别率
  • 效果不理想时可换用其他增强策略重新识别,无需重新上传图片
  • 低置信行与幻读碎片会被过滤,避免无文字图片输出乱码
  • 结果文本框可直接编辑,并显示字符数、行数与平均置信度,支持复制与下载 TXT
适合提取截图说明、合同条款、扫描件正文与纸质资料整理。首次识别需加载识别引擎与语言数据,之后由浏览器缓存;识别全部在本地完成,图片不会上传服务器。
评论 0
暂无评论,快来发表第一条评论吧
评论内容不能为空
0/255