图片文字识别
识别图片中的中英文 · 结果可校对 · 平均置信度可见
点击选择或拖拽一张图片到此处
JPG / PNG / WebP;单张 ≤100MB、≤2000 万像素;PDF 请先用「PDF 转图片」工具
识别结果可能有错字(形近字、跨行断句尤易错),正式使用前请逐字核对。
怎么让识别更准
清晰度是第一变量。印刷体、边缘清楚、对比度高的图识别率最高;模糊、低光、强阴影的图准确率会明显下降。如果原图很大(长边 4000px 以上),可以先用「图片压缩/批量改尺寸」缩到长边 2000px 左右再识别——通常更准也更快,因为模型对小字相对更敏感。
摆正、少干扰。倾斜的文字、大面积装饰花纹、水印压在字上都会拉低准确率。能提前裁掉无关区域就裁掉;截图里的纯色底文字基本都能拿满。
本地识别的真实含义。本页没有"识别服务"——引擎是跑在你浏览器里的开源 OCR(tesseract.js)+ 自托管的语言模型,识别过程不依赖任何服务器;图片不出本机这一点可以用 Network 面板验证:整个识别期间没有任何上传请求,只有首次点击时那一次来自本站的模型下载。
常见问题
第一次点「开始识别」后,页面才会从本站加载识别引擎与语言模型(约 8.5MB,全部来自本站域名、不经过任何第三方);之后识别在浏览器后台线程里运行,图片不出本机、不经过任何服务器。可在 Network 面板核验:未点按钮前没有任何模型请求,识别过程没有任何上传请求。
简体中文 + 英文(chi_sim + eng,默认)与纯英文(eng,模型更小、速度更快)。手写体、严重模糊、艺术字与低对比度图片的准确率会明显下降。
清晰印刷体下中英文都可用,但可能有错字(形近字、跨行断句尤其容易错);页面给出平均置信度,结果可编辑——正式使用前请人工核对,这是页面明确的口径。
首次要下载并初始化引擎与模型(约 8.5MB),之后识别会复用;网络差可以刷新重试。模型按需加载——你不点按钮,本页就一个模型的字节都不请求。
本页只接收图片。PDF 请先用「PDF 转图片」工具转成 JPG / PNG 再识别;扫描版 PDF 的文字层缺失,转图片后识别同样适用。