企评社

图片文字识别

识别图片中的中英文 · 结果可校对 · 平均置信度可见

识别在你浏览器本地完成,图片不上传、不经过任何服务器
关于引擎与模型(先说明白): 本页点「开始识别」之前不加载任何模型。首次点击时,页面会从本站域名下载识别引擎与语言模型—— 中英文默认包约 8.5MB(引擎约 3.9MB + 中文模型约 1.7MB + 英文模型约 2.9MB),全部来自本站、不经过第三方; 下载完成后识别在浏览器后台线程运行,图片本身一个字节都不出本机,也不发起任何上传请求(可在 Network 面板核验)。 之后再次识别会复用已加载的模型,无需重复下载。

点击选择或拖拽一张图片到此处

JPG / PNG / WebP;单张 ≤100MB、≤2000 万像素;PDF 请先用「PDF 转图片」工具

怎么让识别更准

清晰度是第一变量。印刷体、边缘清楚、对比度高的图识别率最高;模糊、低光、强阴影的图准确率会明显下降。如果原图很大(长边 4000px 以上),可以先用「图片压缩/批量改尺寸」缩到长边 2000px 左右再识别——通常更准也更快,因为模型对小字相对更敏感。

摆正、少干扰。倾斜的文字、大面积装饰花纹、水印压在字上都会拉低准确率。能提前裁掉无关区域就裁掉;截图里的纯色底文字基本都能拿满。

本地识别的真实含义。本页没有"识别服务"——引擎是跑在你浏览器里的开源 OCR(tesseract.js)+ 自托管的语言模型,识别过程不依赖任何服务器;图片不出本机这一点可以用 Network 面板验证:整个识别期间没有任何上传请求,只有首次点击时那一次来自本站的模型下载。

常见问题

「本地识别」是什么意思?

第一次点「开始识别」后,页面才会从本站加载识别引擎与语言模型(约 8.5MB,全部来自本站域名、不经过任何第三方);之后识别在浏览器后台线程里运行,图片不出本机、不经过任何服务器。可在 Network 面板核验:未点按钮前没有任何模型请求,识别过程没有任何上传请求。

支持哪些语言?

简体中文 + 英文(chi_sim + eng,默认)与纯英文(eng,模型更小、速度更快)。手写体、严重模糊、艺术字与低对比度图片的准确率会明显下降。

识别准确率如何?

清晰印刷体下中英文都可用,但可能有错字(形近字、跨行断句尤其容易错);页面给出平均置信度,结果可编辑——正式使用前请人工核对,这是页面明确的口径。

为什么第一次这么慢?

首次要下载并初始化引擎与模型(约 8.5MB),之后识别会复用;网络差可以刷新重试。模型按需加载——你不点按钮,本页就一个模型的字节都不请求。

PDF 可以直接识别吗?

本页只接收图片。PDF 请先用「PDF 转图片」工具转成 JPG / PNG 再识别;扫描版 PDF 的文字层缺失,转图片后识别同样适用。

相关工具