免费在线图片文字提取(OCR)

用 PP-OCRv6 这款紧凑的 OCR 模型,在浏览器里把图片转成可编辑文字。模型只下载一次(来自魔搭 ModelScope),之后会被浏览器缓存,图片始终不会离开你的设备。

先选择图片,再加载模型。提取文字会复用已加载的模型。

中等档的模型对约为 140 MB(检测 + 识别),外加一本字典。 文件来自公开的模型托管平台,而非 73hi 服务器,浏览器会在下次访问时缓存它们。 整个过程不会上传任何图片。

你的图片会显示在这里

三个简单步骤

如何在线提取图片里的文字

不依赖账号、不排队、也不经过服务器往返,就能读出图片中的文字。

1

选择图片

把截图、扫描件或照片拖到页面上,或从设备中选取一个文件。

2

加载模型

点击加载模型,等待 PP-OCRv6 就绪,然后点击提取文字。提取过程复用已加载的文件,不会再下载模型。

3

复制或下载

识别出的文字行会以检测框的形式叠加在图片上,同时变成可编辑文字,可以复制到剪贴板或保存为 .txt 文件。

工作原理

紧凑的 OCR 模型,完全运行在你的设备上

整条流水线都在页面内完成:先扫描图片找出文字区域,再裁剪每个区域送进识别网络,最后解码出字符。

阶段 作用 运行位置
文字检测 在图片中找出每个文字区域,输出为多边形 你的浏览器
裁剪与归一化 裁下每个区域,并为其识别做准备 你的浏览器
文字识别 用 CTC 解码器配合字典读出字符 你的浏览器

一次性的代价:中等档的模型对总计约 140 MB。它们来自公开的模型托管平台,而非 73hi 服务器,浏览器会在下次访问时缓存它们。

常见问题

图片文字提取常见问题

模型是从哪里来的?

在 73hi.net 上,本页从魔搭(ModelScope)下载 PP-OCRv6;在 73hi.com 上则从 Hugging Face 下载。两者都提供带跨域许可的文件,73hi 服务器不会存储或转发模型。

我的图片会被上传吗?

不会。图片完全在你的设备上完成解码与识别。只有模型文件会被下载,且浏览器在首次运行后会将其缓存。

支持哪些语言?

PP-OCRv6 针对中英混排以及数字、常用符号做了训练,因此同一页面上的中文、英文和混排文字都能识别。

需要显卡吗?

不需要。模型通过 WebAssembly 在 CPU 上就能运行;本页在浏览器支持时会自动使用 WebGPU(识别更快),不支持则自动回退到 CPU。显卡为可选项,只是速度不同。

为什么首次加载较慢?

中等档的模型对约为 140 MB(检测 + 识别),外加一本字典,因此在网速较慢时首次下载会花一些时间。更小的档位下载与运行更快,但精度略低。

可以使用自己已经下载的文件吗?

模型直接从公开托管平台拉取并由浏览器缓存,本页没有单独的本地文件选项。清空浏览器缓存后,下次访问会重新下载。