选择图片
把截图、扫描件或照片拖到页面上,或从设备中选取一个文件。
用 PP-OCRv6 这款紧凑的 OCR 模型,在浏览器里把图片转成可编辑文字。模型只下载一次(来自魔搭 ModelScope),之后会被浏览器缓存,图片始终不会离开你的设备。
先选择图片,再加载模型。提取文字会复用已加载的模型。
中等档的模型对约为 140 MB(检测 + 识别),外加一本字典。 文件来自公开的模型托管平台,而非 73hi 服务器,浏览器会在下次访问时缓存它们。 整个过程不会上传任何图片。
你的图片会显示在这里
不依赖账号、不排队、也不经过服务器往返,就能读出图片中的文字。
把截图、扫描件或照片拖到页面上,或从设备中选取一个文件。
点击加载模型,等待 PP-OCRv6 就绪,然后点击提取文字。提取过程复用已加载的文件,不会再下载模型。
识别出的文字行会以检测框的形式叠加在图片上,同时变成可编辑文字,可以复制到剪贴板或保存为 .txt 文件。
整条流水线都在页面内完成:先扫描图片找出文字区域,再裁剪每个区域送进识别网络,最后解码出字符。
| 阶段 | 作用 | 运行位置 |
|---|---|---|
| 文字检测 | 在图片中找出每个文字区域,输出为多边形 | 你的浏览器 |
| 裁剪与归一化 | 裁下每个区域,并为其识别做准备 | 你的浏览器 |
| 文字识别 | 用 CTC 解码器配合字典读出字符 | 你的浏览器 |
一次性的代价:中等档的模型对总计约 140 MB。它们来自公开的模型托管平台,而非 73hi 服务器,浏览器会在下次访问时缓存它们。
在 73hi.net 上,本页从魔搭(ModelScope)下载 PP-OCRv6;在 73hi.com 上则从 Hugging Face 下载。两者都提供带跨域许可的文件,73hi 服务器不会存储或转发模型。
不会。图片完全在你的设备上完成解码与识别。只有模型文件会被下载,且浏览器在首次运行后会将其缓存。
PP-OCRv6 针对中英混排以及数字、常用符号做了训练,因此同一页面上的中文、英文和混排文字都能识别。
不需要。模型通过 WebAssembly 在 CPU 上就能运行;本页在浏览器支持时会自动使用 WebGPU(识别更快),不支持则自动回退到 CPU。显卡为可选项,只是速度不同。
中等档的模型对约为 140 MB(检测 + 识别),外加一本字典,因此在网速较慢时首次下载会花一些时间。更小的档位下载与运行更快,但精度略低。
模型直接从公开托管平台拉取并由浏览器缓存,本页没有单独的本地文件选项。清空浏览器缓存后,下次访问会重新下载。