最近给图映加了个 OCR 。合同、订单和后台截图经常需要提取文字,但这类图片直接丢给在线 OCR ,我自己用着也有点顾虑,所以这次还是把模型放进浏览器本地跑。
目前做了三档:普通截图用 6 MB 的极速版;复杂排版和日文用 31 MB 的专业版;小字、低清扫描件再用 138 MB 的极致版。第一次使用需要下载模型,后面直接走浏览器缓存。识别过程放在独立 Worker 里,界面也重新收了一遍,原图、模型和识别结果现在都放在一屏里。

结果会保留文字位置、置信度和表格结构,表格复制到 Excel 时用 Tab 分列,也能导出 TXT 、Markdown 和 JSON 。现在支持中英日及几种常见欧洲语言,韩文暂时还没有。
OCR:https://imging.ai/ocr.html
图映还提供本地图片压缩、常用格式转换、动图制作和视频抠背景。常用处理尽量留在浏览器本地完成,免费、免注册。