目前市面上的图片翻译接口都是收费的,不过效果确实很好,可以在原图的基础上进行翻译,然后返回翻译后的图片。但接口真的是太贵了。
于是我换了一个思路,使用免费的 ZOCR 识别方案 提取文字,然后再结合 AI 大模型进行处理,显著降低了成本。
具体的流程是:前端将图片转为 WEBP 压缩体积 -> ZOCR 提取文字 -> 大模型清洗 -> 修复 -> 合句 -> 输出双语对照。
效果如下:


目前市面上的图片翻译接口都是收费的,不过效果确实很好,可以在原图的基础上进行翻译,然后返回翻译后的图片。但接口真的是太贵了。
于是我换了一个思路,使用免费的 ZOCR 识别方案 提取文字,然后再结合 AI 大模型进行处理,显著降低了成本。
具体的流程是:前端将图片转为 WEBP 压缩体积 -> ZOCR 提取文字 -> 大模型清洗 -> 修复 -> 合句 -> 输出双语对照。
效果如下:


1
dimlau 8h 59m ago 漫画的话就识别不准了
|