把微信里挺好用的图片 OCR 交互搬到了 Chrome,做了个 SelectSight

之前在微信里体验过的功能,图片里的文字可以直接识别、选择、复制。感觉这个交互放到浏览器里应该也挺方便,所以自己做了一个 Chrome 插件 SelectSight。

使用比较简单:把鼠标移到网页里的图片上,就会自动开始本地识别,识别过程中右上角会有一个 loading 动画。

速度主要取决于图片大小:小图基本没什么感觉,比较大的图片可能需要稍微等一会儿。 识别完成后,就可以直接选择图片里的文字进行复制。也支持快捷键截图进行识别。

目前主要分成两部分:

  • 本地识别:免费

    • 使用 Paddle OCR
    • 图片不会上传服务器
    • 适合普通文字识别和复制
    • 只输出纯文本,不保留原来的格式
  • 增强识别:收费

    • 适合公式、表格、代码、文档等内容
    • 会尽量保留原始结构和格式
    • 支持 Markdown 、Word 等格式的预览和导出
    • 需要上传图片到服务器处理,图片只用于当次识别,不做保存

确实现在类似的 OCR 插件确实已经很多了,但主要还是想把体验做得更无感一些:

看到图片 → 鼠标移上去 → 等待识别 → 直接选择和复制。

小图片基本就是移上去之后直接用,大图片则可能需要等一下。

主页:

https://selectsight.lol/

Chrome 商店:

https://chromewebstore.google.com/detail/selectsight/acpnlpaaaihjngcanakmkiabdeaepooc

目前还在继续迭代,想找一些人实际用用看。

有兴趣的话可以在楼里留下邮箱,担心被爬的话也可以留 base64 后的邮箱,赠送 300 次增强识别额度。

有什么识别不准、交互别扭,或者某些网站不好用的地方,都欢迎直接反馈。