AI 图像识别
OCR Buddy
忠实、100%本地的OCR Chrome扩展,支持文本、代码、公式和表格,无幻觉。
OCR Buddy
什么是 OCR Buddy?
OCR Buddy是一款免费、开源的Chrome扩展,使用PP-OCRv5和ONNX Runtime Web在设备上完全执行OCR,支持文本、代码、公式(LaTeX)和表格,无需将数据发送到任何服务器。
OCR Buddy 与相似工具比较
| 计价模式 | 免费 | 免费, Freemium | 免费, Freemium | 付费 |
| 免费额度 | ||||
| 主要功能 |
|
|
|
|
| 优点 |
|
|
|
|
| 缺点 |
|
|
|
|
| 适合对象 |
|
|
|
|
如何使用 OCR Buddy?
- 1从Chrome网上应用店安装OCR Buddy扩展。
- 2选择区域、视口或捕获整个页面。
- 3选择读取模式:文本/代码、公式或表格。
- 4通过源裁剪对比检查提取结果。
- 5将输出复制或下载为纯文本、Markdown或LaTeX。
OCR Buddy 主要功能
- 区域、视口和全页捕获
- 文本/代码OCR,带语法高亮和布局重建
- 公式转LaTeX,带KaTeX渲染用于验证
- 表格转Markdown,使用几何重建
- 通过DOM结构混合图像OCR实现页面转Markdown
- 100%本地处理,数据不离开设备
- 多语言支持(拉丁、中日韩、西里尔等)
- 低置信度单词标记和源裁剪显示
OCR Buddy 使用场景
- 从暂停视频中提取代码
- 从PDF或图像中OCR文本
- 将数学公式转换为LaTeX
- 将表格截图转换为Markdown
- 捕获整个网页作为干净Markdown供LLM使用
OCR Buddy 价格与免费额度
OCR Buddy 目前采用 免费 模式。
此工具完全免费使用
OCR Buddy 优缺点
优点
- 隐私优先:所有处理在设备上完成
- 无幻觉文本,忠实转录
- 支持多种捕获模式和读取模式
- 内置模型可离线使用
- 开源,许可证宽松
缺点
- 仅限Chrome(需要Worker中的WebGPU)
- 不支持阿拉伯语
- 全页捕获可能交错列或重复固定表头
- 公式模式可能误读复杂、低分辨率的公式
- 没有管道符与I/l歧义的自动修复
OCR Buddy 最适合哪些用途?
- 需要可靠代码OCR的开发者
- 从学术论文中提取文本的研究人员
- 将数学图像转换为LaTeX的学生
- 注重隐私、避免云端OCR的用户
- 需要忠实无幻觉OCR的任何人