📚 Wiki 知识库

🏷️ OCR

5 篇

Workbuddy 腾讯文档零基础从 0 到 1 教程

本教程详细介绍了如何使用 Workbuddy 通过 MCP 协议连接并操控腾讯文档。内容涵盖了前置连接准备、文档增删改查、表格数据处理、AI 生成 PPT、智能画布绘图以及 OCR 与自动化工作流等高阶技巧,旨在帮助用户利用自然语言高效管理在线文档。

技术工具与效率 ✍ Adrian Punk🕐 2026-07-07

不用花钱仅需10分钟在笔记本搭好本地OCR工作流(实测PP-OCRv6)

文章实测了百度开源的PP-OCRv6(Tiny、Small、Medium三档)本地部署方案。作者演示了如何用10分钟在笔记本上搭建OCR工作流,并对比了这三档模型与Apple Vision、Qwen3-VL等在手写、名片、轮胎压印等场景下的表现。结论指出,专用轻量模型在“逐字还原”的抄写员场景下远超大模型(VLM),且具备离线、隐私保护的优势。

技术工具与效率 ✍ Berryxia.AI🕐 2026-06-17

LlamaIndex 用 Rust 重写文档解析器 LiteParse

LlamaIndex 推出完全用 Rust 重写的文档解析器 LiteParse。相比旧版,新版本在处理大文档时速度提升 3 倍,小文档提升可达 100 倍,实测 457 页 PDF 解析仅需 0.777 秒。该工具支持 Python、Node.js、Rust 及浏览器环境,覆盖 PDF、Office 等主流格式,具备原生 OCR 能力,且可作为 Agent Skill 直接集成。

技术工具与效率 ✍ Jason Zhu🕐 2026-05-28

一行配置,让 OpenClaw 拥有超强文档识别能力

本文介绍了如何通过简单的配置,将 PaddleOCR 接入 OpenClaw Agent,以低成本实现高精度的文档识别。相比昂贵的大模型视觉方案,PaddleOCR 提供了每日 1 万页的免费解析额度。文章详细演示了申请 API、获取密钥以及在手机端实现名片数字化的全过程,强调了 OCR 在 Agent 与人协同时代的重要性。

技术Agent ✍ 铁锤人🕐 2026-03-13