📚 Wiki 知识库

🏷️ 数据采集

4 篇

我戴了三周 Fitbit,终于看懂了 Apple 和 Google 的健康生意

作者通过三周佩戴 Fitbit 对比 Apple Health 和 Google Health,发现前者安静克制,后者主动互动。这种差异源于不同的商业模式:Apple 依赖硬件生态,Google 则依赖数据和 AI 反馈。文章深入剖析了两者在数据采集、AI 教练设计及产品逻辑上的根本区别,并警示小团队不应盲目照搬,需找到适合自身的商业引擎。

技术方法论 ✍ Bear Liu🕐 2026-07-22

想用Hermes和Openclaw白嫖全网数据又不想被反爬的收藏着10个仓库就够了

文章推荐了10个用于全网数据采集和规避反爬虫策略的优质GitHub仓库。这些工具包括Firecrawl、Crawl4AI、browser-use等,涵盖了网页爬取、数据清洗、模拟真人操作、指纹伪装及移动端控制等功能,旨在帮助用户高效获取AI训练所需的干净数据。

技术Openclaw ✍ 鸟哥 | 蓝鸟会🕐 2026-07-01

Claude Code 全网爬取指南:五款核心工具配置

本文介绍了如何通过配置五个关键开源项目和官方插件,赋予 Claude Code 强大的全网数据采集能力。内容涵盖社媒平台API对接、反爬虫对抗、浏览器自动化、人工辅助监工以及全自动联网接管等场景。作者提出了“从轻到重,够用就停”的配置原则,并展示了自动扒取课程、翻译字幕并归档的实战工作流。

技术Agent ✍ Echo ./🕐 2026-06-04