📚 Wiki 知识库

🏷️ 调试

5 篇

How I Use Cursor: pstack与Agent工程化的深度实践

文章作者 lauren 分享了加入 Cursor 前后的编码体验对比,从使用 Claude Code 转向 Cursor,并深入探讨了如何通过 GUI 优于 CLI 的设计以及多模型对抗来提升效率。重点介绍了其开源的 pstack 插件,该插件通过一套严谨的技能和工作流,教导 AI Agent 像资深工程师一样进行二分法调试、代码审查和深度工作,以解决 AI 编码中常见的“平庸且快速”问题,倡导深度优于广度的 Agent 编排理念。

技术工具与效率 ✍ lauren🕐 2026-05-26

AI 神经系统诊断:Agent 运行时的六种病症

文章提出了一个新的视角来理解和调试 AI Agent:将其错误类比为人类神经系统疾病。作者指出,所谓的“AI 幻觉”在医学上更接近于“虚构症”。文章详细列举了 Agent 运行时中的六种病症,包括“遗忘症”、“幻肢状态”等,并针对每种症状提供了具体的诊断工具(如 gbrain, Mem0)和解决方案,强调通过检查“器官”(记忆、环境、工具链)来优化 Agent 性能。

技术Agent ✍ Vox🕐 2026-05-25

Recursive Agent Optimization Actually Works

文章介绍了 HALO(分层 Agent 循环优化),一种构建递归自改进 Agent 框架的方法论。通过专门的递归语言模型(RLM)分析追踪数据并诊断问题,利用编码 Agent 修复漏洞并重新部署。在 AppWorld 基准测试中,经过 5 个循环优化,场景目标完成率从 73.7% 提升至 89.5%。该实验证明,利用 AI 审视自身追踪数据的“鸟瞰视角”能有效识别幻觉模式、工具调用错误及配置缺陷,为未来的框架设计提供了新的优化范式。

技术Harness Engineering ✍ Amar Singh🕐 2026-05-05

Compound Engineering v3 发布:统一命名空间与增强可追溯性

文章介绍了 Compound Engineering v3.0.0 的主要更新,包括使用 'ce-' 前缀统一命名空间以避免冲突,通过结构化文档实现从头脑风暴到代码提交的全流程可追溯性,以及对 Codex、Pi 和 Copilot 等 IDE 的全面原生支持。此外,v3 优化了代码审查流程以防止橡皮图章,改进了调试方法论以减少猜测,并增加了对 Swift/iOS 的审查支持和本地保存功能。

技术工具与效率 ✍ Trevin Chow🕐 2026-04-23

Hermes Agent 从中级到高级进阶指南

本指南旨在帮助用户解决 Hermes Agent“记不住东西”的痛点,深入讲解其 Agent-curated 策展记忆机制。文章涵盖了记忆系统优化、技能自进化、多 Agent 协作、生产化部署(Systemd/Docker)及高级调试技巧,通过具体配置与实践任务,指导用户让 Agent 实现从“能干活”到“越干越会干”的进化。

技术Hermes ✍ 一🕐 2026-04-22