📚 Wiki 知识库

🏷️ 验证

4 篇

做 AI Agent 一年,90% 的时间都在做表面功夫

作者通过一年的 AI Agent 开发实践,发现 90% 的时间浪费在手动测试上。受芯片“验证不对称”理念启发,作者提出构建可验证的架构:通过前后端分离(ACI)使系统对 AI 友好,并引入“确定性断言”和“LLM 裁判”两级回归测试体系。最终实现了由 Coding Agent 自动运行的闭环开发,将开发者从繁琐的手工验证中解放出来,重塑了 AI 时代的开发效率。

技术Agent ✍ Ando🕐 2026-07-08

当“写代码”被解决之后:Anthropic 内部的 7 件怪事与未来启示

文章基于 Anthropic 工程负责人访谈,探讨了当编码能力不再稀缺时,公司内部发生的结构性剧变。核心观点是“瓶颈只会搬家”,从“产出”转移到了“验证”与“判断”。文中剖析了路线图失效、中间层消亡、努力崇拜崩塌及工程师孤独感等现象,指出在生成成本归零的时代,人的注意力、判断力和认知协作将成为唯一的稀缺资源。

技术LLM ✍ DataDan🕐 2026-06-29

关于循环工程的思考:验证是核心

本文探讨了“循环工程”(Loop Engineering)的概念,即从编写提示词转向设计运行 Agent 的系统。文章指出,尽管生成器很重要,但循环架构中的核心瓶颈其实是验证器。通过 Bun 移植 Rust 的案例,作者强调了无论内外循环,严格的质量验证和测试才是决定项目成败的关键。

技术DevOps ✍ Samuel McDonnell🕐 2026-06-16

Claude Code for Solo Founders: From Idea to First Paying

本文是面向独立创始人的 Claude Code 使用指南。文章提出在 2026 年,独立创始人的核心竞争力不再是写代码,而是判断力与方向把控。通过利用 Claude Code 作为执行者,创始人可将角色从专家转变为导演,大幅缩短从想法验证到获得首个付费用户的时间(仅需 30-60 天)。文中详细介绍了如何利用 AI 进行想法验证、落地页测试和客户访谈,并提供了在周末构建 MVP 的具体提示词(Prompt)和开发排期,强调了 CLAUDE.md 文档在控制项目范围中的关键作用。

技术Claude Code ✍ CyrilXBT🕐 2026-05-12