📚 Wiki 知识库

🏷️ 模型评估

2 篇

四大 Agent 编排模式详解

本文探讨了单提示词 LLM 工作流的局限性,并介绍了 NYU 研究者测试的四种多 Agent 编排架构:顺序流水线、并行分发合并、分层主管-工人模式以及反思式自纠循环。文章详细分析了每种模式的技术原理、优缺点、Token 效率及适用场景,指出分层模式在成本与精度间最平衡,而自纠模式虽精度最高但成本高昂且难以扩展。

技术Agent ✍ AlphaSignal AI🕐 2026-05-06

The Self-Healing Agent Harness

文章介绍了作者开发的“自愈 Agent Harness”系统,该系统通过 AI 代理实现了自动化评估和修复闭环。它包含三个核心组件:用于实时评分的三法官评审团、将低分转化为修复工单的工程管道,以及由 AI 评分控制发布的灰度发布机制。这一系统替代了传统的 QA 和人工审查,使团队能够在每天发布 3-8 次的高频节奏下,自动发现并修复模型幻觉、工具契约漂移或基础设施故障等问题。

技术Harness Engineering ✍ Peter Pang🕐 2026-04-28