我在过去两年里读了很多代理建筑的内容,几乎所有的建筑都是关于同一个层:代理如何思考.
迅速连锁、接线、管弦乐手、评估员、优化员、重新行动、计划和执行。
这一层确实得到了很好的服务,我不打算增加。
换句话说,我一直碰到一件不舒服的事 我所看到和所审查的事件并非来自选择错误的管弦乐模式。
他们来自一个特工 被允许做一些没人决定可以做的事 一个可以读取订单数据库的辅助代理从"从"升级到",因为一个客户写道"我被双重充电了,整理出来".
一个承包商询问一个政策聊天人关于行政离职的问题,并从一个文件得到正确和引人入胜的答案,他们从未被允许看到。
一个支付账款的代理支付一张4200美元的发票,中途被被一个被吊舱驱逐的人杀死,并在重试时再次支付.
这些都不是推理失败。
在所有情况下,模型都做了一些可以辩护的事。
它们是建筑的失败, 它们都生活在框架下面的两层。
TL; DR 数据 一个AI代理有三层,大多数内容只涵盖第一层:Lewers Consult Elections well?
框架 代理如何认为 LangGraph, CrewAI, Agent Framework Yes – 去读读 Anthropic和Gulli Harness 代理如何操作 循环,预算,沙箱,收缩,重试 barely 治理 模型提出来;绳子处理.
一个工具呼叫是一个请求,而不是一个行动,以及一切使它能够安全地纪念模型外的生命的东西.
这个系列为这两层的18个图案,每个图案由运行的代码支撑,其中包含它所防止的失败作为您可以执行的程序.
该代码在github.com/shashikanth-gs/agent-harness-patters上——314个测试,无API键下线.
框架层并不是我想具体阐述的 我并不主张的问题, 因为“框架无关紧要” 是那种在没有限定词的情况下被引用的声明。
框架层覆盖得很好,你应该阅读一下。
Anthropic's Building Effect Agents是对工作流程模式最短的处理——即时连锁,路由,平行,管弦乐工,评价-优化者——及其中心建议("使用最简单的工作,只在支付时加入代理行为")是正确的并被广泛忽略.
安东尼奥·古利的"代理设计模式"(Antonio Gulli's Agentic Design Patterns)将21个模式编目,可运行代码贯穿了LangChain,CrewAI,和Google ADK.
在他们之间,那层有一条拐杖。
我所声称的是狭义的,我认为,更难争论的是:你对兰格拉夫和CrewAI的选择不会决定你是否有出事.
你回答"谁决定这个特工可以发退款, 是什么阻止它发它不应该发退款?" 我检验了这种说法,而不是断言。
这个系列的每一个图案都被写成平通钩子,然后被挂载——不变——在LangGraph和Microsoft Agent Framework上,测试断言拒绝消息的字节取字节相同,因为它们来自同一种代码.
这是适配器的文章。
图案端口.
框架为管道.
LLM是一个推理引擎。
它阅读了文本并生成了文本,包括写有"用这些论据召唤"的文本.
它不能执行任何东西。
提议和退款之间的一切 实际达到客户卡是: 这五道接缝是整个建筑.
此系列的每个模式都挂在其中一两个上: 缝合 内存注入 预算检查 输出护栏 引用验证特权 代理商 批准门 身份 预算 沙箱 – 返回 ALLOW / DENY / PAUSE 校正 , 不信任