停止责怪LLM:为什么你的AI代理一直失败(以及如何修复他们)

2026年8月22日1 次浏览来源:Dev.to阅读原文

我深夜盯着一个破碎的"Next.js"和"Express"后端集成,说服我的AI经纪人已经疯了.

本来应该是一个直通式N8n自动化管道.

然而,每当它运行时,它都幻出不存在的包裹,并把它的背景推到一半。

我的系统1直觉反应立刻爆发:LLM只是不够聪明.

我坐在那里,精疲力尽,准备第二十次重写提示.

退后一步,我强迫自己 进入分析系统2的大脑。

我并不是在处理缺乏模型智能的问题,而是处理缺乏基础设施的问题。

我运行一个庞大,强大的AI模型 零护栏。

没有持续的记忆。

没有核实。

只是把一个巨大的Mongoose计划 扔到一个迅速和希望最好的。

我基本上把一台一级方程式发动机 扔到木制滑板上 想知道它为什么在一转弯时坠毁 什么是哈内斯工程?

我不再沉迷于即时工程 开始专注于哈尼斯工程 型号只是发动机;牵引装置提供底盘,指向和制动.

以下是我如何完全重组我的代理工作流程: 上下文管理: 而不是用原始代码库的垃圾堆淹入上下文窗口, 我实施了定向检索。

代理现在只看到当前任务所需的具体文件.

标准化工具:我集成了"模型背景协议"(MCP)服务器,给出了该模型的受约束,安全的方式执行动作,而不仅仅是生成文本.

持久状态:如果一个长期工作流程暂停或失败,该系统现在检查其进展。

它完全恢复原地,而不是从零开始。

严格校验:"看起来对我很好"不再是一个可接受的出品.

代理人被迫在完成任务前进行测试并验证CLI输出.

学会打破系统 结果是立即的。

幻觉停止了,代理从脆弱的文本生成器转变为可信赖的开发者.

如果周围没有可靠的系统,聪明的模型最终是无用的.

为了实现真正的自主,你必须学会打破你最初信任的系统,并设计出更好的系统.

在复杂任务期间,你试图使自动化代理保持正常运行,这是你面临的最大挑战吗?

分享