我深夜盯着一个破碎的"Next.js"和"Express"后端集成,说服我的AI经纪人已经疯了.
本来应该是一个直通式N8n自动化管道.
然而,每当它运行时,它都幻出不存在的包裹,并把它的背景推到一半。
我的系统1直觉反应立刻爆发:LLM只是不够聪明.
我坐在那里,精疲力尽,准备第二十次重写提示.
退后一步,我强迫自己 进入分析系统2的大脑。
我并不是在处理缺乏模型智能的问题,而是处理缺乏基础设施的问题。
我运行一个庞大,强大的AI模型 零护栏。
没有持续的记忆。
没有核实。
只是把一个巨大的Mongoose计划 扔到一个迅速和希望最好的。
我基本上把一台一级方程式发动机 扔到木制滑板上 想知道它为什么在一转弯时坠毁 什么是哈内斯工程?
我不再沉迷于即时工程 开始专注于哈尼斯工程 型号只是发动机;牵引装置提供底盘,指向和制动.
以下是我如何完全重组我的代理工作流程: 上下文管理: 而不是用原始代码库的垃圾堆淹入上下文窗口, 我实施了定向检索。
代理现在只看到当前任务所需的具体文件.
标准化工具:我集成了"模型背景协议"(MCP)服务器,给出了该模型的受约束,安全的方式执行动作,而不仅仅是生成文本.
持久状态:如果一个长期工作流程暂停或失败,该系统现在检查其进展。
它完全恢复原地,而不是从零开始。
严格校验:"看起来对我很好"不再是一个可接受的出品.
代理人被迫在完成任务前进行测试并验证CLI输出.
学会打破系统 结果是立即的。
幻觉停止了,代理从脆弱的文本生成器转变为可信赖的开发者.
如果周围没有可靠的系统,聪明的模型最终是无用的.
为了实现真正的自主,你必须学会打破你最初信任的系统,并设计出更好的系统.
在复杂任务期间,你试图使自动化代理保持正常运行,这是你面临的最大挑战吗?