我的8个Claude密码特工中有7个 在30天里接到零电话:自动找到死亡特工

2026年9月2日1 次浏览来源:Dev.to阅读原文

我在克洛德法典里定义了八个海关特工 当我最后数起时,其中7个在过去30天里没有被叫过一次.

保持我1.2M日元/月自动化装置运行 并不是聪明的提示 这是一个环境,它不断自动地检查, 我建造的东西是否真的在做任何事情。

为什么这个设置工作 Claude 代码允许您通过将文件丢入目录来定义自定义代理.

你定义专家,如(建筑设计),(代码审查)和(安全审计),并期望克洛德代码自己选择正确的一个.

由是自然假设.

但当你计算出日志时 结果是令人惊讶的。

以我的环境为例 目前持有8个代理定义文件。 2026年5月28日至8月30日的682个记录 过去30天的总和提供了以下细目: 在八名指定特工中, 确切的说,一个, 甚至在30天内被调用过一次。

其他7个没有电话 我定义的87.5%的特工 可能根本不存在 收缩到最后7天 情况越来越糟:也退学了,零呼号名单增长到8个.

这不仅仅是个"浪费"的故事 Claude代码代理定义在每次请求时都会被迅速注入系统.

打开这样的大型代理 你会找到220多行的定义 7个未使用的代理定义在不断燃烧活物并悄悄地降低推断质量. "定义=工作"的谬误 当你定义代理人时,成就感是真实的. "从现在起,我的代码会自动被审查" "当我想到建筑, 一个专家步骤英寸 你相信这一点, 几个星期过去了。

在现实中,除非明确指定代理人,克洛德会选择通用路线()或.

即使其描述是“所有代码更改都必须使用” 定义中的文字。

克劳德不自主地读取该指示并采取行动.

代理只有在调用方出现调用即时或调用逻辑时才能工作.

没用的特工花了你两分钱 托肯成本。

输入系统的代理目录的长度按每次引用支付。

更多定义文件意味着每个请求都有更多的令牌,吃入一个大上下文窗口.

认知成本。

人类很难手动追踪哪些代理实际运行,随着定义文件的堆积,管理变得更加复杂.

当不反映现实的定义被累积起来时,对环境的信任就会被侵蚀.

你怀疑"这个特工是否在运行"的那一刻 你对自主设置的挥发者的信心 固定:基于测量数字的棱柱定义 解决办法是根据真实数字而不是直觉来决定.

构建一个操作周期,使用日志自动地表面"在过去30天里一次也没有调用过的代理",然后删除或清理.

关键的想法是投资于环境,而不是任务.

不是一个一次性的"今天删除这个代理",而是"存在一个脚本,可以随时立即向我展示未使用的代理"的状态.

每月、每周或按日计时运行;节奏可在稍后决定。

关键在于能够从测量数据中长期判断。

我之所以能在六个月内建立一个1.2M日元/月的自主环境,并不是因为我期望"AI变得更聪明".

是因为我主要投资在不断关注"AI走错方向"的机制上.

监测剂的使用就是一个例子。

系统有三层。 (Layer 1: 录音.

Claude Code的"停止钩"写出代理引用JSONL,每行有1个记录与","等第2层:聚合".

汇总给定窗口的记录,其中Bash shell用于参数解析和环境变量,而Python3用于逻辑:由窗口过滤,由 计数,对照 。

第3层:输出。

前10名 引用排名加零调用代理列表,该列表为删除/存档/重新设计决定提供信息. ) 第1层: JSONL 记录

分享