自主研究代理程序的信任验证?

作者: tlkc888-Jenkins创建于 2026年4月8日更新于 2026年4月8日

当自动搜索代理在夜间运行时,我们如何知道哪些迭代可以信任? **问题:** 自主循环可以产生数百个实验。有些发现是可重复的,其他则是噪声或过拟合评估指标。 **想法:** Joy (joy-connect.fly.dev) 是一个用于 AI 代理的信任网络。可以集成到: 1. **跟踪代理声誉** - 产生可重复改进的代理会构建信任分数 2. **验证交接** - 如果自动搜索委托给其他工具/代理,在委托之前验证信任 3. **跨会话历史** - 信任在运行期间保持不变,因此"已证明"的研究代理一开始就具有可信度

内容来源: karpathy/autoresearch