知识和记忆管理v.0.0.2:便携式知识收集和内存管理

2026年8月3日1 次浏览来源:Dev.to阅读原文

V0.0.2"知识与记忆-管理"的发布正是清版的外观:没有留下去的个人路径,没有被硬码地夹入到配置中,知识收集与内存管理之间有明显的分化.

如果你一直遵循了0.0.x行,这就是工具最终可以跨出机器和代理的放行.

以下是改变的原因和原因。 $AGENT HOME:可移动性修复 v0.0.2中最明显的变化是用环境变量来替换所有绝对的个人路径.

之前,代理商的知识库被捆绑在一个特定的文件系统布局上——如果你在容器中运行代理,跨越多个用户,或者在麻黄CI跑道上运行的话,就是交易中断.

现在,每个收藏,内存索引, 和元数据文件 解决反对.

如果变量未被设定,代理机会回落到一个合理的默认(典型的),但合同是明确的:设定一次,整个知识金字塔随它移动.

下面的核心路径解析逻辑 现在支撑一切: 这个单一的变化波纹贯穿整个代码库.

切换手提电脑时不再进行路径外科手术.

不再黑客在团队成员之间移动一个知识库.

准备出发 知识收集:网络、视频、文章 v0.0.2中的收集管道围绕三种来源类型构建:网页,视频誊本和长式文章.

每个源类型都有自己的摄入路径,但它们都集中在一个共同的内存格式上.

Web:收集器获取一个URL,取出主要内容(取出导航、脚印和锅炉板),并将被清理的文本与源URL一起存储并取出时间戳.

重点是保护出处——每一块都知道出处。

视频:视频集依靠字幕/特写取出而不是录音抄录.

这使管道保持了快速和决定性。

如果视频没有标题,则采集器会记录元数据,但跳过内容提取.

没有伪造记录 文章:内容较长(如PDFs或完整博客文章), 代理将文章拆分为可管理部分,边界相重叠,这后使取回和内存合并变得明显容易.

所有收集的物品都装有副车JSON元数据文件。

目录布局稳定且有文献记载,这意味着您可以通过查看文件系统来检查代理商所知道的.

内存管理:超越原始存储存储不是内存. v0.0.2明确了这一区别。

内存管理层负责分解,分时衰减,并进行整合.

复制 : 如果您两次收集同一文章,代理检测URL散列并更新已存在的条目,而不是创建重复.

内容散列是在正版文本上计算的,而不是原始字节,因此小格式的修改不会引起重复的bloat.

衰变:内存条目带有时间戳.

特工拿回知识后 就会刷新时间戳 在可配置的窗口中无法访问的 prunning pass 删除或存档条目 。

这不是AI魔法——这是应用在您知识库上的简单的LRU政策.

合并: 代理组通过轻量级关键词的相接分数按来源和主题进行组合。

这不是一个向量商店。

这是一种决定性的heuristic,让代理商说出"这篇新文章与已存在的三个块重叠",并把它们合并为一个内存条目.

关键的设计选择是内存管理可以检查.

在JSON的文件系统中,一切都会发生,有明确的时间戳。

您可以删除一个内存条目 。

在v0.0.2笔记中的"干净的放出"(Clean Release)意味着什么不仅仅是市场营销.

意思是:没有个人文物——没有,没有,没有,没有Windows驱动信件在代码库中.

决定式布局——考虑到同样的,在机器之间获得相同的收藏结构.

后进

分享