功能请求: 在 /sdk/augmentation 中支持本地语言事实提取
作者: mheland创建于 2026年5月3日更新于 2026年5月5日
标签enhancement
您的特性请求与问题有关吗 ?
我们的应用程序在欧盟/斯堪的纳维亚地区运行
虽然我们成功地将嵌入模式转换为parater-multial-MiniLM-L12-v2',以支持多语种向量空间,但我们在/sdk/agment'终点遇到了限制。
目前,端点会自动取出所有事实并翻译为英语,无论输入语言如何. 这就产生了三个主要问题:
- ** 努恩斯损失:** 与
母语-语言-query-本土-语言-事实'相比,编码母语-语言-query-本土-语言-事实'时存在语义上的不匹配。 - ** 行动快取:** 本地运营商在检查数据库时发现,当对话以本地语言进行时,管理和审查英文翻译的内容是反直观的。
- ** 缺少配置:** 目前,在
AugmentPayload ' 或MetaData ' 内没有机制来指定用于提取的预期输出语言。
我们要求有能力向`/sdk/agment'终点传递语言提示,以确保所提取的事实留在用户的母语中。
解决办法
我们提议在增强有效载荷中的 " MetaData " 物体上增加一个可选 " extraction.language " 字段。
建议的有效载荷更新 贾森 { "论语":"{"消息":[.],"通鉴":"."〕 "梅塔":{ . . . . . . . . "摘录":{ "语言":"sv" // ISO 639-1代码;"自动"或无效默认当前英语行为 {\fn黑体\fs22\bord1\shad0\3aHBE\4aH00\fscx67\fscy66\2cHFFFFFF\3cH808080}你觉得呢? {\fn黑体\fs22\bord1\shad0\3aHBE\4aH00\fscx67\fscy66\2cHFFFFFF\3cH808080}你觉得呢? {\fn黑体\fs22\bord1\shad0\3aHBE\4aH00\fscx67\fscy66\2cHFFFFFF\3cH808080}你觉得呢?
执行细节
* ** 背面兼容性:** 如果将`语言'省略或设定为`null'/'auto',服务应保持当前行为(默认为英语)。
* 行为:** 如果提供了有效的ISO 639-1代码,提取器应当以指定语言提出事实.
* ** SDK 贡献:** 我们已确定了进行这一更新的必要地点(`memori/memory/augmentation/agmentation/agreements/memori/models.py'),并准备在后端更改得到批准时,为SDK方面提交PR.
页:1
带着爱和林根莓,
伊马戈小组
考虑的替代品
无回复( N)
受影响的组成部分
矢量存储/ 内存
参与
- [x] 我愿意提交一个Pull Request 这个功能.内容来源: MemoriLabs/Memori