关于您对 LLaMA 解码器阶段的实现的问题
作者: wangtianxia-sjtu创建于 2024年7月1日更新于 2025年5月5日
最近我一直在研究你的代码。不过在我看来,你的实现在解码阶段不会扩展 kv 缓存。以下代码摘自 LLaMA.py 中的函数 _concatenate_to_cache。
内容来源: LargeWorldModel/LWM
最近我一直在研究你的代码。不过在我看来,你的实现在解码阶段不会扩展 kv 缓存。以下代码摘自 LLaMA.py 中的函数 _concatenate_to_cache。
内容来源: LargeWorldModel/LWM