经历异质LLM推论/精细优化的灵活框架
QQ Overview KTransfers是一个研究项目,重点是通过CPU-GPU的多功能计算对大型语言模型进行高效推论和微调. 该项目现在暴露出两个来自克特内核源树的用户造型能力:推论和SFT. QQ更新 Aug 26, 2026: 添加了GLM-5.3-flash的本土支持,为消费者GPU带来了1M-token上下文和多模式输入. (图文) 2026年8月25日:上传一款新型易用KTransformers × LlamaFactory MoE Fine-Tuning Cookbook,涵盖硬件检查,安装,BF16/FP8/INT8配方,LORA并全面微调,资源规划,以及故障排除等. 2026年8月17日:LORA微调现在支持兼容的AVX512 x86 CPU,包括AMD服务器,而不需要AMX. (v0.7.0放出说明) Aug 16, 2026年:DeepSeek-V4-Flash在一个有CPU专家卸载的单一Ascend NPU上. 2026年8月5日:引进本土集团.