每经记者:岳楚鹏 每经编辑:兰素英2月10日,清华大学KVCache.AI团队联合趋境科技发布的KTransformers开源项目迎来重大更新,成功打破大模型推理算力门槛。此前,拥有671B参数的MoE架构大模型DeepSeek-R1在推理时困难重重。
然而,最近由清华大学KVCache.AI团队和趋境科技联合发布的KTransformers项目,带来了一项令人振奋的突破:只需一块24G显存的4090显卡,就能在本地顺畅运行DeepSeek-R1的671B“满血版”。