文章来源:放心AI网发布时间:2025-05-26 15:19:02
在人工智能迅速发展的时代,大型模型的智能化水平不断提升,但随之而来的推理系统效率挑战也越来越明显。如何应对高推理负载、降低推理成本、缩短响应时间,已成为业界共同面对的重要问题。
Kimi 公司联合清华大学的 MADSys 实验室,推出了基于 KVCache 的 Mooncake 推理系统设计方案,该方案于2024年6月正式发布。
Mooncake 推理系统通过创新的 PD 分离架构和以存换算为中心的理念,显著提升了推理的吞吐能力,吸引了广泛的行业关注。为了进一步推动这一技术框架的应用与普及,Kimi 与清华大学 MADSys 实验室联合多家企业,如9#AISoft、阿里云、华为存储等,推出了开源项目 Mooncake。11月28日,Mooncake 的技术框架在 GitHub 平台正式上线。
Mooncake 开源项目围绕超大规模 KVCache 缓存池展开,致力于通过分阶段的方式逐步开源高性能的 KVCache 多级缓存 Mooncake Store。同时,该项目将兼容多种推理引擎和底层存储、传输资源。
目前,传输引擎 Transfer Engine 的部分已经在 GitHub 上全球开源。Mooncake 项目的终极目标是为大模型时代构建一个新型高性能内存语义存储的标准接口,并提供相关的参考实现方案。
Kimi 公司的工程副总裁许欣然表示:“通过与清华大学 MADSys 实验室的紧密合作,我们共同打造了分离式的大模型推理架构 Mooncake,实现了推理资源的极致优化。
Mooncake 不仅提升了用户体验,还降低了成本,为处理长文本和高并发需求提供了有效解决方案。” 他期待更多企业和研究机构加入 Mooncake 项目,共同探索更高效的模型推理系统架构,让 AI 助手等基于大模型技术的产品能够惠及更广泛的人群。
项目入口:https://github.com/kvcache-ai/Mooncake
相关攻略 更多
最新资讯 更多
Kimi联手清华开源大模型推理架构Mooncake提升AI推理效率
更新时间:2025-05-26
月之暗面Kimi联合清华大学等开源共建大模型推理架构Mooncake
更新时间:2025-05-26
AI辅助诊断首次被列入!今年人工智能企业注册量已超45万
更新时间:2025-05-26
ComfyUI重磅更新:桌面版正式发布,小白也能轻松玩转AI绘画!
更新时间:2025-05-26
专家表示,营销中AI的阴暗面经常被忽视
更新时间:2025-05-26
AlanAI推出划时代的私有AI平台
更新时间:2025-05-26
百度文库推出“AI全网搜”:结构化回答图表呈现答案更清晰
更新时间:2025-05-26
Uber新业务,开始进军AI标注市场
更新时间:2025-05-26
Meta、Rabbit等推出黑色星期五促销活动但消费者对AI硬件的态度依然冷淡
更新时间:2025-05-26
为博取流量,男子利用AI编造比亚迪收购蔚来谣言被捕
更新时间:2025-05-26