头版Folia Daily Briefing
← 返回头版
科技人工智能

在Apple M1 Max上成功运行2.8万亿参数Kimi K3模型

Deltafin项目成功在Apple M1 Max笔记本电脑上实现了参数量为2.8万亿的Kimi K3大模型的本地推理[1]。该项目通过专门的优化技术,证明了在消费级硬件上部署大规模混合专家模型的可行性,项目代码采用MIT许可证开源[1]。

运行该模型需要64GB内存的Apple Silicon Mac硬件配置[1]。完整安装需要1.7TB的磁盘空间,而采用流式安装模式则可将空间需求降至215GB[1]。模型的驻留脊柱大小约为114GB,经过量化后可缩减至60GB[1]。每个推理token需要读取16个专家×92层对应的25.8GB专家数据,从本地磁盘读取耗时约4秒,通过网络读取则需要数分钟[1]。

虽然推理速度约为每token 16秒[1],但该项目提供了完整的安装指南和OpenAI API兼容接口[1],为用户在资源受限的设备上本地运行大规模语言模型提供了新的解决方案。


Kimi K3大模型推理Apple Silicon本地运行Deltafin项目

来源

  1. Hacker NewsRunning Kimi K3 on a M1 Max