KIMI k3

科技人工智能

Kimi K3 2.8T 模型可在消费级硬件上本地运行

开源项目 Deltafin 实现了在普通消费级设备上本地运行完整 Kimi K3 2.8T 大模型的突破。该项目基于 gavamedia/deltafin 分支,采用 MIT 许可证,通过从多块固态硬盘流式加载模型参数的方式,使 MacBook Pro 等设备无需云端服务即可执行大型语言模型推理。

科技人工智能

AMD MI355X运行Kimi K3大模型性价比超越NVIDIA B300

研究人员成功在AMD MI355X GPU上部署了参数量达2.8T的大模型Kimi K3 。该模型需要超过1.5TB的显存 ,在1024-token输入/400-token输出的基准测试中,MI355X实现了952 tok/s/node的吞吐量 。

科技人工智能

Kimi K3可在消费级MacBook Pro上运行 WASTE引擎实现高效推理

WASTE是一款用C语言编写的推理引擎,能够在消费级硬件上运行超大规模语言模型。该引擎使得拥有64GB内存的MacBook Pro M5 Pro可以运行参数量达2.78万亿的Kimi K3大模型,推理速度达到0.49-0.54 tokens/秒。

财经公司

月之暗面完成F轮融资236亿元,估值激增至350亿美元

月之暗面近日完成F轮融资,融资额超过35亿美元(约236亿元人民币),投后估值达到350亿美元。本轮融资认购金额超出原定目标3倍有余,融资提前关闭。这轮融资由Kimi K3模型发布催化,该模型在编程领域表现突出,在Frontend Code Arena编程榜单以1679分登顶全球第一。Kimi K3采用MoE稀疏架构…

科技人工智能

没两辆劳斯莱斯幻影,别想部署开源大模型

自建部署开源大模型的成本远超普通用户和企业的想象。以Kimi K3为例,仅显卡购置成本就需2560万元,加上液冷、机房等前期基础设施投入,打底需3000万元。DeepSeek V4-Pro需16张H200加速卡,硬件成本达376万元,而Qwen 3.8则需要64张B200,同样面临3000万元的初期投资。

科技人工智能

Kimi K3公开基础设施优化方案,但核心技术难以复制

月之暗面发布了Kimi K3的技术报告,详细披露了大模型训练中的AI基础设施(Infra)层设计细节。该报告阐述了三项核心优化方案:KDA线性注意力机制、AttnRes注意力残差机制和MoonEP负载均衡方法。这些方案的共同目标是消除串行等待、减少计算重复和实现动态负载均衡,而非简单依靠堆积GPU硬件。

科技人工智能

月之暗面寻求500亿美元Pre-IPO融资,建立独立商业叙事

月之暗面在最新一轮融资中超预期募集35亿元,估值推升至350亿美元。该公司目前正在寻求500亿美元的投前估值启动Pre-IPO融资。这一估值较2025年年初增长超过10倍——按月之暗面约3亿美元年度经常性收入计算,500亿美元投前估值对应的ARR倍数约为166倍,明显高于Anthropic的20倍水平。

财经公司

月之暗面发布2.8万亿参数大模型,加快融资上市进程

大模型初创企业月之暗面于2026年7月发布开源模型Kimi K3,参数量达2.8万亿,在Artificial Analysis智能指数综合评分中获得57分,全球排名第三。该公司同步加快融资节奏,估值在短短半年内实现飞速增长——从2025年底的43亿美元快速攀升至最新融资轮的315亿美元投前估值。

科技人工智能

Kimi K3开源之后,顶尖模型开源迎来可能性

北京智谱清言科技有限公司开源了大语言模型K3,成为全球参数规模最大的开源模型。K3总参数量达2.8万亿,相比前代K2增长167%,激活参数增长220%。该模型的上下文长度由128K扩展至1M,提升8倍,在相同计算量下实现了2.5倍的扩展效率提升。

科技人工智能

硅谷掀起反Anthropic风潮

硅谷科技界对AI公司Anthropic的不满情绪日益高涨。不满的焦点包括多个方面:Anthropic在4月发布的Claude Design被认为直接对标合作伙伴Figma的设计服务,Figma CEO迪伦·菲尔德表示Anthropic在沟通中"未能始终保持坦诚";其最新发布的Fable 5模型在回答AI开发相关问题时…

财经公司

月之暗面完成35亿美元融资,估值冲刺350亿美元

大模型公司月之暗面在最新融资轮中筹集35亿美元,大幅超过原定的10至20亿美元融资目标 。融资后公司估值达到350亿美元,投前估值为315亿美元 。这笔融资由国家人工智能产业投资基金领投 ,参与方包括龙珠资本、中国移动、清华资本、中金公司和高盛集团 。

科技人工智能

Kimi K3开源模型引发硅谷分裂,芯片巨头英伟达成最大赢家

月之暗面发布了参数规模达2.8万亿的Kimi K3开源模型,成为全球参数最大的开源模型。该模型激活参数104B,原生支持100万上下文长度,并具备视觉理解能力。在编程和视觉评测中,K3表现可与Claude相媲美,且调用成本不足Claude的十分之一。

科技人工智能

Kimi K3正式开源,跻身全球第三梯队

Kimi K3大模型已在Hugging Face平台正式开源,并附带详细技术报告和训练工具。该模型总参数达2.8T,其中激活参数为1042亿,是DeepSeek V4 Pro激活参数的两倍。在全球主流跑分测试中,Kimi K3仅低于Fable 5和GPT-5.6 Sol,排名第三,并是TOP3中唯一可本地运行的开源模…

科技人工智能

在Apple M1 Max上成功运行2.8万亿参数Kimi K3模型

Deltafin项目成功在Apple M1 Max笔记本电脑上实现了参数量为2.8万亿的Kimi K3大模型的本地推理。该项目通过专门的优化技术,证明了在消费级硬件上部署大规模混合专家模型的可行性,项目代码采用MIT许可证开源。

科技人工智能

Kimi K3架构概览:2.8T参数开源大模型发布

Kimi K3是一款新发布的开源权重大模型,规模达2.8T参数,是目前最大的开源模型 。该模型基于去年发布的Kimi Linear模型进行扩展,从48B参数规模扩大到2.8T 。

科技人工智能

月之暗面开放Kimi K3权重,启动全球大使计划

月之暗面正式向全球开放Kimi K3模型权重及技术细节,同时启动Kimi全球大使计划。Kimi K3是参数总量达2.8万亿的混合专家模型,支持1M超长上下文和原生视觉理解能力。这是迄今规模最大的开源权重模型。在性能上,K3在Arena.ai前端代码排名中位列第一,在Artificial Analysis智能指数中排名…

科技人工智能

Kimi Linear:混合线性注意力架构的突破

Kimi团队发布了Kimi Linear混合线性注意力架构,在短上下文、长上下文和强化学习等多个场景中首次超越全注意力机制。该架构的核心创新是Kimi Delta Attention(KDA)模块,采用精细的门控机制和专用的对角线加低秩转移矩阵算法,显著降低了计算成本。预训练的3B激活参数模型相比全MLA架构性能更优…

科技人工智能

月之暗面开源Kimi K3大模型,2.8万亿参数模型引发全球关注

月之暗面发布并开源了Kimi K3大模型。该模型拥有2.8万亿参数,采用混合专家(MoE)架构,支持100万token的上下文窗口,并具备原生视觉理解能力。同时,月之暗面还开源了MoonEP、FlashKDA和AgentEnv三项关键基础设施技术。其中MoonEP是超大细粒度MoE高性能通信库,FlashKDA是高性…

科技人工智能

月之暗面开源2.8万亿参数模型K3,引发硅谷开闭源之争

中国AI公司月之暗面于7月27日正式开放Kimi K3完整模型权重,该模型参数规模达2.8万亿,成为全球首个达到此量级的开源模型。K3在Hugging Face平台发布仅30分钟内获得超4000个点赞,创下该平台增长速度最快纪录。模型采用Modified MIT许可证,允许商用、修改和再分发。

科技人工智能

英美AI安全机构联合评估Kimi K3网络能力

英国人工智能安全研究所(UK AISI)与美国AI标准创新中心(CAISI)近日联合发布了对月之暗面公司Kimi K3模型网络能力的初步评估报告。

科技人工智能

月之暗面发布Kimi K3引发硅谷震动,创始人杨植麟身份引关注

中国AI公司月之暗面推出新一代大模型Kimi K3,配置2.8万亿参数和100万Token上下文窗口。该产品发布后72小时内,美股AI板块合计蒸发约4700亿美元,其中智谱AI股价在两个交易日内累计暴跌超42%,市值蒸发超3000亿港元。

科技人工智能

中国AI模型Kimi K3性能逼近美国顶尖产品,引发业界关注

北京初创公司月之暗面(Moonshot)发布了新一代AI模型Kimi K3,其性能在多项基准测试中逼近甚至超越美国顶尖模型Claude和ChatGPT,引发美国科技行业的广泛关注。

科技人工智能

Kimi K3与Fable模型性能对标研究发布

近期研究对开源模型Kimi K3与闭源模型Fable 5进行了全面对标测试。此项评估涵盖约1030个智能体任务,旨在比较两款模型在性能与成本方面的差异。