自托管推理

科技人工智能

Kimi K3自托管推理性能测试:硬件成本增加20%,任务完成率提升24个百分点

一项针对Kimi K3模型自托管推理的评测显示,该模型在8×B300节点配置下需要1.4TB权重,硬件成本相比采用8×B200节点的GLM-5.2高约20%。尽管投入更高,K3在SWEBench Pro基准测试中的任务完成率达到86.4%,较GLM-5.2和Opus 4.8的62.5%高出24个百分点。在16并发会话…