推理效率

科技人工智能

AI开始给自己写代码了,GPT-5.6重写内核,服务成本直降20%

OpenAI于7月29日宣布,GPT-5.6 Sol模型已被部署到生产环境,可自主优化运行系统。该模型通过独立重写用Triton和Gluon编程语言编写的生产内核,并在GPU编程、负载均衡、推测解码等多个环节进行优化,使OpenAI的端到端服务成本降低了20%,token生成效率提升超过15%。

科技人工智能

OpenAI公布GPT-5.6自进化成果,翁荔重返公司领导研究团队

OpenAI公布了GPT-5.6系列模型的自进化优化成果。在技术性能方面,推理服务部署成本下降20%,整体token生成效率提升超15%。该公司还通过推测解码技术优化进一步提升预测模型效率15%以上,在ARC-AGI-3测试中启用推理记忆留存与上下文压缩后,模型评测分数提升至原先3倍,同时输出token消耗量缩减为1…

科技人工智能

Kimi K3架构概览:2.8T参数开源大模型发布

Kimi K3是一款新发布的开源权重大模型,规模达2.8T参数,是目前最大的开源模型 。该模型基于去年发布的Kimi Linear模型进行扩展,从48B参数规模扩大到2.8T 。