小米MiMo大模型负责人罗福莉宣布,团队在4月开源MiMo-v2.5后沉寂了近半年,专注于研究一个核心课题——强化学习究竟能扩展到多远。MiMo-V2.6目前处于强化学习中间阶段,扩展了计算、环境工具和评分三项能力。

一位开发者通过运行软件工厂实验对GPT-6 Astra的代码生成能力进行了测试。在35小时的实验中,该模型消耗约10亿个token,成本约1200美元,最终生成了75000行代码但未产生任何有价值的输出。这次实验共产生79次代码提交,平均每次提交的成本约15.5美元。
Mistral调整了模型训练政策,现在默认将用户的输入和输出数据(包括对话和文档等)纳入模型训练计划。这一变更对大多数用户生效,仅企业级用户在默认设置下被排除在训练之外。
AI驱动的软件工厂模式面临严重的质量问题。虽然StrongDM等企业已实现了"无灯工厂"式的全自动代码生成,但这些系统缺乏人类代码审查环节 。Faros AI的数据显示,自今年1月至2月以来,采用此类自动化模式的团队面临拉取请求审查质量下降、事件频率增加,以及单个开发者的bug数量上升 。