Folia
更新于
10/10 14:22
Language / 语言
中文
English
登录
全部
国际
中国
科技
财经
政治
军事
社会
科学
健康
环境
体育
娱乐
文化
大语言模型能力测试
科技
/
人工智能
AI系统在自动化研究开发方面仍存明显局限
研究人员通过InnovationEval基准测试评估了当前AI系统独立发现新型机器学习算法的能力。该测试要求AI代理在无法接触参考论文的情况下,开发出能匹配人类研究者成果的自蒸馏后训练方法。
8 小时前