Folia
← 返回头版

研究揭示AI使用数据存在重大偏差,公司报告掩盖真实用户行为

由麻省理工学院和斯坦福大学等机构联合创建的AI Observatory项目发现,主流AI公司发布的使用数据与实际用户行为存在显著差异2。该项目汇总分析了包含85,633个对话轮次的数据,来自24,521个对话,涉及7个真实数据集2。研究表明,Anthropic、OpenAI等AI公司只发布他们选择公开的部分数据1。

研究揭露了数据报告中的具体偏差幅度。当应用Anthropic的过滤方法到AI Observatory数据集时,48%的对话会被过滤掉2。在非工作相关对话中,健康和人际关系话题占44.2%,而Anthropic报告中仅为31.2%2;成人或非法内容在真实数据中占7.9%,对比Anthropic的2.1%2;骚扰和仇恨内容分别为27.5%与5.66%2;色情内容为16.7%对比2.4%2。这些差异反映了AI公司报告中遗漏的敏感行为类别。

用户在不同AI模型间表现出差异化的使用习惯。研究发现,用户倾向于将Anthropic用于编程任务,Gemini用于社交和角色扮演,而ChatGPT则主要用于作业辅导1。OpenAI 2025年的报告显示,消费者中仅有30%的使用与工作相关2。


评论