头版Folia Daily Briefing
← 返回头版
科技人工智能

研究揭示Claude与GPT模型的知识截断点和预训练时间线差异

通过精心设计的探测方法,研究人员分析了Claude和GPT等前沿大语言模型的知识截断点和预训练时间线[1]。研究通过历史事实测验、自我报告日期和模型身份识别等方式,推测了Anthropic和OpenAI不同模型的预训练完成时间[1]。

根据分析结果,Anthropic的Opus 4.7及后续模型来自同一训练运行,知识截断点约在2025年12月末[1]。相比之下,OpenAI的GPT-5.6系列与GPT-5.5来自不同检查点,预训练完成时间约在2026年2月末[1]。有趣的是,虽然Opus 5发布时宣称知识截断点为2026年5月,但其实际性能与之前1月截断的模型相近[1]。模型自我报告的日期与基于事实的估计相关联,垂直条纹显示活跃的后期训练[1]。

研究还发现了两家实验室模型之间的显著差异。Anthropic的Sonnet 5会定期自我认同为GPT-4,而OpenAI模型从不认同其他实验室的模型[1]。当被要求"模仿模型X"回答身份问题时,Claude能在68%的情况下再现OpenAI模型的特征,而OpenAI模型仅能在8%的情况下再现Claude的特征[1]。此外,研究发现这些模型的训练数据中包含了用户聊天记录,揭示了模型训练的一些隐藏特征[1]。


ClaudeGPT知识截断训练数据大语言模型模型分析