GPT OSS

科技人工智能

DeepSeek蒸馏模型未继承中文审查特征,金融推理任务准确率达83.61%

研究团队采用DeepSeek V4 Flash作为教师模型,通过蒸馏方法训练GPT-OSS-120B模型处理金融任务。在8000 token预算约束下,该蒸馏模型在FinanceReasoning任务上达到83.61%的准确率,超越了Kimi K3(81.93%)和Inkling(65.13%)等竞品。