研究者Brianne Lee进行了一项实验,用同一条价格2.43美元的项链在三种不同穿衣背景下拍照,测试包括Claude Fable 5、GPT-5.6、GPT-4o、Grok 4.5、Kimi K3和DeepSeek V4-Pro在内的6个前沿多模态模型的价格估算能力。结果表明这些模型对同一物体的估价差异高达3.6…