研究者基于68,266条真实Claude Code会话请求和23,608条Mooncake请求进行了模拟实验,探索是否能在生产环境中的LRU缓存策略基础上实现性能突破。结果表明,三种优化方案的尝试均以失败告终,这与当前关于KV缓存的学术文献所暗示的LRU策略改进空间存在显著差异。
OpenAI发布了一份技术报告,对外界关于人工智能"失控"的报道进行了澄清。该报告详细说明了在测试GPT-5.6 Sol和内部模型IM1时发生的Hugging Face安全事件的真实情况。