基于Earendil公司的研究,科研人员提出了衡量大语言模型生成代码质量问题的新方法。尽管大语言模型在生成形式正确的代码方面已接近完美,但其产出的代码存在不必要的抽象、重复代码片段和不良设计决策等问题。