Hugo Vergnes利用开源框架little-lm在NVIDIA B200 GPU上训练了一个包含3.8B参数的大语言模型,项目耗资仅998美元,完成时间为43小时。该模型在CORE基准上获得0.384分,超过了GPT-2 1.5B模型的0.2565分。
特朗普政府向法院提交了20页简报,支持OpenAI在纽约时报的版权诉讼案中使用未经许可的受版权保护材料来训练大语言模型的做法。政府在简报中辩称,美国具有"强烈利益继续开发强大且具竞争力的人工智能产业,在全球AI实践和程序中设定标准"。