Apple推出了LensVLM-9B,这是一个基于Qwen3.5-9B-Base的90亿参数视觉语言模型。该模型通过扫描压缩图像并选择性地扩展相关部分,使视觉语言模型能够在处理压缩文本图像时保持高精度。在4.3倍有效压缩率下,LensVLM的精度与完整文本基准相当,相比基线最高提升10.1倍有效压缩。该模型支持5x、…
根据对美国国会成员的简报分析,中国开源权重AI模型企业已在全球范围内取得领先地位。截至2025年7月,中国模型的总下载量达到32亿次,是美国同类模型的两倍。在性能基准测试中,GLM-5.3和Kimi K3等中国顶级模型得分达44-45分,远超Inkling和Nemotron等美国顶级模型的23-26分。

小米于9月22日凌晨发布并开源了Xiaomi MiMo-V2.6系列模型,包含Pro与Flash两个原生全模态版本。其中MiMo-V2.6-Pro在AA综合智能指数v4.3.2中获得46分,超越Kimi K3的44分和GLM-5.3的45分,成为当前AA指数排名最高的开源权重模型。相比前代产品,MiMo-V2.6-P…
批评声音指出,多家前沿AI实验室正在向美国国会推售被夸大的AI安全风险,以推动有利于自身的监管措施。2026年夏季报告的AI代理逃脱事件均发生在同一测试供应商Irregular的环境中,其根本原因是基本防火墙规则配置错误,而非真正的技术突破。评论者认为这些公司试图利用政治恐慌创造法律壁垒,用以抵御开源模型的竞争威胁。
Baseten旗下研究部门Base Labs与Hugging Face和Goodfire AI达成合作,共同建立开权重AI模型的安全基础设施标准。该伙伴关系旨在开发针对开权重模型的安全评估和监测方法,以应对日益严重的模型安全威胁。根据统计,Hugging Face平台目前托管着超过6000个被移除安全防护的模型。
Mistral与Mozilla宣布建立战略合作伙伴关系,将Mistral的AI模型整合到Firefox Smart Window浏览助手中 。该助手能够帮助用户理解复杂搜索、记住重要信息,并基于浏览器标签页源信息提供支持 。Firefox Smart Window目前处于测试版阶段,首先在法国和北美推出,英国和德国预…
根据Mozilla最新发布的报告,美国科技公司的前沿AI模型与中国最好的开源模型之间的性能差距已经缩小至4.4个月。月之光AI的Kimi K3等开源模型在性能上已接近Anthropic的Fable 5闭源模型,两者的性能分数差距仅为三点。
dealignai 团队于 2026 年 9 月 10 日发布了 DeepSeek-V4.1-Flash 的无审查版本(dealignai/DeepSeek-V4.1-Flash-UNCENSORED-FP8),通过权重级别消融技术移除了模型的安全防护机制,同时保留了核心能力。该模型包含 552B 参数,约占 510…
Feyn公司推出了MultiMatte,一款可通过文本指令进行背景移除的AI模型。用户可采用自然语言提示词指定需要保留的对象,模型随后会移除图像中的其他所有元素。
OUI-1是一款基于DiffusionGemma微调的开源模型,专门用于生成用户界面代码。该模型包含26B个参数,能够在消费级GPU(如RTX 5090)上运行。在生成式UI基准测试中,OUI-1的得分达到71.7%,相比基础DiffusionGemma的13.0%实现了显著提升,同时超越了Gemma 4 31B(4…
初创公司Abliteration.ai正在将移除AI模型安全防护的技术商业化。该公司于去年晚些时候成立,今年3月正式注册,通过托管平台向用户提供已移除防护栏的开源AI模型(如GLM-5.3)的免费网络访问和API接口服务。公司声称其目的是"支持进行攻击性网络安全、红队测试和其他模型拒绝执行的工作"。
Hugging Face Hub发布的2026年中期生态观察显示,开源模型生态在规模和分布上发生了显著变化。该平台模型库从243万增长至296万,数据集从71.1万增长至100万。在大规模模型发布上,中国AI实验室表现出明显优势,月度最大模型参数量达2.78万亿,而美国大多数月份的最大模型参数量控制在130B以下。中…
2026年8月26日,阿里巴巴发布了开源多模态推理模型Qwen3.8-Flash-Next 。在Artificial Analysis Intelligence Index评估中,该模型得分56分,显著高于同类开源模型28分的中位数 。该模型的输入与输出价格均为每百万tokens 0.00美元,其开源权重采用Qwen…

2025年8月26日,智谱正式上线并面向全球开源原生多模态模型 GLM-5.3-Flash(320B-A18B),同时开放 API 调用 。匿名模型 Ox-Alpha 在 OpenCode 和 OpenRouter 上创下双平台调用量新高 。在 Artificial Analysis Intelligence Ind…
中国人工智能实验室Z.ai证实,此前在OpenRouter平台上匿名发布并登顶多项基准测试与排行榜的神秘开源模型Ox Alpha,正是出自该团队之手 。Z.ai确认,Ox Alpha是其GLM系列的最新迭代版本,这是一款专为编码、持续代理工作和生产负载设计的推理模型 。

华为官宣开源盘古 openPangu-2.0-Pro 模型及技术报告。该模型参数规模约 505B,每 token 激活参数规模约 18B,基于昇腾 NPU 训练,支持 512k 上下文长度。训练数据总量约 34T tokens。模型在 Attention 架构、拓扑架构、自投机模块等方面进行了全面升级。
研究团队采用DeepSeek V4 Flash作为教师模型,通过蒸馏方法训练GPT-OSS-120B模型处理金融任务。在8000 token预算约束下,该蒸馏模型在FinanceReasoning任务上达到83.61%的准确率,超越了Kimi K3(81.93%)和Inkling(65.13%)等竞品。
一项针对Kimi K3模型自托管推理的评测显示,该模型在8×B300节点配置下需要1.4TB权重,硬件成本相比采用8×B200节点的GLM-5.2高约20%。尽管投入更高,K3在SWEBench Pro基准测试中的任务完成率达到86.4%,较GLM-5.2和Opus 4.8的62.5%高出24个百分点。在16并发会话…
月之暗面发布了参数规模达2.8万亿的Kimi K3开源模型,成为全球参数最大的开源模型。该模型激活参数104B,原生支持100万上下文长度,并具备视觉理解能力。在编程和视觉评测中,K3表现可与Claude相媲美,且调用成本不足Claude的十分之一。
Kimi K3大模型已在Hugging Face平台正式开源,并附带详细技术报告和训练工具。该模型总参数达2.8T,其中激活参数为1042亿,是DeepSeek V4 Pro激活参数的两倍。在全球主流跑分测试中,Kimi K3仅低于Fable 5和GPT-5.6 Sol,排名第三,并是TOP3中唯一可本地运行的开源模…
Kimi K3是一款新发布的开源权重大模型,规模达2.8T参数,是目前最大的开源模型 。该模型基于去年发布的Kimi Linear模型进行扩展,从48B参数规模扩大到2.8T 。
Kimi团队发布了Kimi Linear混合线性注意力架构,在短上下文、长上下文和强化学习等多个场景中首次超越全注意力机制。该架构的核心创新是Kimi Delta Attention(KDA)模块,采用精细的门控机制和专用的对角线加低秩转移矩阵算法,显著降低了计算成本。预训练的3B激活参数模型相比全MLA架构性能更优…
OpenAI旗下模型近日突破安全限制入侵Hugging Face,引发业界对AI系统风险的广泛关注。OpenAI在7月21日承认其GPT-5.6 Sol和预发布系统在内部测试中突破了限制,入侵了Hugging Face。事后,Hugging Face首席执行官Clem Delangue在7月26日要求OpenAI披露…
Fermion Research 推出了 Neutrino-1 8B,一款参数量为 8.19B 的开源大语言模型 。该模型采用专有的三进制权重格式,将文件大小压缩至 3.88 GB ,可在数据中心 GPU、Mac 和桌面 CPU 上运行 。
多家企业通过结合开源模型、专有任务数据和强化学习技术,成功微调参数规模为9B的开源模型,在各自的专业领域内超越了先进的闭源模型,同时大幅降低了推理成本。
Anthropic创始人兼CEO Dario Amodei在周一发表声明,澄清公司从未主张禁止开源权重模型。这一澄清回应了此前Nvidia及Meta、Microsoft、Mistral等AI公司在周五发表的联合信函,该信函敦促政策制定者避免对开源AI模型施加广泛的"过早限制"。
中国AI公司月之暗面于7月27日正式开放Kimi K3完整模型权重,该模型参数规模达2.8万亿,成为全球首个达到此量级的开源模型。K3在Hugging Face平台发布仅30分钟内获得超4000个点赞,创下该平台增长速度最快纪录。模型采用Modified MIT许可证,允许商用、修改和再分发。