Deepseek

政治外交

川习会将触及AI议题 美中会前就模型蒸馏相互指责

美中即将举行的高层会谈预计将AI问题列为重点议题。美国国家安全局、网络安全和基础设施安全局及联邦调查局联合发表声明,指控中国AI企业DeepSeek、月之暗面、阿里巴巴、MiniMax及阶跃星辰大规模蒸馏美国AI模型。中国官媒人民日报随即回应,主张蒸馏是AI领域"各个模型间互相学习的通行做法,本质是中性技术手段",并…

科技人工智能

DeepSeek 刘胜与发文引热议,称AI将替代人类算子工作

DeepSeek v4.1主Attention算子负责人刘胜与于9月14日发布文章《我不得不把才华埋葬在昨天》,引发网络广泛关注。文章在微信公众号获得10万+阅读量,在知乎热榜排名第一。

科技人工智能

Anthropic披露中国AI公司对Claude模型的蒸馏攻击活动

Anthropic于周四发布报告,揭示了阿里巴巴、Moonshot AI和DeepSeek等中国AI公司针对其Claude模型开展的持续蒸馏攻击活动。这些攻击旨在提取Claude的思维链过程,用于训练规模更小的模型。

科技人工智能

DeepSeek V4.1 Flash 模型正式发布:性能全面超越 V4 Pro、降价最高六成

DeepSeek 正式发布 V4.1 Flash 模型,这是其新模型结构系列中最小尺寸的版本,具备原生多模态视觉理解能力。该模型采用全新 Causal-Encoder-Decoder 结构,为 552B 参数的 MoE 模型,输入激活仅 8B、输出激活 16B,在成本上显著低于同尺寸已知模型。相比初代模型,V4.1…

政治外交

中国驳斥美国AI"蒸馏"指控,双方争端或成特朗普-习近平会谈焦点

美国联邦调查局、国家安全局和网络安全基础设施安全局周二联合发布网络安全建议,指控中国AI开发商自至少2024年末以来,大规模"蒸馏"美国前沿AI模型 。被指控的企业包括DeepSeek、阿里巴巴、Moonshot AI和Z.ai,美国方面声称这些公司从Anthropic的Claude、OpenAI的GPT、Googl…

财经公司

DeepSeek筹备科创板IPO 计划近期发布V4.1 Flash模型

DeepSeek已委托中信证券筹备科创板IPO,目前处于尽职调查阶段,但尚未签署正式上市辅导协议。同时,该公司计划于9月10日前后正式发布V4.1 Flash模型。

中国时政

打开“智治”的盒子:AI政务的城市方法论

南方周末城市(区域)研究中心发布报告,系统梳理人工智能大模型在中国地方政府政务领域的应用现状,涵盖政务服务、机关办公、社会治理、辅助决策四大场景。报告指出政务AI呈现明显梯度分化,头部城市及主城区领跑,同时暴露区域失衡、基层运维薄弱、人才短缺、制度滞后及公众参与缺失等问题,并提出集约化部署、省级底座复用、人机协同与参…

科技人工智能

DeepSeek 发布多模态视觉模型 deepseek-v4-flash-vision-exp

DeepSeek 推出新型多模态视觉理解模型 deepseek-v4-flash-vision-exp,已在 DeepSeek API 平台上线。该模型支持图像和文本的多模态输入,可处理 JPEG、PNG、GIF 和 WebP 格式的图像。用户可通过设置 `model='deepseek-v4-flash-visio…

科技人工智能

中国AI模型性能突进 冲击全球科技市场

中国开发的AI模型正以更低的成本和不断提升的性能威胁美国科技巨头的全球主导地位。Moonshot AI发布的Kimi K3引发华尔街震荡,纳斯达克100指数短暂进入回调区域,韩国Kospi指数7月下跌38%。华盛顿指控这一模型使用了美国专有技术。

科技人工智能

中国大模型厂商以成本优势冲击全球AI产业格局

中国大模型厂商正通过工程化优化和开源策略对全球AI产业产生深远冲击。DeepSeek V3的训练成本约为550万美元,其V4版本在单项基准上与GPT-5.5相当,而DeepSeek V4-Flash的API定价为每百万输入tokens 0.14美元,比GPT-5.5和Claude Opus便宜7到10倍。与此同时,K…

科技人工智能

DeepSeek-V4-Flash正式版API上线公测

DeepSeek于7月31日宣布DeepSeek-V4-Flash正式版API上线公测。该版本在多项Agent基准测试中表现出色,Terminal Bench 2.1达到82.7分,NL2Repo得分54.2分,Cybergym达到76.7分,DSBench-FullStack为68.7分,DSBench-Hard为…

科技人工智能

人形机器人"拐点"已至:产量只是下限,模型决定天花板

机器人行业的价值重构正在加速进行。机器人的定价权正在从硬件本体向大脑模型转移,资本和政策正加速向掌握模型能力的企业集中。2026年上半年国内具身智能赛道融资总额达935亿元,较2025年上半年增长超过5倍。这一融资热潮反映出行业对模型驱动力量的共识,DeepSeek R1的发布证明了模型能力而非算力才是估值溢价的核心…

科技人工智能

OpenAI 大幅下调 GPT-5.6 系列模型费用,Luna 降价 80%

OpenAI 于 7 月 31 日宣布下调 GPT-5.6 系列模型的 API 调用费用。其中,入门款 Luna 模型降价幅度最大,达到 80%,输入价格从 1 美元下降至 0.2 美元,输出价格从 6 美元下降至 1.2 美元。同时发布的 Terra 模型降价 20%,输入和输出价格分别为 2 美元和 12 美元。…

科技人工智能

DeepSeek蒸馏模型未继承中文审查特征,金融推理任务准确率达83.61%

研究团队采用DeepSeek V4 Flash作为教师模型,通过蒸馏方法训练GPT-OSS-120B模型处理金融任务。在8000 token预算约束下,该蒸馏模型在FinanceReasoning任务上达到83.61%的准确率,超越了Kimi K3(81.93%)和Inkling(65.13%)等竞品。

科技人工智能

大模型巨头陷入内卷困局:资本开支巨大却领先窗口被压缩至月级

尽管投入巨大,大模型产业的技术差距已趋于微小,竞争优势转瞬即逝。根据斯坦福AI Index 2026报告,LMArena前四模型的Elo分差不到25分,在税务、金融、法律等测试中前15名模型的差距最小仅为3个百分点。这种技术的快速同质化直接导致排名的频繁变动——过去39个月,LMArena榜首易主21次,平均在位时间…

科技人工智能

Kimi K3正式开源,跻身全球第三梯队

Kimi K3大模型已在Hugging Face平台正式开源,并附带详细技术报告和训练工具。该模型总参数达2.8T,其中激活参数为1042亿,是DeepSeek V4 Pro激活参数的两倍。在全球主流跑分测试中,Kimi K3仅低于Fable 5和GPT-5.6 Sol,排名第三,并是TOP3中唯一可本地运行的开源模…

财经公司

汤臣倍健投资布局AI大模型和芯片产业

保健品龙头企业汤臣倍健近期启动了人工智能产业投资布局。自2026年4月以来,该公司合计投入约4.5亿元参与多家AI领域企业的融资,涉及DeepSeek、月之暗面、阶跃星辰等公司,并扩展到芯片领域。

科技人工智能

全球大模型调用量前五均为中国产品,小米MiMo-V2.5登顶

根据OpenRouter发布的全球AI大模型调用量周榜单,7月20日至7月26日期间,前五席位全部被中国企业自研大模型占据。其中,小米MiMo-V2.5位居榜首,单周调用量达10.5万亿Tokens,环比增长12%。该款产品于2024年4月23日正式公测,4月底完成全系列开源。

科技人工智能

中国AI模型在美国市场加速扩张

中国AI初创企业的模型产品正在美国市场获得显著增长。Moonshot的Kimi K3、Z.ai的GLM-5.2等中国AI模型因价格低廉、性能接近美国顶尖模型而吸引了美国开发者和企业采用。Kimi K3发布后一周内在美国的下载量增长了387%,根据Sensor Tower的数据,该周下载次数超过930,000次。

科技人工智能

瑞银:中国AI成本优势显著 算力短缺成发展瓶颈

瑞银分析师熊瑋发布对中国AI产业的展望,指出中国AI模型在成本控制方面形成了显著竞争优势。部分领先模型的训练成本仅为海外龙头的约1成,API定价也仅为海外同类模型的10%至20%。尽管价格更低,中国模型业者在API业务上仍能维持20%至40%的毛利率。DeepSeek、智譜AI及Kimi等中国领先模型均采取开源策略。