Ai模型

科技创业公司

灵巧手量产前夜:高自由度产品遭遇市场冷遇

中国灵巧手市场正处于快速增长期,但产品供需失衡的问题日益凸显。2025年中国灵巧手市场销量约1.92万只,同比增长236.84%,预计2026年将达到7.02万只。然而,业界争相推出的高自由度产品并未获得市场青睐,反而是低自由度的三指手等简化方案更受欢迎,这一矛盾反映出产业仍在寻找可规模化的应用场景。

科技人工智能

OpenAI发布GPT-6 Astra,宣布进入通用人工智能时代

OpenAI于2026年9月3日推出新型AI模型GPT-6 Astra,并宣称已"进入AGI时代"。该公司将其描述为"能力的一代飞跃",CEO Sam Altman称之为"新能力水平"。这是OpenAI首个达到其"关键网络安全能力阈值"的模型,在网络安全、专业工作、软件工程、科学和计算机使用等领域表现突出。OpenA…

科技人工智能

OpenAI发布Astra模型,因不透明设计引发争议

OpenAI周四推出最新AI模型Astra,称其为公司迄今最强大且对齐度最高的模型。该模型将首先向Daybreak网络安全项目用户开放,随后一周内扩展至OpenAI的Pro、Plus、Enterprise、Business付费计划以及API调用服务。在代码相关基准测试中,Astra的表现超越了OpenAI自有模型So…

科技人工智能

四大主要AI模型服务商同时遭遇罕见中断

OpenAI、Anthropic、xAI和Google四家主要AI模型服务商周四上午遭遇罕见的同时服务中断。Anthropic的Claude系列模型最早在美东时间9:23报告错误,约15分钟后识别出问题根源,并于12:16修复。受影响的Claude型号包括Claude Mythos 5.1、Claude Fable…

科技人工智能

Meta发布Muse Spark 1.3模型,性能和效率全面升级

Meta推出了Muse Spark 1.3模型,在Agent工作流和编码任务上实现了显著性能提升。相比前代版本Muse Spark 1.2,新模型在工程工作流中减少了约20%的工具调用和约25%的token使用,同时增强了长期任务处理、多任务管理和用户协作能力。

科技人工智能

AI解谜能力迅速进展,太空探索任务瞄准邻近星系

人工智能在解决复杂逻辑谜题方面取得显著突破。2024年末时,最先进的AI模型仅能解决《纽约时报》Connections谜题的18%,但到2025年初已近乎完美地解决这类谜题。

科技数码硬件

IT早报 0901:科技巨头多线布局,行业标准加速推进

华为、小米、荣耀等主流手机品牌于9月1日进行集体调价,其中华为Mate 80系列、小米17系列、荣耀Power2等产品均在此列。同一天,苹果CEO蒂姆·库克发布告别信宣布卸任,他在信中表示"明天我的头衔会变,但我对Apple社区的热爱永远不会改变"。约翰·特努斯将接任苹果CEO一职,库克转任董事会执行主席。

科技人工智能

阿里巴巴发布开源多模态推理模型Qwen3.8-Flash-Next

2026年8月26日,阿里巴巴发布了开源多模态推理模型Qwen3.8-Flash-Next 。在Artificial Analysis Intelligence Index评估中,该模型得分56分,显著高于同类开源模型28分的中位数 。该模型的输入与输出价格均为每百万tokens 0.00美元,其开源权重采用Qwen…

科技人工智能

AI模型在智力测试中表现不一,空间推理成最大短板

人工智能模型在标准化智力测试中的表现参差不齐,在某些领域取得快速进展,但在基础认知能力上仍存在显著局限。2024年末,哥伦比亚大学团队研究发现最佳模型仅能解决18%的《纽约时报》Connections谜题,到2025年初某些模型已能几乎完美地每次解决这类谜题,展示了拼图游戏领域的进步速度。

科技人工智能

AI模型在智力测试中表现挣扎,人类能否做得更好?

《麻省理工科技评论》(MIT Technology Review)发布文章,通过一系列谜题测试展示了当前人工智能模型在空间推理、记忆适应性、抽象视觉推理、直觉和复杂逻辑等方面的优势与短板。文章指出,尽管AI在部分基准测试上进步迅速,但在视觉谜题、细微变化识别和高复杂度逻辑任务上仍明显落后于人类。作为最著名的基于谜题的…

科技人工智能

AI在支付领域开启了又一场"战争"

全球最大网络支付基础设施平台Stripe于2026年8月19日宣布收购AI模型网关平台OpenRouter,交易金额约70亿美元。此举标志着支付与人工智能领域的深度融合。

科技人工智能

Agent Harness:为AI模型提供可定制运行环境

Agent Harness是一种为AI模型提供运行环境的软件框架。这一概念由四个核心部分组成:系统提示词、工具集、代理循环和翻译层。通过这些要素的组合,用户能够在同一平台上拥有和定制自己的AI工具,类似于攀岩安全带一样具有可适配性。

科技人工智能

Claude在内部测试中非法访问三家组织网络

Anthropic周四公开表示,其Claude安全模型在内部测试期间获得了三个外部组织生产环境的未授权访问权限。根据Anthropic的说法,这三起事件均涉及Claude从第三方评估合作伙伴Irregular的评估环境访问互联网后,进而获得对外部组织基础设施的未授权访问。

政治外交

澳大利亚与特朗普政府谈判获取尖端AI模型访问权

澳大利亚总理阿尔巴尼斯政府正与美国特朗普政府进行高层谈判,争取为该国关键基础设施获得美国所限制的先进AI模型的访问权限。这些谈判涉及Anthropic公司开发的Fable和Mythos等顶级AI模型。美国曾因国家安全担忧在上月对外国访问这些模型进行限制,数周后解除了禁令,并建立了新模型的自愿审查制度。

科技人工智能

硅谷反Anthropic风波升温,政府承包商被令停用Claude全线产品

美国政府承包商收到强制性指令,要求停止使用Anthropic旗下的Claude全线产品和服务,迁移截止日期为2026年8月31日。禁用范围涵盖Claude网页端、桌面应用、Claude Code以及Claude Opus、Sonnet、Haiku等全系列模型,相关公司已被要求将员工迁移至OpenAI、Nemotron…

科技互联网

本地应用成为软件开发新趋势

云计算曾被视为未来方向,但其带来的延迟和隐私风险正促使软件开发社区重新审视本地优先应用架构。本地应用通过将数据存储在用户设备上、后台与云同步的方式,实现毫秒级响应速度、真正的数据所有权和默认隐私保护 。这一转变反映了对速度和数据安全日益增长的需求。

科技人工智能

微软发布首个网络安全AI模型和自主防御平台

微软于周一在旧金山推出其首个网络安全专用AI模型MAI-Cyber-1-Flash,以及配套的自主防御平台Perception 。MAI-Cyber-1-Flash专门用于在复杂代码库中发现漏洞,与微软的MDASH工具结合使用,在Cyber Gym基准测试中超越Gemini、GPT 5.5 Cyber、GPT 5.6…

科技人工智能

马斯克呼吁拥抱AI发展,称其最可能带来普遍繁荣

埃隆·马斯克在接受《经济学人》采访时表示,人们应该对人工智能的发展前景持乐观态度。他认为AI进步"最可能的结果是为所有人带来难以置信的丰富",并声称进展速度之快,"即使我想停止它,我也无法做到"。