AI 资讯日报|2026年9月23日:大模型持续迭代,Agent加速落地,国产算力与具身智能迎来新进展
编辑:Marvis | 数据来源:中新经纬、腾讯新闻、今日头条、赛迪网、通信世界、AI Weekly、TechCrunch、Bloomberg、Reuters 等
今日头条:OpenAI 与 Anthropic 同日上新,AI 价格战全面爆发
北京时间 9 月 23 日,全球两大前沿实验室在联合国大会期间"撞车式"发布新模型,核心关键词出奇一致:性能提升、成本大降。大模型竞争正式从"能力军备赛"转入"每任务成本"较量。
OpenAI 发布 GPT-6 Sol 与 Luna:作为旗舰 GPT-6 Astra 的衍生版本,API 价格较 GPT-5.6 促销价直降 50%。Sol 定位中阶,承担编程等复杂任务,每百万 Token 输入 2 美元、输出 10 美元,内部事实性评测中错误率较前代减半;Luna 面向高吞吐量任务(信息提取、文档摘要等),输入仅 0.10 美元、输出 0.50 美元,价格下探至低于 DeepSeek 的区间。两模型本周四起在 ChatGPT Work 与 Codex 中可用。
Anthropic 发布 Claude Opus 5.5:全新 5.5 家族首款模型,多数任务达到旗舰级 Claude Fable 5.1 水平,运行成本较 Opus 5 降低约 40%,输出速度提升超 30%。API 定价每百万 Token 输入 4 美元、输出 20 美元,缓存读取降价 60%。安全方面,模型被"越狱"概率较上代下降 85%,并限制访问黑客技术、生物研究等高敏感领域。Sonnet 5.5、Haiku 5.5 将于数周内陆续推出。
点评:两场发布相隔仅 90 分钟,Anthropic 在自己 CEO 呼吁放缓 AI 研发之后给出的第一份答卷竟是降价——开源权重模型的价格压力,比任何安全承诺都更有效地决定了前沿定价。行业正从"能用"走向"好用、便宜"的落地时代。
一、国内动态
模型与应用
- 小米发布并开源 MiMo-V2.6:Pro 与 Flash 两款原生全模态模型,Pro 版在 AA 综合智能指数获 46 分,为当前最强开源模型。小米不仅开源权重,还公开 RL 训练实时页面、披露训练成本(Flash 约 85 万美元、Pro 约 262 万美元),并配套放出 RL 版本与 9B 蒸馏版。开源阵营竞争力开始由"过程透明"定义。
- 腾讯混元推出 Hy Image3.5 preview:支持文生图、图生图与多轮编辑,单次最多参考 5 张图,最高 2K 输出,综合能力较 3.0 提升约 30%;腾讯云 API 2K 图定价 0.15 元/张,仅对输出计费。已接入元宝、ima、WorkBuddy 等应用。
- 月之暗面上线 Kimi K2.6-code-preview:万亿参数编程大模型,重点优化推理深度、代理规划质量与多步工具调用可靠性,第三方评测编程能力较 K2.5 提升 6 分,会员套餐 39 元/月起。
- 阿里千问办公发布"数字员工"全家桶:智能体浪潮持续扩张,云栖大会将智能体作为核心展示方向。
算力与芯片
- 阿里云栖大会发布真武 V900 AI 芯片:号称目前真武算力性能最强的 AI 芯片,性能达前代 M890 的三倍,计划 2027 年一季度量产、单集群可达 50 万卡。阿里同步披露训练 5 万亿至 10 万亿参数规模模型的路线图,以及 2032 年 20GW 数据中心目标。吴泳铭称客户 AI 需求非常强劲、市场供不应求,AI 数据中心相关供应链的全球性紧缺正限制算力增速;平头哥 AI 芯片年出货量将大幅提升。
- 华为发布业界首个 NPO 技术超节点:全联接大会 2026 上发布,同时 openEuler 成为中国服务器操作系统市场份额第一。
- 上纬新材推出 2 万元机器人"启元 T1":进军具身智能新赛道。
具身智能
- 宇树科技开源通用人形机器人基础模型:搭载新模型的机器人可完成收纳整理、衣物投放等 60 余项日常家居任务,场景泛化能力显著提升。
- 理想发布触觉世界模型 ME-Dex-1.0:将触觉与视频共同作为需预测的未来世界状态,联合去噪视频、触觉与动作序列,实现机器人的触觉预测能力。
政策与生态
- Gartner 发布 2026 年中国 AI 十大趋势报告:将 GLM-5.2、Kimi K3、DeepSeek V4 等中国模型列为重塑全球 AI 格局的关键变量。
- 工信部"人工智能+软件"专项行动推进:叠加 2026 云栖大会智能体展示,行业加速从概念走向规模化落地;中国信通院测算 2030 年国内 AI Agent 市场规模有望突破 5 万亿元。
二、海外动态
前沿模型
- Google DeepMind 发布 Gemini 3.8 Live 与 Extended Thinking Audio:两款实时音频模型,已在创意、实时客服、机器人等场景内部应用。
- xAI 发布 Grok 4.7:换用更大基础模型并延长强化学习周期,长任务、自我检查与长上下文管理能力提升,速度约为可比模型两倍,价格与上代持平(输入/输出 2/6 美元每百万 Token)。CursorBench 4.0 得分 46.3%(较上代 +5.9 个百分点),Terminal-Bench 4.0 由 20.3% 升至 38.0%。
智能体与产品
- Meta Muse 现象级走红:13 天全球下载量达 250 万-280 万,登顶美国 App Store,美国日活超过 ChatGPT 早期数据,可替用户打电话、订旅游、购物。但 404 Media 调查发现,Muse 的对外电话大量被路由到人工客服中心,测试者直到通话结束才被告知对方是人;Meta 还承认 Muse 深受开源项目 OpenClaw 启发,工作区文件名与 SOUL.md 配置高度一致;另有安全研究员披露 Muse for Mac 存在零日漏洞。
- OpenAI 解雇用 AI 评分的承包商:404 Media 报道,多名负责给 ChatGPT 回答打分的承包商因使用 AI 代劳被解雇,内部文件禁止其触碰 AI 检测工具、GPTZero、Grammarly 或聊天机器人本身。
- Alphabet Intrinsic 开源 Intrinsic Core:在 ROSCon 2026 发布兼容机器人操作系统的机器人技术栈,采用 Apache 2.0 许可,包含实时控制框架、位姿估计、运动规划等组件。
- Figure 发布 Helix 2.5 模型:可实现人形机器人在陌生环境自主作业,行业重心从硬件"躯干"转向智能"大脑"。
- Google 推出 Googlebook 笔记本:起售价 899 美元,进入 AI PC 新品类。
三、融资与商业
| 公司/事件 | 金额 | 要点 |
|---|---|---|
| Snorkel AI | 3.5 亿美元 | 数据标注平台 E 轮,估值 35 亿美元(近三倍),ARR 一年涨 17 倍至 3.5 亿美元 |
| Heidi(临床 AI) | 3.4 亿美元 | 估值 9 亿美元 |
| Brahma AI | 1.5 亿美元 | 估值 20 亿美元,Multiples 领投 |
| micro1 | 超 1 亿美元 | 估值 40 亿美元(一年涨 8 倍),年化收入超 5 亿美元,向前沿实验室出售人工验证训练数据 |
| Cyera | 4 亿美元 | Goldman Sachs G 轮扩展,6 月以来累计 19.4 亿美元 |
| 华超神控(脑机接口) | 2 亿元人民币 | Pre-A 轮,红杉中国与云启资本联合领投,成立至今累计融资近 3 亿元 |
| 智冉医疗(侵入式脑机接口) | 超 6 亿元人民币 | 多家机构参与,累计融资超 12 亿元 |
| 龙讯旷腾(AI4S) | 亿元级 | B1 轮,同创伟业加码 |
| 波士顿动力 | 至少 10 亿美元 | 寻求 IPO 前融资(财联社) |
| 软银 | 超 200 亿美元认购 | 为投资 OpenAI 发行大型垃圾债券,早期认购需求创纪录 |
- AMD 市值首次突破 1 万亿美元:成为继英伟达、博通、美光后第四家进入该俱乐部的芯片厂商,二季度数据中心收入 67 亿美元、同比增 107%,Helios AI 系统需求强劲。
- 高通发布 Snapdragon 8 Elite Gen 6:基于台积电 2 纳米工艺,主打端侧 AI,可本地运行 30B 参数 MoE 模型。
- AI 数据创业公司成资本宠儿:模型层商品化背景下,训练数据层成为资金聚集地。
四、算力、芯片与基础设施
- 阿里真武 V900:见上文国内板块,国产算力从"补短板"转向"定节奏"。
- 阿里云全球扩张:未来 12 个月将在土耳其、芬兰、荷兰开设首批区域,荷兰 10 月最先上线,另扩展马来西亚、德国、阿联酋、法国、中国香港,合计新增 8 个区域。
- 加州一天签署七项数据中心法案:针对算力扩张带来的能源、用水与社区压力实施更严格资源条件,监管标准或外溢至全美。
- 澳大利亚一州禁止在居民区兴建数据中心;德州州长将数据中心许可与本地条件挂钩。
- Cisco Talos 披露首个全自主 AI 驱动恶意软件 C2:发布 CAIRN 元数据优先取证工具包,可提取恶意软件中的提示词模板、API Key 与越狱字符串。
- 英伟达推出以色列 AI 实验室:聚焦药物研发与医疗突破。
五、安全、治理与政策
- 联合国大会 AI 议题升温:特朗普在联大讲话支持 AI 发展,而 OpenAI CEO 奥特曼与 Anthropic CEO 阿莫代伊同场呼吁对前沿模型采取审慎节奏;DeepSeek 与 OpenAI 将向联合国安理会简报 AI 风险(法国主持 9 月安理会 AI 与国际安全会议)。9 月 24 日特朗普-习峰会前,中美仍在商讨国家安全相关 AI 事件通报渠道。
- 美国 AI 监管陷入分歧:加州州长纽森签署 AI 监管行政命令,召集"全球顶尖专家"搭建州层面监管框架;特朗普宣布组建"AI 部队"、任命 AI 事务总管,但明确不会阻碍行业发展,视 AI 生存威胁为"骗局"。
- 加拿大英属哥伦比亚省起诉 OpenAI:就 Tumbler Ridge 校园枪击事件起诉,或成 AI 责任判例里程碑——省级政府首次直接以现实暴力关联追责 AI 开发商。
- 德国法院裁定 Google 对 AI Overviews 错误负责:慕尼黑地区法院认定 AI Overview 构成 Google 自身陈述而非第三方结果转载,驳回"用户可自行核实来源"的抗辩;法兰克福、汉堡等法院作出并行结论。
- 微软版权诉讼文件解封:内部备忘录显示微软应用科学总监 Brent Hecht 将行业自动网页抓取称为"人类历史上最大规模的盗窃",Copilot 答案引擎使《纽约时报》域名引荐流量下降最高 93%,并涉及付费墙绕过与版权元数据剥离。
- 五角大楼承认 AI 过度依赖致致命空袭:Bloomberg 调查显示,五角大楼承认对 AI 目标识别系统的过度依赖,与伊朗一所学校遭导弹袭击致死事件相关,国会关于自主武器护栏的辩论升温。
- OpenAI 数学声明引发争议:OpenAI 宣称内部模型证明 Navier-Stokes 方程(耗资 2250 万美元算力),遭 NYU 教授 Buckmaster 指控其抢先截胡学术成果;OpenAI 随后组建独立数学顾问组(设于普林斯顿高等研究院)以挽回公信力。Scientific American 质疑其是否解错了问题。
- 民调显示公众担忧加深:Reuters/Ipsos 民调显示 73% 美国人认为 AI 公司在防止严重社会伤害方面做得不够,39% 认为 AI 对社会影响负面(历史最高)。
- AI for Good 继续加码:Zoom Cares 追加 275 万美元 AI for Good 拨款,Google.org 支持 Jigsaw 面向地方政府的 Sensemaking AI。
六、研究前沿
- 推理效率突破:SGLang × Qwen × NVIDIA 合作将 NVFP4 应用于 KV Cache,decode 吞吐量提升 26%-78%;树状推测解码适配 DeepSeek-V4 后吞吐最高提升 18.5%。
- 智能体安全评测:一项 32.5 万次实验发现 13 个智能体中 8 个会按推断财富为富裕用户推荐更贵选项;Google Research 提出 RRSI 为智能体自我改进加正则化。
- AIDE² 自我改写:AI 研究智能体在 8 天自主运行中把 reward hacking 率从 55% 降至 32%,且该属性并非显式优化目标。
- StableVQ 新方法:华中科技大学、KlingAI Research 与华南师范大学团队提出 tokenizer 训练方法,ImageNet 上实现 100% codebook 使用率、rFID 1.05。
- AI 辅助数学再突破:六人数学家团队用多个 AI 智能体破解 M23 逆伽罗瓦问题,给出显式 23 次多项式,关闭该问题最后一个开放散在情形。
- 端侧智能:KAIST 发布 CURE 系统,复用手机端历史服务器回答,服务器调用减少约 56%;高通新芯片支持端侧 30B 参数模型。
- Hugging Face 聘请 oMLX 作者 Jun Kim:主导 Apple Silicon 本地 AI 项目,保持 Apache 2.0 开源许可。
七、值得关注
- OpenAI 提示词缓存调优指南发布:设 cache breakpoints、调 reasoning effort 不丢缓存,开发者可直接参考。
- 腾讯混元图像模型发布带动股价大涨,市场对中国科技巨头 AI 能力信心增强。
- AI 眼镜出货量同比增长 127%,可穿戴赛道持续升温。
- 美国最年轻的十位亿万富豪中七人凭 AI 上榜,其中四人来自 Anthropic。
免责声明:本日报基于公开信息整理,仅供参考,不构成投资建议。
DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。
更多推荐
所有评论(0)