AI新闻日报_2026-08-07
AI 新闻日报|2026-08-07
主题: AI Coding 生态走向标准化与硬件自研,具身智能进入"全身控制"与"百万小时数据"竞赛新阶段
编制时间: 2026-08-07
本期看点: Agent Plugins 统一插件规范、Meta 首款编程 Agent 下场、NVIDIA Cosmos 3 开放物理 AI 基座
一、要闻速览(Top Stories)
| 序号 | 事件 | 标签 | 关键词 |
|---|---|---|---|
| 1 | Agent Plugins 1.0.0 发布:Google/Amazon/Microsoft/OpenAI/Cursor/Vercel 联合推出统一智能体插件规范 | AI Coding | 统一规范、MCP、跨客户端、开放标准 |
| 2 | xAI Grok 4.6 正式发布:1.5T 参数后训练升级,定价 $2/$6 直逼 Kimi K3 | AI Coding | 1.5T 参数、后训练、价格战、Agent |
| 3 | Meta 发布 Muse Code + Muse Spark 1.2:首款编程 Agent,Terminal-Bench 2.1 仅次于 Opus 5 | AI Coding | Meta 编程 Agent、协同训练、异步后台 |
| 4 | Anthropic 首次确认自研 Claude 定制芯片:软硬件协同设计,年薪最高 48.5 万美元 | AI Coding | 自研芯片、软硬件协同、推理成本 |
| 5 | OpenAI 优化 GPT-5.6 Sol:免费用户无限使用 Luna,新增思考力度滑块 | AI Coding | GPT-5.6、免费开放、思考滑块 |
| 6 | NVIDIA Cosmos 3 发布:混合 Transformer 架构全模态世界模型,五项基准第一 | 具身智能 | 世界模型、物理 AI、开放权重、五项第一 |
| 7 | Google DeepMind 发布 Gemini Robotics 2:首个"脚趾到指尖"全身统一策略 | 具身智能 | 全身控制、VLA、多机协作、ASIMOV |
| 8 | 宇树科技科创板定价 150.8 元/股,DeepSeek 参与战略配售,市值约 610 亿 | 具身智能 | IPO、DeepSeek、600 亿市值、人形机器人 |
| 9 | 黎曼动力联合光轮智能/诺亦腾冲刺全球首个 100 万小时具身数据 | 具身智能 | 数据底座、百万小时、Scaling、三方联盟 |
| 10 | 北京发布智能体十项举措:国内首个省级智能体全链条政策,最高 1 亿元支持 | 综合 | 智能体政策、Token 经济、OPC、十项举措 |
筛选标准:5-10 条,侧重 AI Coding 与具身智能方向;每条一句话概括事件 + 快速定位标签。
二、AI Coding 方向深度动态

1. Agent Plugins 1.0.0:六大巨头联合推出统一智能体插件规范
事件: 2026 年 8 月 6 日,Vercel 联合 AWS、Cursor、Microsoft、OpenAI 正式发布 Agent Plugins 1.0.0 开放规范,Google 同日宣布作为核心维护者加入。
核心能力 / 产品细节:
- 统一目录结构:
plugin.json清单 +skills/目录 +mcp.json配置,一次打包即可跨客户端使用 - 首日支持客户端:ChatGPT/Codex、Cursor、GitHub Copilot、VS Code、Kiro(AWS)共 6 大平台
- 技术指导委员会核心维护者来自 Amazon、Cursor、Microsoft、OpenAI、Vercel 五方,Google DeepMind 高级工程师 Kevin Hou 代表 Google 加入
- 规范刻意精简:v1 仅标准化 Agent Skills 和 MCP 服务器两种组件,安装/分发/权限留给各客户端自行实现
值得关注的原因:
- 终结"重打包税":此前同一 Skill/MCP Server 需为每个客户端分别适配元数据、发现路径和配置格式,现在一次打包跨平台运行
- 行业首个跨厂商中立标准:五大巨头放弃各自封闭格式共同推进,类似 npm 之于 JS 生态、OCI 之于容器
- 与 MCP 2026-07-28 无状态规范同月落地:工具链生态正在围绕一小组合约快速收敛
2. xAI Grok 4.6 正式发布:1.5T 参数后训练升级,价格不变直逼 Kimi K3
事件: 2026 年 8 月 7 日,xAI 正式发布 Grok 4.6,沿用 Grok 4.5 的 1.5 万亿参数 V9 基座,通过强化 SFT 与 RL 后训练实现性能提升。
核心能力 / 产品细节:
- 1.5T 参数 MoE 架构不变,改进集中在监督微调(SFT)和强化学习(RL)两个后训练环节
- 定价维持 $2/$6 每百万 Token(输入/输出),API 端点不变,迁移仅需一行代码改模型名
- 500K 上下文窗口延续,
reasoning_effort参数支持 low/high 切换 - Grok 4.7(2.1T 参数)预计数周后发布,xAA 进入约 4 周一版的模型迭代节奏
- 通过 SpaceXAI 控制台、GitHub Copilot(VS Code)、Azure AI Foundry 三大渠道分发
值得关注的原因:
- 后训练效率路径验证:在不扩大参数的前提下通过 SFT+RL 获取增益,验证了"卷后训练"路线的投入产出比
- 价格战持续施压:$2/$6 定价对比 Kimi K3 的 $3/$15,输出 Token 便宜 2.5 倍,对高用量 Agent 场景吸引力显著
- 4 周迭代节奏颠覆采购逻辑:按版本采购已过时,平台渠道价值超过单一模型版本
3. Meta 发布 Muse Code + Muse Spark 1.2:首款编程 Agent 下场参战
事件: 2026 年 8 月 5 日,Meta 正式发布 Muse Code 终端编程 Agent 测试版,由 Muse Spark 1.2 模型驱动,扎克伯格亲自在 X 平台官宣。
核心能力 / 产品细节:
- Muse Spark 1.2 Terminal-Bench 2.1 得分 82.9%,DeepSWE v1.1 得分 59.3%,均仅次于 Claude Opus 5(max)
- 1M Token 上下文窗口,支持文本/图像/视频/PDF 输入
- 模型与 Agent 框架协同训练(Co-training):Muse Spark 1.2 在训练阶段即与 Muse Code 工具集绑定
- 异步后台智能体设计:子 Agent 整个会话持续运行而非按任务临时创建,降低延迟与重复探索
- 本地事件日志:模型调用/工具运行/审批/编辑全部 append-only 记录,崩溃后精确恢复
- Contributor 版定价 $0.10/$0.20(输入/输出),比标准版便宜 10 倍以上
值得关注的原因:
- Meta 正式入局编程 Agent 赛道:从 Llama 开源模型转向全栈编程 Agent 产品,与 Anthropic/OpenAI 三足鼎立格局形成
- 协同训练范式:模型与 Harness 同时开发,不同于"通用模型+适配编码"的传统路径
- 自我改进闭环:用 1.1 生成高难度编程环境和指令模板,再自评筛选构建 1.2 训练数据,无需外部标注
- 激进定价策略:Contributor 版价格比竞品低一个数量级,以量换数据
4. Anthropic 首次确认自研 Claude 定制芯片
事件: 2026 年 8 月 5 日,Anthropic 首次公开确认正在组建内部"定制芯片团队",为 Claude 模型设计专用 AI 处理器。
核心能力 / 产品细节:
- 软硬件协同设计策略:芯片与 Claude 模型同步开发、相互塑造架构,类似苹果 M 系列和谷歌 TPU 路径
- 招聘覆盖芯片架构、前端设计、验证、物理设计、晶圆制造与封装全流程,年薪 32 万至 48.5 万美元
- 核心人物 Clive Chan:曾任 OpenAI 芯片团队早期成员(参与 Jalapeño 项目),此前在特斯拉 Dojo 超算项目
- 坚持多芯片策略:AWS、谷歌、英伟达、AMD 硬件仍为算力主力
- 已与三星就 2nm 制程和先进封装技术接触(7 月初 The Information 报道)
值得关注的原因:
- 推理成本压力驱动:Anthropic 年化收入运行率已达 470 亿美元,推理是持续性成本黑洞,ASIC 可将每 Token 成本降低约 50%
- 头部大模型厂商竞争延伸至底层硬件:OpenAI 有 Jalapeño(博通合作),Mistral 也在考虑自有芯片
- 对 Transformer 架构稳定性的押注:ASIC 制造后不可重编程,投资定制芯片意味着 Anthropic 对 Transformer 核心计算模式的长期信心
5. OpenAI 优化 GPT-5.6 Sol,免费用户获无限 Luna 访问
事件: 2026 年 8 月 6 日,OpenAI 更新 ChatGPT 中的 GPT-5.6 Sol,提升事实准确性与回答聚焦度,同时扩大免费用户对 GPT-5.6 Luna 的访问权限。
核心能力 / 产品细节:
- Plus 和 Pro 用户的 GPT-5.6 Sol 在事实准确性和回答聚焦度上有所提升
- 新增思考力度滑块,用户可控制模型思考投入程度
- 免费用户默认模型升级为 GPT-5.6 Luna,开放无限文本聊天
- 新增 Think 按钮,免费用户可处理更复杂问题
值得关注的原因:
- 免费层无限对话:OpenAI 通过扩大免费访问争夺用户基数,与 Meta Contributor 版低价策略形成呼应
- 思考力度可调:将推理深度控制权交给用户,体现了"推理即服务"的产品化趋势
- 模型快速迭代:GPT-5.6 系列在发布后持续优化,反映前沿模型从"版本发布"转向"持续流式更新"
三、具身智能方向深度动态

6. NVIDIA Cosmos 3:开放物理 AI 全模态世界模型,五项基准第一
事件: 2026 年 8 月 6 日,NVIDIA 发布 Cosmos 3——基于混合 Transformer 架构的开放物理 AI 基础全模态模型,整合视觉推理、世界生成与动作预测。
核心能力 / 产品细节:
- 三档模型:Cosmos 3 Super(64B,高保真世界建模)、Cosmos 3 Nano(16B,高效推理与后训练)、Cosmos 3 Edge(4B,边缘设备实时推理)
- 五项基准第一:Artificial Analysis 开源文生图/图生视频、PAI-Bench 世界生成、Physics-IQ 图生视频、RoboLab 机器人策略、VANTAGE-Bench 视觉理解
- 采用 Linux Foundation OpenMDW 1.1 许可证,允许在自有数据和硬件上后训练
- 配套 Omniverse 库(仿真环境)+ OpenUSD(3D 数据框架)+ Isaac GR00T(机器人)+ Alpamayo(自动驾驶)+ Metropolis(视觉 AI)
- 已知采用方:Doosan Robotics、LG、Samsung、理想、小米、Skild AI 等
值得关注的原因:
- “一个模型家族覆盖全链路”:VLM 推理、世界模拟、动作预测三种能力合一,取代此前需分别维护多个专用模型的拼接架构
- 开放权重是物理 AI 的技术刚需:每个机器人/工厂/车队都有不同传感器和场景,必须后训练适配——开放不是营销卖点而是技术前提
- 边缘部署能力:4B 模型可在 Jetson Thor 上运行,从 DGX 到机器人本体同一架构贯通
7. Google DeepMind Gemini Robotics 2:首个"脚趾到指尖"全身统一策略
事件: 2026 年 7 月 30 日发布,本周持续引发行业讨论。Google DeepMind 发布 Gemini Robotics 2,首次将机器人控制从上半身扩展至全身——从脚趾到指尖,单一学习策略驱动完整人形机器人。
核心能力 / 产品细节:
- 三模型分工:Gemini Robotics 2(VLA 全身控制)+ ER 2(具身推理与多步规划)+ On-Device 2(边缘本地运行)
- 全身协调:行走、蹲下、弯腰、抓取一体化,消除传统"移动+操作"分离架构的脆弱切换点
- 多机器人协作:ER 2 可将任务分派给不同机器人协同完成,支持失败后从最后成功步骤恢复
- On-Device 2 适配:仅需不到 200 个训练样本、数小时即可适配新型双臂机器人
- ASIMOV-Agentic 安全基准:评估 Agent 拒绝不安全工具调用、预测任务可行性、主动请求人工干预的能力
- 已在 Apptronik Apollo 2(配备 22 自由度 SharpaWave 手)上验证
值得关注的原因:
- 架构范式转移:从"分离式控制(移动+操作各管一段)“转向"端到端统一策略”,这是机器人学习领域三年来最重要的架构突破
- 诚实的性能数据:精密插装 89.6% 成功率,但从地面拾取仅 45.7%,五指簸箕任务仅 32%——架构里程碑与不均匀性能并存
- 安全从附属变核心:ASIMOV-Agentic 首次将"拒绝不安全操作"作为可评测指标,为具身智能部署划定安全边界
8. 宇树科技科创板定价 150.8 元/股,DeepSeek 参与战略配售
事件: 2026 年 8 月 6 日,宇树科技公告科创板 IPO 发行价定为 150.80 元/股,对应上市市值约 609.93 亿元,网上申购日为 8 月 10 日。
核心能力 / 产品细节:
- 发行 4044.6434 万股(发行后总股本 10%),预计募资总额约 60.99 亿元,超募(原计划 42.02 亿元)
- 发行市盈率 219.23 倍,远高于行业平均 38.56 倍
- 战略配售阵容:社保基金(第一大)、DeepSeek(93.34 万股,限售 36 个月)、中石油昆仑资本、南方电网产融、天翼资本、腾讯旗下启善投资等 9 家
- 2025 年营收 16.99 亿元,扣非净利润 5.9 亿元;预计 2026 上半年营收 10.52-11.28 亿元
- 募资近半投向模型研发(WMA + VLA 两大技术路线),"本体+小脑+大脑"全栈技术体系
值得关注的原因:
- DeepSeek 战略入股人形机器人:大模型龙头与机器人本体厂商深度绑定,聚焦 AI 大模型与具身智能技术整合,36 个月限售期显示长期合作意愿
- A 股具身智能第一股估值锚定:610 亿市值 + 219 倍市盈率为后续排队企业设定参照系
- "量"和"智"双线进阶:2025 年人形机器人出货超 5500 台,募资同时押注模型能力提升
9. 黎曼动力联合光轮智能/诺亦腾冲刺全球首个 100 万小时具身数据
事件: 2026 年 8 月 7 日,黎曼动力联合光轮智能(仿真基建)和诺亦腾机器人(动捕数据),宣布共建具身智能数据底座,目标 2026 年底完成 100 万小时机器人训练数据采集。
核心能力 / 产品细节:
- 三方分工:黎曼动力(机器人大脑/模型)+ 光轮智能(仿真基建)+ 诺亦腾(人体动作捕捉)
- 目标规模:100 万小时,为当前全球高质量具身交互数据存量(约 50 万小时)的两倍
- 黎曼动力已用 23.2 万小时数据训练 Riemann-1.0,初步验证 Scaling 路线
- 刚拿下仿真、真机双 SOTA,将分散的采集/仿真/训练/评测接成一条线
- 行业背景:Physical Intelligence 训练 π0 时使用超 1 万小时数据已是当时最大规模之一,当前全球达到数十万小时的模型仍屈指可数
值得关注的原因:
- 具身智能 Scaling 的核心瓶颈是数据:大语言模型靠互联网语料实现 Scaling,机器人数据每一帧都要人工标注或遥操采集,无法照搬"数据飞轮"
- 联盟模式破解数据孤岛:单打独斗难以回答"机器人能否 Scaling"这一终极命题,三方组队从采集/仿真/训练/评测全链路整合
- 100 万小时可能成为分水岭:如果数据规模翻倍能带来质的泛化能力跃升,将为具身智能的"GPT 时刻"提供实证
四、产业趋势总结
- AI Coding 生态标准化加速:Agent Plugins 1.0.0 六大巨头联合推出统一插件规范,MCP 无状态规范同月落地,工具链生态正围绕小组合约快速收敛——"一次打包、跨客户端运行"成为新基线。
- 编程 Agent 进入"协同训练"时代:Meta Muse Spark 1.2 与 Muse Code 同时开发、模型与 Harness 绑定训练,打破了"通用模型+适配编码"的传统路径——模型与工具的协同设计成为新竞争力维度。
- 头部 AI 公司全面下沉至芯片层:Anthropic 确认自研 Claude 定制芯片,OpenAI 已有 Jalapeño,推理成本压力驱动大模型厂商从"芯片消费者"变为"芯片设计者",软硬件协同设计成为降本核心路径。
- 具身智能架构进入"统一策略"纪元:Gemini Robotics 2 首次实现"脚趾到指尖"全身单一学习策略,NVIDIA Cosmos 3 用一个模型家族覆盖推理/生成/动作全链路——从"拼接式 VLA"到"原生融合全模态"的架构跃迁正在发生。
- 具身智能数据竞赛白热化:黎曼动力目标 100 万小时(当前全球存量两倍),宇树科技募资近半投向模型研发——数据规模而非本体数量正成为决定胜负的关键变量。
- 政策与资本同步加码智能体赛道:北京发布国内首个省级智能体全链条政策(最高 1 亿元支持),宇树科技 IPO 募资 61 亿、上半年具身智能融资 935 亿——政策给出方向、资本通道紧跟,衔接紧凑。
从当天筛选的 10 条中提炼 6 条跨事件共性趋势。
五、值得持续关注的信号
- Agent Plugins 规范 的生态采纳速度——6 大客户端首日支持,但实际插件作者迁移意愿和社区仓库规模仍待观察;
- Grok 4.7(2.1T 参数) 的发布时间与独立基准评测——xAI 的 4 周迭代节奏能否持续,以及 Grok 4.6 在 Arena Agent 排行榜的实际表现;
- Meta Muse Code 开源计划——扎克伯格暗示"很快有更多分享",Muse Spark 是否开源将影响编程 Agent 竞争格局;
- Anthropic 自研芯片流片时间——当前仍处于早期阶段,三星 2nm 制程合作和量产时间节点尚未确认;
- NVIDIA Cosmos 3 Edge 在 Jetson Thor 上的实际推理性能——4B 模型边缘部署的延迟/功耗/泛化表现将决定物理 AI 落地速度;
- Gemini Robotics 2 全身策略的第三方验证——地面拾取 45.7% 和五指任务 32% 成功率是否能通过后续迭代快速提升;
- 宇树科技 8 月 10 日申购及上市后表现——610 亿市值锚定能否站住,将影响后续排队 IPO 的具身智能企业估值;
- 黎曼动力 100 万小时数据目标——年底能否达成,以及数据规模翻倍是否带来泛化能力的质变跃升。
从当天报道中提取值得长期跟踪的信号或待验证的节点。
本日报基于公开报道整理,仅供参考。
DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。
更多推荐

所有评论(0)