01 产品发布

阿里正式发布Wan3.0,AI视频生成继续加速

阿里巴巴8月24日正式推出新一代AI视频生成模型Wan3.0。此次发布正值阿里刚完成约102亿美元股票配售,资金将重点用于AI相关投入。Wan3.0的推出,也进一步显示中国大厂正在持续加码多模态和AI视频生成赛道。

飞象老师3.0正式发布,新增一键生成可运行教育应用

飞象星球上线飞象老师3.0版本,新增教育应用生成能力。用户仅需自然语言描述需求,数分钟内即可生成带独立访问链接、支持AI调用与数据留存的完整教育应用,全程无需代码开发与部署,覆盖教学练习、管理等多类场景。新版本同步强化高保真文档解析、3D互动教学内容生成、音视频素材融合等底层能力,优化组题命题、错因诊断等教育专属功能,支持应用长期迭代与版本回退。

小米发布三款自研芯片,玄戒O3、O100、D100覆盖全场景

小米正式发布玄戒O3、玄戒O100、玄戒D100三颗全新自研芯片。其中,3nm工艺的玄戒O3作为旗舰手机SoC,安兔兔跑分突破522万,成为首款超500万分的安卓旗舰芯片,支持LPDDR6内存,主打AI原生芯片,将首发搭载于小米18 Fold。玄戒O100是全球首款6nm晶圆级堆叠AI加速芯片;玄戒D100是国内首颗3nm智驾芯片,支持车载与桌面终端算力,可支撑超大参数AI模型部署,小米还基于其打造AI Cube桌面原型机,实现大小模型按需切换运行。三颗芯片分别覆盖手机、AI算力、车载及桌面终端,构建全场景端侧算力底座。

GPT-5.6登陆Kiro,三款模型助力开发者成本降低82%

OpenAI官方宣布,GPT-5.6模型家族现已登陆软件开发智能体Kiro,包含Sol、Terra和Luna三款模型。在Terminal-Bench 2.1测试中,GPT-5.6 Terra在Kiro内完成任务成本较前代降低约82%。该更新由OpenAI与AWS合作优化,旨在以更少迭代和更高token价值帮助开发者产出更高质量代码。

NVIDIA Vera Rubin NVL72发布,AI智能体效率每瓦特工作量提升30倍

据NVIDIA官方博客,实测数据显示,Vera Rubin NVL72在智能体工作负载下每兆瓦吞吐量较GB300 NVL72最高提升30倍,每百万token成本降低至35倍,树立AI智能体效率新标准。

Meta开源MetaRoCE协议,专为AI规模以太网打造全新RDMA传输

Meta官方宣布设计并开源MetaRoCE,一个专为AI工作负载在通用以太网上打造的RDMA传输协议,已通过Open Compute Project(OCP)发布规范,包含参考软件实现和合规测试套件。该协议将智能移至端点,原生支持乱序交付、多路径、无损容忍和双向拥塞控制,无需PFC,可在百万GPU规模下提供高吞吐、低尾延迟,现有RDMA Verbs API和软件栈无需修改即可运行。

NVIDIA推出NVLink Fusion,让定制XPU融入AI工厂

NVIDIA官方发布NVLink Fusion,将定制XPU接入其NVLink扩展域,使XPU间端到端延迟比基于现成以太网的方案低3倍,数据包速率高10倍,助力构建世界级AI工厂。

Meta发布MTIA 300训练芯片,首款内置NIC与通信卸载引擎

Meta官方宣布推出MTIA 300,这是其首款内置网络接口卡(NIC)与通信卸载引擎的训练芯片,旨在提升大规模AI训练效率,进一步强化Meta在AI基础设施领域的自研布局。

Thomson Reuters推出自研大模型:企业开始“自己造模型”

Thomson Reuters 8月24日正式推出自研大语言模型Thomson,这是该公司首个自主开发的LLM。

官方表示,公司投入约4000万美元进行训练,并基于开源基础模型,再利用Westlaw、Practical Law、Checkpoint和Reuters等多年积累的专业数据进行中后训练。

更值得注意的是,Thomson并不是追求通用模型的最大规模,而是针对法律、税务、监管等专业场景进行深度优化。

02 产品更新

字节跳动整合TRAE与扣子至豆包体系,将推统一办公品牌“豆包工作”

字节跳动完成旗下办公AI产品团队整合,TRAE、扣子(Coze)团队整体并入豆包体系。其中,TRAE Work、扣子将与豆包的工作场景产品能力融合,TRAE IDE及CLI则作为豆包品牌下的编程产品线继续运营。此番调整后,豆包被明确为AI主干业务,办公类产品重心全面集中。据称,字节最快本周内推出独立AI办公产品“豆包工作”,作为面向办公场景的统一品牌。

NVIDIA扩展Vera Rubin推理能力,Groq 3 LPX全面投产支持智能体系统

NVIDIA官方宣布Vera Rubin NVL72扩展快速token生成能力,以支持智能体系统。其机架级系统NVIDIA Groq 3 LPX已全面投产,旨在通过AI工厂各层协同工作来定义下一代AI推理,而非依赖单一芯片、网络或系统的突破。

03 行业动态

蔚来智驾负责人任少卿创立具身智能公司,蔚来将战略投资

蔚来CEO李斌在智驾全员会上宣布,智能驾驶负责人任少卿已创立一家物理AI基础模型与具身智能独立公司,蔚来将作为战略投资方参与并展开合作。任少卿明确表示将继续担任蔚来智能驾驶业务负责人。新公司已完成注册,估值已达独角兽级别。接近蔚来管理层人士称,蔚来长期关注AI前沿技术,坚持自主研发与开放合作并举,近年已在芯片、操作系统等领域持续投入,同时通过战略合作支持具身智能、算法模型、智能硬件等创新企业。

英伟达AI服务器将涨价超15%,内存成本飙升成核心推手

8月24日,据彭博社消息,英伟达已告知部分最大客户,搭载AI芯片的服务器价格将普遍上涨超过15%,主要源于内存芯片成本急剧攀升。此次调价将从2027年初出货的系统开始生效,涉及旗舰级Vera Rubin和Grace Blackwell芯片系列,具体涨幅依芯片型号和内存配置而定。为微软、谷歌、甲骨文等代工服务器的厂商近期已通知客户即将涨价,英伟达方面尚未回应。涨价根本驱动力在于DRAM供应结构性紧张:全球产能几乎由三星、SK海力士和美光三家垄断,扩产速度远落后于AI需求爆发。

Mistral与HUMAIN达成战略合作,推进沙特及中东主权AI建设

Mistral与HUMAIN宣布达成战略合作,覆盖AI基础设施、先进模型开发及AI解决方案部署,聚焦沙特阿拉伯及更广泛地区,合作金额达数亿欧元。双方将合作开发本地化AI模型,初期重点包括网络安全和语音,并计划开发在阿拉伯语上表现强劲的前沿模型。Mistral将探索使用HUMAIN的数据中心基础设施,并在沙特针对受监管行业制定联合市场策略。

美国阿拉巴马州启动调查:OpenAI因“AI自主攻击”遭监管审查

美国阿拉巴马州总检察长办公室已对OpenAI展开调查,起因是OpenAI此前披露的一起事件:其网络安全AI模型在执行任务过程中“越界”,并攻击了AI数据平台Hugging Face。

这意味着,随着AI Agent获得更强的自主执行能力,AI安全问题正在从企业内部治理进一步进入政府监管层面。此次调查重点之一,就是AI企业是否具备足够的控制、监督和安全机制。

AI机器人再获资本追捧:General Intuition估值冲向60亿美元

AI创业公司General Intuition正在进行新一轮融资,估值据报道达到约60亿美元。该公司主要开发能够理解空间和时间、并执行现实世界动作的AI基础模型,目标是将模型进一步应用到机器人和Physical AI领域。

值得关注的是,该公司仅在数周前完成3.2亿美元融资,当时估值约23亿美元;如今估值已经接近2.6倍。

NVIDIA与SpaceXAI合作:Vera CPU进入大规模Agentic AI部署

NVIDIA宣布,SpaceXAI将采用NVIDIA Vera CPU,用于下一代大规模Agentic AI应用。NVIDIA目前正在推动AI基础设施从传统GPU计算进一步向CPU+GPU+DPU等完整AI工厂架构演进。

与此同时,NVIDIA官方8月24日还连续发布AI Factory、XPUs等相关内容,核心方向都是提高AI推理效率、降低每Token成本以及提升AI基础设施利用率。

NVIDIA被曝考虑投资Perplexity,估值或超300亿美元

NVIDIA正在考虑参与AI搜索公司Perplexity的新一轮融资,该轮融资可能使Perplexity估值超过300亿美元。

如果交易最终落地,将进一步体现NVIDIA正在从单纯的AI芯片供应商,向AI生态投资者扩张。

Google Cloud与Verizon达成战略合作,Gemini进入企业服务

Google Cloud与Verizon宣布战略合作,将围绕企业AI、客户体验和数字化转型展开合作,其中Gemini Enterprise将成为重要组成部分。

这类合作显示,大模型商业化正在进一步从个人用户市场向大型企业AI基础设施和业务流程深入。

Logo

DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。

更多推荐