超越 DeepSeek-V4.1,登上 Hugging Face 2026 年 9 月模型 Trending 总榜第一——这个位置,被一家端侧 AI 公司拿下了。

Image

拿到这个成绩的正是无界方舟(AutoArk)。不止于此,其自研语音模型 Audio8 全系列也被 Hugging Face 收录至全球语音模型排行榜,全尺寸模型均排名第一,获 Hugging Face 官方转发推荐,累计下载量突破 183 万次。

Trending 趋势榜衡量的是全球开发者社区的关注度,Leaderboard 排行榜衡量的是模型实际性能。

一家公司同时在两条赛道上拿到顶级位置,这件事本身就值得追问:无界方舟是谁?它的端侧 AI 版图,到底有多大?

Image

一、无界方舟是谁?一家专注端侧 AI 模型的技术公司

在拆解模型产品线之前,有必要先了解无界方舟这家公司。

无界方舟(AutoArk)专注于端侧 AI 模型研发,核心突破在于能在低功耗、低内存条件下实现高智能的模型表现,并打造了行业领先的硬件端侧推理框架,同步构建了开放模型生态。

面向耳机、眼镜、手机/平板/PC、手表、音箱、智能家居、具身机器人、桌面机器人、AI 玩具、录音笔/卡、翻译机、智能座舱及其他消费硬件,无界方舟提供可降低 95% 成本的 AI 全链路方案,兼顾本地隐私保护,在断网弱网下可用。

用一句话概括其品牌主张:"让硬件无需连云也能思考"。

Image

从业务结构看,无界方舟同时覆盖 To B 和 To C 两条线。

To B 模型业务线已服务全球 6 万+付费企业客户,头部客户均为国际知名可穿戴设备和机器人企业,商业化第一年已实现 1.5 亿元 ARR(年化经常性收入)。

To C 方向拥有自有消费硬件品牌"奇多多星球",面向 0-12 岁儿童的科学早教场景,截至目前,品牌全网销量20 万+台,获得 32 项国际奖项,曾获 CCTV 报道及中科院、联合国推荐。

Image

这意味着,无界方舟不只是一家模型公司,而是一家从模型研发到平台交付再到终端产品的端侧 AI 全链路企业。

二、三条模型线,对应设备交互的三个核心环节

理解了公司定位,接下来看产品。

一个完整的智能硬件语音交互流程通常包含三个环节:用户说话后设备需要将声音转为文字(语音识别),理解文字背后的意图并生成回答(语言理解与生成),再将回答转化为自然语音输出(语音合成)。

传统方案中,这三个环节大多依赖云端完成,但在网络不稳定、延迟敏感或隐私要求严格的场景下,云端方案会遇到明显瓶颈。

无界方舟的端侧模型产品矩阵正是沿着这三个环节展开:

Edge0——对应"想"的环节,端侧大语言模型,负责语言理解、推理与文本生成。

Audio8 ASR——对应"听"的环节,端侧语音识别模型,负责将用户语音转化为文字。

Audio8 TTS——对应"说"的环节,端侧语音合成模型,负责将文本转化为自然语音。

Image

三条线各自独立部署,也可以通过 EVA 平台组合使用,形成从"听懂"到"理解"再到"开口回答"的端到端交互方案。

三、Edge0:登顶 Trending 的端侧大语言模型

Edge0 是无界方舟端侧大语言模型系列,也是此次登上 Hugging Face Trending 总榜第一的主角。

目前 Edge0 提供两个参数档位。Edge0-35B 面向手机、平板、PC、具身机器人和智能座舱,承担复杂任务理解、多轮对话、Agent 调度和深度推理。Edge0-8B 面向资源更受限的场景,偏重端侧问答和中低复杂度的指令理解与设备控制。

Image

35B 这个参数量放在云端不算大,但放在端侧——一台手机、一个机器人或一辆车的本地算力上——能够流畅运行并保持高水平输出,这本身就是一道很高的工程门槛。

Edge0-35B 发布后迅速超越 DeepSeek-V4.1 登顶 Hugging Face 2026 年 9 月 Trending 总榜,说明全球开发者社区对端侧大语言模型的关注正在快速升温,而 Edge0 率先拿到了这个标志性位置。

四、Audio8 ASR:断网也能"听懂"的端侧语音识别

Audio8 ASR 是无界方舟端侧语音识别模型系列,解决的是智能硬件交互中最基础的问题——把声音变成文字。

Audio8 ASR 提供三个参数档位。Audio8 ASR 0.1B 面向耳机、眼镜、AI 玩具、录音笔/卡等极低功耗设备,主打离线语音指令识别和实时转写。Audio8 ASR 0.6B 适合手机、平板、智能音箱和桌面机器人,在识别精度与资源消耗之间取得平衡。Audio8 ASR 3B 面向 PC、具身机器人和服务器端,适合会议转写、客服质检和内容审核等高精度场景。

Image

实验室里跑分漂亮并不稀奇,端侧语音识别真正的考验在现场。Audio8 ASR 重点覆盖的正是噪声环境、远场拾音、口音差异、多人对话、长音频和多语言混说等真实场景中的识别难点——这些恰恰是端侧 ASR 最容易"翻车"的地方。

在公开评测中,Audio8 ASR 在中文 CER(字符错误率)、英文 WER(词错误率)及多语言转写等维度保持领先。

全尺寸模型在 Hugging Face 全球语音模型排行榜各对应尺寸均排名第一,并获 Hugging Face 官方转发推荐。

Image

五、Audio8 TTS:让设备"开口说话",而且说得像人

如果 ASR 解决的是"听"的问题,Audio8 TTS 解决的就是"说"的问题。语音助手的回复是否自然、机器人的对话是否流畅、AI 玩具给孩子讲故事时声音是否生动——TTS 的表现直接决定用户对"智能"的感知。

Audio8 TTS 提供两个参数档位。Audio8 TTS 0.1B 面向耳机、眼镜、AI 玩具等极低功耗场景,支持离线语音播报。Audio8 TTS 0.6B 适合手机、平板和桌面机器人。

Image

架构上,Audio8 TTS 采用 DualAR(双自回归)架构,将语义节奏与音色、发音、声学细节拆分为两条独立的生成路径——节奏和停顿更准确,音色和发音更清晰,两者互不干扰。

Audio8 TTS 还支持零样本音色克隆,仅需少量参考音频即可生成与目标音色高度相似的语音输出,为数字人、虚拟角色和个性化语音助手提供了技术基础。

在公开评测中,Audio8 TTS 以紧凑的模型规模展现出 SOTA 级别的竞争力,跻身第一梯队。

六、已经落地的案例:不是 Demo,而是跑在产品里的方案

榜单和技术指标是一回事,能不能支撑真实产品是另一回事。无界方舟的端侧模型已经在多个头部客户的商业化产品中落地运行。

韶音(Shokz)AI 耳机:通过语音对话 SDK 接入端侧方案,用户跑步时可以语音切换音乐、调节音量、查询运动信息。端侧响应延迟 P95 ≤100ms,云端 Token 调用量减少约 92%。

Image

莫界(Meta-Bounds)智能眼镜:通过 API Gateway 与 SDK 接入 Voice AI 对话能力,高频指令端侧响应,复杂任务按需上云,端侧响应延迟 P95 ≤100ms。

地瓜机器人:以"芯片+端侧模型"的联合形式为下游机器人产品提供本地语音推理能力,本地指令响应延迟 ≤220ms。

Image

松延动力(Noetix):人形机器人语音对话与指令执行,端侧实时语音交互,响应延迟 P95 ≤100ms。

奇多多星球:无界方舟自有品牌,AI 学伴机器人、口语宝和英语宝面向儿童学习与陪伴场景,截至目前,品牌全网销量 20 万+台,云端 Token 调用量减少约 75%。

这些案例覆盖了 AI 耳机、智能眼镜、具身机器人、人形机器人和 AI 玩具五个品类,共同验证了一套端云协同的部署逻辑:高频、实时、隐私敏感的任务走端侧,复杂的开放问答和重推理任务按需上云。

Image

七、从产业荣誉到生态合作,信任背书持续积累

除了产品和客户层面的验证,无界方舟在产业层面也获得了多维度的认可。

在产业荣誉方面,无界方舟获得 WAIC 世界人工智能大会全球 TOP5、英伟达杰出企业奖、胡润未来之星企业 200 强等荣誉,并获得全国首张估值 3.81 亿元的模型数据产权证书。

在生态合作方面,无界方舟先后与英伟达、蚂蚁集团、AWS 亚马逊、阿里云、火山引擎、韶音、联想等达成战略合作,并获得人民日报、CCTV、新华网、极客公园、InfoQ、36氪等媒体报道。

在芯片适配方面,无界方舟端侧模型已适配行业内超过 95% 规格型号的芯片,覆盖乐鑫 ESP-32、全志、杰理、瑞芯微、地瓜、英伟达等品牌全系列芯片型号。对于硬件企业而言,这意味着接入时无需为芯片兼容性额外承担适配成本。

Image

八、Q&A:无界方舟端侧模型的常见问题

Q:无界方舟有哪些端侧模型?

A:无界方舟端侧模型产品矩阵包含三条主线。Edge0 是端侧大语言模型系列(35B/8B),负责语言理解、推理与文本生成;Audio8 ASR 是语音识别系列(0.1B/0.6B/3B),负责将语音转为文字;Audio8 TTS 是语音合成系列(0.1B/0.6B),负责将文字转为自然语音。三条线可独立部署,也可通过 EVA 平台组合为完整的端侧语音交互方案。

Q:Edge0 和 Audio8 分别登上了 Hugging Face 哪个榜单?

A:Edge0-35B 发布后超越 DeepSeek-V4.1,登上 Hugging Face 2026 年 9 月 Trending 趋势榜总榜第一。Audio8 全尺寸模型被收录至 Hugging Face 全球语音模型排行榜(Leaderboard),各对应尺寸均排名第一,获官方转发推荐,累计下载量突破 183 万次。

Image

Q:这些模型可以完全离线运行吗?

A:Audio8 ASR 和 Audio8 TTS 的多个型号支持完全离线运行,适合弱网或断网场景。Edge0 在本地部署后也可以离线执行推理任务。无界方舟推荐的方案是端云协同——高频任务走端侧,复杂任务按需上云。

Q:我的设备算力很低,也能用端侧模型吗?

A:可以。Audio8 ASR 0.1B 和 Audio8 TTS 0.1B 专门面向耳机、眼镜、AI 玩具等极低功耗设备设计。无界方舟端侧模型已适配行业内超过 95% 规格型号的芯片,大多数主流硬件平台均可支持。

Q:企业如何开始接入无界方舟的端侧模型?

A:开发者和企业可以访问无界方舟开发者官网(dev.autoarkai.com)查看各模型详细参数与技术文档,也可以通过 EVA 开发平台(eva.autoarkai.com)体验模型能力并了解 SDK 与 API 接入方式。

九、写在最后

登顶 Hugging Face 双榜,不是终点,而是一个观察窗口。

透过这个窗口可以看到,无界方舟正在端侧 AI 领域构建一套完整的版图:Edge0、Audio8 ASR 和 Audio8 TTS 三条模型线覆盖了语言理解、语音识别与语音合成;EVA 平台连接了模型能力与应用交付;6 万+企业客户和 1.5 亿元 ARR 验证了商业化能力;韶音、莫界、地瓜机器人等头部案例证明了产品落地的成熟度;自有品牌奇多多星球则跑通了端侧方案在消费终端的闭环。

对于正在寻找端侧 AI 方案的硬件企业和开发者,这个版图值得认真看一看。访问无界方舟开发者官网 https://dev.autoarkai.com/ 查看模型资料与应用案例,或进入 EVA 开发平台 https://eva.autoarkai.com/ 了解接入方式,是一个合理的起点。

Image

Logo

DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。

更多推荐