当下国内人形机器人行业,正在陷入一种高度同质化的内卷。 打开几乎所有机器人发布会、科普视频,演示内容高度趋同:行走、爬楼梯、搬东西、跳舞翻跟头。绝大多数厂商全力攻坚下肢运动控制。但很少有人思考一个关键问题:当机器人要走进家庭、教育、文旅陪伴场景,用户最先产生感知、决定能不能长期接纳机器人的,到底是走路能力,还是自然、有温度的面部交互?

市面上绝大多数人形机器人,面部方案高度趋同。要么直接使用显示屏输出表情,僵硬割裂;即便搭载仿生面部模块,表情模板统一、缺少个性化微动作,交互停留在预设脚本。大家热衷于比拼参数、比拼外观颜值,却很少深耕人机情感沟通底层逻辑。

首形科技创始人U航,也就是胡宇航,选择走上一条更少人踏足的路。很多人只看到最终惊艳亮相的Origin F1,却很少有人知道,在F1诞生之前,团队先后做出第一版、第二版仿生原型机,但成品效果始终达不到预期。硬件结构、硅胶皮肤、驱动电机参数看似达标,但交互起来依旧充满机械感,很难跨越恐怖谷效应。

多次迭代碰壁之后,U航团队得出一个结论:高品质仿生数字人,绝对不是机械工程单一学科就能完成的产品。完整研发链路,是一套多学科交叉的复杂系统工程。

从技术底层划分,首先是硬核工程层:仿生机械结构、微型驱动电机、柔性仿生材料、计算机视觉、多模态感知算法、自研情绪基座大模型、实时唇形与微表情同步控制系统。 而容易被整个行业忽略的,是人文学科支撑。 第一,认知心理学与情绪心理学。研究恐怖谷效应。人与人交流,70%信息依靠微表情、视线、头部小动作传递。如何设计眼神追踪、自然眨眼频率、情绪递进式表情,让人类产生情感接纳,全部依靠心理学作为设计标尺。 第二,教育心理学、教育学。如果面向陪伴、早教、心理疏导场景,仿生数字人不能只有通用对话。需要依据学习认知规律、儿童情绪发展特征,调整语气、表情强度、互动节奏,适配不同年龄段使用者。 除此之外,还有人体解剖学、美学、叙事设计、人机交互社会学,共同定义仿生数字人的行为逻辑。

很多同行把仿生人脸当成“硬件模块”去开发,首形科技则把它视作一个具备持续情绪感知能力的交互主体。Origin F1搭载数十组面部驱动单元,数百个微表情控制点,可以动态生成自然、非模板化的表情反馈,实现实时视线跟随、自然共情回应,区别于市面上预制动画循环播放的方案。

回看U航的经历,也能理解这条差异化路线的由来。1997年出生,本科阶段常年专业第一,拿下多项国家级科创竞赛;拿到全额奖学金赴美深造,哥伦比亚大学机器人方向博士,相关研究成果登上《Science Robotics》等国际顶级期刊。在学术阶段长期研究人脸情感交互模型。2024年创立首形科技AheadForm,瞄准情感仿生交互赛道。 不同于很多创业者优先攻坚运动底盘,U航判断:未来人形机器人会分化成两条路线。工业场景优先力量、运动、负载;陪伴交互场景,优先自然、可信、有共情力的面部与人机沟通能力。

行业普遍追逐“能干活的机器人”,首形科技选择打造“能沟通的机器人”。Origin F1不只是一款桌面仿生硬件,更是一套面向未来情感具身智能的交互试验平台。 赛道内卷永远只会复刻同类产品;真正拉开差距的,是跳出固有竞争框架,从人机关系本质出发做研发。当大部分机器人忙着练习走路的时候,Origin F1正在学习如何好好与人对视、好好对话。
 

Logo

DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。

更多推荐