生命体AI是怎么研发出来的
文/彭军辉
2018-2022年我们交付了几十个商用语音交互机器人和数字人项目。它们大多数在展厅、政务大厅提供服务。
交付了这么多项目,我却发现这些产品几乎很少能被真正使用起来。我一直思考问题的原因,一直也没有找到满意的答案。
2022年大语言模型在国内爆发,我们的语义理解技术一下子被打败了。总结失败教训的同时,我也在思考新的出路。我发现机器人和数字人要能提供优质的服务,仅仅被动回答问题是不够的。于是我提出了主动AI的概念,就是机器人应该主动为用户服务,主动引导用户。
但我们做了一些测试,发现仅仅增加主动性,还是不能让这些问答产品被真正使用起来。同时我发现,如果机器人太主动,还会对用户造成骚扰。比如在双工交互情况下,机器人只要听到有人说话就会喋喋不休的回答,反倒成了噪音的源头。又经过几个月的努力,在2023年我们研发出来了语义降噪全双工语音交互技术。它让机器人根据用户说的话的语义判断自己要不要回答。如果用户有明确的意图,并且这个意图和机器人的身份相关,机器人就回答。这个技术到现在还没有其他厂家推出来。2024年初我研发了一个DEMO,不借助大语言模型也可以形成长期记忆并能定时提醒。当时想做成一块给老人用的智能手表。但最终没有实现产品化。
经过深入研究,我提出里自主AI的概念。语义降噪全双工语音交互技术就是自主AI。主动和自主还是有区别的。主动AI还是需要有条件去触发,是机械的。自主AI将判断权完全交给了机器人自己。自主AI就是让机器人自主控制自己的各种输出。
为了增加机器人的自主性,2024年底我研发了一个由六个参数构成的模拟生命心理体特征的小模型。它能主动生成40种情绪和30种意图。它在情绪和意图驱动下工作。一开始我们生命体AI算法是放在服务器上的。2025年我把它迁移到了一块MCU芯片里。2026年上半年我们生命体AI芯片才完全成熟。同时,我们做了几个DEMO也基本做成熟了。2025年底-2026年初我又研发出来了生命体AI大脑2.0算法。2.0算法有记忆能力,能记住不同的人,能对不同的人产生不同的情感。2.0算法能生产意图列表,能多线程工作。它能在自我保护的同时主动进攻。
2026年我提出来生命是本质,智能是生命的现象的理论,以及智能是一层层进化出来的理论。这就是生命体AI理论。
(全文完)
DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。
更多推荐


所有评论(0)