《现代机器人学:仿生系统的运动感知与控制》读书笔记
在这里插入图片描述

一、全书概述与写作背景
《现代机器人学:仿生系统的运动感知与控制》是郭巧教授撰写、北京理工大学出版社于1999年7月出版的学术专著。这部著作虽然出版于上世纪末,但其学术视野和思想深度在今天看来依然具有前瞻性和启发性。全书共分十章,围绕“仿生系统的运动、感知与控制”这一核心主题,系统阐述了生物系统的运动机理以及仿生系统运动的实现方法。
从作者在前言中的论述可以看出,本书的写作动机源于一个深刻的时代洞察:长期以来,人们怀有“用各种不同的方式再现或构造具有生命特征的人工系统”的强烈愿望,但由于历史条件和科学技术发展水平的限制,这一愿望的实现受到阻碍。随着生命科学和计算机科学取得的巨大进展,“具有生命特征的人工系统”作为一个典型的跨学科产物,其实现已经具备了科学和技术基础。
作者在前言中提出了一个极具价值的学术判断:经典的机器人学理论大都从工程学角度出发,处理和解决机电系统的运动与智能问题,这在实际应用中具有很大的局限性,同时也限制了这门学科的发展。因此,需要借鉴生物系统的研究成果,以期使现有的机器人学理论获得大的突破。正是在这一思想的指导下,本书试图沟通生物学与工程学这两大学科之间的联系——因为在当时,国内在这一领域中的科研、生产与教学状况基本处于生物学与工程学各自独立进行的局面。
从今天的视角回看,本书所倡导的“仿生学+机器人学”的融合思路,恰恰预示了此后二十多年机器人技术发展的主流方向:仿人机器人、仿生机器鱼、仿蛇机器人、软体机器人、人工肌肉、神经形态计算等前沿方向,无不印证了本书思想的前瞻性。
二、全书结构体系分析
全书十章的内容组织体现了一条清晰的逻辑主线:从生物系统的运动机理出发,到生物体运动模型的建立,再到感知系统与信息融合,进而到各类致动与控制方法,最后落脚于仿生系统的实例。这条主线可以概括为“机理—模型—感知—控制—实例”五个层次。
第一章“生物体运动系”是全书的生物学基础。本章从解剖学和力学的双重角度,系统阐述了骨、生物软组织、骨连结(关节)和肌的结构与力学性能。
第二章“生物运动学”将解剖学、生理学和力学结合起来,分析生物运动的宏观规律,包括运动动作分析、动作分类、人体动力学分析,以及跳跃、步行、爬行等特定运动形态的分析。
第三章“生物体系统运动模型”在此基础上建立数学模型,涵盖类人型运动模型、四足动物运动模型和爬行动物模型。
第四章“感觉系统模型与感知信息融合”从感知角度切入,讨论生物体感觉系统的生理机制与数学模型,以及仿生系统信息融合的原理与方法。
第五章“仿生系统常用感知器与致动器”面向工程实现,介绍运动传感器、力与力矩传感器、接近觉与触觉感知器,以及液压、气压、电气致动和新型致动装置。
第六、七、八章构成全书的控制理论核心,分别讨论神经控制、认知控制和自主控制——这三个层次恰好对应了从低级到高级、从反射到智能的控制体系。
第九章“进化算法与人工生命”引入了进化计算和人工生命的前沿思想,将进化理论引入机器人系统的设计。
第十章“仿生系统实例”以类人型系统、步行机器人、仿蛇系统、人工脑、自主机器人和进化机器人等具体案例收束全书。
这种结构安排体现了作者“从生物到机器、从机理到应用”的系统论思想,是一部典型的“以生物为师、以工程为用”的跨学科著作。
三、核心思想提炼
通读全书,我认为其核心思想可以归纳为以下几个层面:
(一)生命系统的本质在于运动、感知与控制的三位一体
作者在前言中指出:“生命系统的本质特点是具有自繁衍能力和自适应与自进化能力,而这一切都是在永恒的运动中完成的。所有的运动都会遵循一定的规律,并为这些规律所控制。控制的依据与生物体所能获得的各种感知信号密切相关。”
这段话是理解全书的钥匙。作者将生命系统的特征浓缩为“运动—感知—控制”的闭环链条:运动是生命的外在表现,感知是运动控制的依据,控制是连接感知与运动的中枢。这一思想直接决定了本书的框架——研究生命系统的运动和感知机理及其相应的控制规律,对于了解生命系统的实质,进而制造出能满足人们不同需要的仿生系统具有重要意义。
这一思想在今天的人工智能与机器人研究中得到了充分验证。现代机器人学中的“感知—决策—执行”架构、具身智能(Embodied Intelligence)理论,本质上都是这一思想的延续与深化。
(二)机器人学发展的四阶段论与仿生转向
作者在前言中提出了机器人学发展的四阶段划分:

第一阶段:工业机器人——主要理论基础是力学和经典控制论;
第二阶段:遥控机器人——用于危险性大、环境恶劣的场合,原理上与第一阶段没有本质区别;
第三阶段:智能机器人——将人工智能成果融入机器人系统,自律机器人和足球赛机器人是典型代表;
第四阶段:进化机器人——设计原理侧重于生物运动学、遗传学与进化理论,是机器人发展的新阶段。

这一划分不仅是对历史的总结,更是对未来的预言。作者敏锐地指出,仿生系统“以其能体现生命特征的能力被看作是生命科学与工程(人工生命)领域相结合所创造出的最高目标”。这一判断在今天看来极为准确——进化算法、遗传编程、神经进化等方法已成为机器人学与人工智能领域的重要分支,而“人工生命”研究更是催生了现代的群体智能、涌现计算等研究方向。
(三)跨学科融合的方法论
本书最突出的特色是其跨学科性质。作者指出,仿生系统综合了生物运动学、动力学、机器人学、人工智能、信息科学、人工神经网络、计算机科学、知识库系统以及认知科学等学科领域的研究成果。全书的内容组织充分体现了这一方法论:

讲运动时,从人体解剖学(骨、肌、软组织的构造)讲到固体力学(应力应变分析、粘弹性理论);
讲感知时,从生理学(瞳孔控制、视细胞、侧抑制、感受野)讲到信息融合的数学方法;
讲控制时,从神经生理学(运动神经控制机理)讲到人工神经网络、知识系统、动态规划;
讲进化时,从生物进化论讲到进化算法与人工生命的计算机实现。

这种“生物机理→数学模型→工程实现”的三段式方法论贯穿全书,构成了仿生学研究的基本范式。
四、各章核心内容详析
第一章:生物体运动系——力学生物学的基础
这一章是全书的生物学与力学基础,内容极为扎实。
关于骨的力学性能,作者给出了几个重要观点:
其一,骨是“最理想的等强度优化结构”。它不仅在不变的外力环境下能显示出承力的优越性,而且在外力环境发生变化时,能通过内部调整,以有利的新结构形式来适应外力环境。这就是骨的“功能适应性”。这一思想源自 Wolff 定律,即骨会沿着主应力方向重构其内部结构。书中提到的“骨小梁的走向大体沿骨所受应力方向”正是这一规律的解剖学证据。
其二,骨的成分构成决定了其独特的力学性能。成年人骨由1/3的有机质(主要是胶原蛋白)和2/3的无机质(主要是磷酸钙和碳酸钙等)组成,有机质和无机质的结合使骨既有弹性又很坚硬。小儿骨中有机质较多,故弹性大而硬度小,容易变形;老年人骨中无机质相对较多,故较易发生骨折。
其三,骨的复合材料结构原理极具仿生学价值。作者用玻璃钢作类比:块状磷酸盐脆性大、初应力高,但骨骼中的磷酸盐是较细的针状结晶体,其内应力大大降低,以针状无机盐结晶为核心,与骨胶原共同组成的复合材料结构是一种高强度承载物体。书中特别指出这种复合材料要求无机盐和骨胶原之间具有合适的比例——通常是7:3。这为人工复合材料的设计提供了直接启示。
其四,从功能适应性的反馈控制观点看骨。作者提出:“骨的功能性理论把骨看成是一个具有反馈装置的控制系统。在经常的外力作用下,骨以一个合适的截面来承受这一外力。如果外力增加了,截面上与它平衡的应力也就相应地增加,增加后的应力刺激了骨使它内部组织发生两方面变化,一是截面积增长,一是截面上的单位面积抗载能力增强。”这种将生物组织看作自适应控制系统的观点,是全书方法论的一个缩影。
关于生物软组织,作者重点阐述了其粘弹性特征。生物软组织材料与常用金属材料之间的差别主要在于它具有明显的非线性、各向异性和粘弹性(包括滞后、蠕变和松弛特性)。软组织在循环载荷下具有“趋近性”——每次加载循环下的载荷—变形曲线都不相同,但随着循环次数增加,加载与卸载曲线之间的差别越来越小。这一现象(即预调现象)在生物力学实验中极为重要。
在理论建模方面,作者介绍了冯元桢提出的解决生物组织大变形的“软组织粘弹性准线性理论”。该理论将松弛函数K(λ,t)表示为归一化松弛函数G(t)与弹性响应T^(e)(λ)的乘积。尽管应力—应变关系是非线性的,但应力与弹性响应之间的关系是线性的,且归一化函数G(t)又不随变形而变化,所以系统可认为是“准线性的”。这一理论是生物力学史上的里程碑,也为软体机器人的建模提供了理论工具。
关于骨连结(关节),书中介绍了直接连结与间接连结的分类,关节的基本构造(关节面、关节囊、关节腔)和辅助结构(韧带、关节内软骨、关节唇),以及关节的三组拮抗性运动(屈伸、收展、旋转)。特别值得注意的是关节软骨的功能——润滑、受力与减震,这为人工关节设计提供了仿生学依据。
关于肌,本章详细介绍了骨骼肌的结构(肌外膜、肌束膜、肌内膜、肌纤维、肌原纤维)和收缩机理。作者重点阐述了汉森和赫斯莱提出的肌丝滑动学说:当肌纤维收缩或伸长时,两种肌丝的长度均不改变,收缩时通过相互之间的滑行使重叠部分增加,此时I带缩短,整个肌肉的长度变短。
一个反直觉的现象是“韦伯矛盾”:一般工程材料在工作范围内其抗拉伸能力总是随伸长而增长,但肌肉正好相反——肌肉越是收缩,承载能力就越强,因此所有肌肉在休息时都处于部分收缩状态。这一特性对仿生致动器(如人工肌肉)的设计具有重要参考意义。
作者还从能量转换效率的角度分析了肌肉的仿生学价值:工程上是使化学能先转化为热能才能变为机械能(如蒸汽机能量损失达80%以上,内燃机可利用能量也不到1/3),而肌肉的能量转换不经过热能阶段,由化学能直接转化为机械能,所以效率很高。书中给出的仿生模型——在活塞桶内装有聚丙烯酸和聚乙烯薄膜,通过交替输入氢氧化钠和盐酸使薄膜膨胀/收缩从而直接将化学能转变为机械能——是“直接能量转换致动器”的早期探索,与今天的高分子凝胶人工肌肉一脉相承。
肌纤维收缩的微观机理在书中也有精辟阐述:肌质网释放钙离子→钙与肌原蛋白结合→原肌球蛋白构型变化→肌动蛋白与肌球蛋白分子头接触→ATP酶被激活→ATP分解释放能量→肌球蛋白分子头运动将细肌丝拉向M膜。当钙被收回且新的ATP结合时,肌肉松弛;若缺乏ATP,则出现肌强直。这一钙触发—横桥循环机制是理解神经肌肉控制(第六章)的生物学基础。
在肌的三单元模型(收缩元、串联弹性元、并联弹性元)中,收缩元反映粗肌丝与细肌丝间相对运动形成的拉力,串联弹性元表示两种肌丝和横桥的弹性,并联弹性元表示完全松弛后肌肉的力学性质。该模型至今仍是肌肉力学分析的经典模型,也是Hill型肌肉模型的基础。
第二章:生物运动学——从定性到定量的运动分析
本章的方法论价值在于将生物运动研究由定性分析推向定量分析,其推动力是“录像技术和数字计算机的普遍使用”。
运动动作分析的三维框架是本章的理论骨架:

结构分析——研究动作的形式、外貌、性质及与前后动作的关连,包括运动学分析(轨迹、速度、加速度)、运动轨迹分析(总重心轨迹与各部分相对轨迹)和动力学分析;
解剖学分析——用解剖学知识分析骨骼肌的工作,特别是肌群(原动肌、协同肌、对抗肌、固定肌)的协调配合;
生理学分析——从神经系统控制的角度理解随意运动的本质。

在动力学分析中,作者区分了内力与外力:内力仅发生在动物体内部,只能引起身体一部分与另一部分的相对运动,不能改变整个身体重心的空间运动状态;外力则包括重力、惯性力、摩擦力、支反力、介质阻力等。同时又区分了动力与制动力:动力与运动方向一致,多数由肌肉产生;制动力与运动方向相反,有的是环境产生(如重力、空气阻力),有的是动作需要(如跑步前腿落地后的地面阻力),后者“是动力的前驱,是不可避免的,但可以通过姿态调整适当减小”。这一“预备性动作—功能性动作”的分析框架对步态规划极具指导意义。
书中关于动物运动能耗的比较生物学分析尤为精彩。作者引入“移动净耗”Ē=(E_T−E_g)/(mv)的概念,比较不同动物的能耗:水中游动动物的Ē最小(水的阻力小,又不必克服重力);空中飞行动物的Ē稍大(尽管空气阻力小,但要克服地心引力付出诱导阻力之功);陆上动物的Ē最大(要克服较大的地面阻力并支持自身重量)。这解释了“许多鸟类和鱼类可以做很长时间的移徙与回游,但陆上动物则极少能这么做”。同时,袋鼠在低速下用步行省功率、在高速下跳跃反而省功率的发现,揭示了不同运动模式在不同速度区间的能耗最优性——这一原理已被应用于足式机器人的步态切换策略中。
关于平衡与稳定性,书中区分了稳定平衡态(小位移下重心升高,如分腿站立)、不稳定平衡态(小位移下重心降低,如滑冰、自行车侧向平衡,需要神经系统每时每刻调节维持)和随遇平衡态(位移不改变重心高度)。作者还引入“稳定角”概念来定量描述某方向上的稳定性大小,指出运动中有时必须在某些方向保持尽可能大的稳定角(如摔跤),另一些场合则应维持尽可能小的稳定角以便随时破坏该方向的稳定(如起跑或入水)。这种“方向性稳定”的思想对足式机器人的姿态控制很有启发。
关于人体动力学建模,作者介绍了经典的Hanavan人体简化模型:人体被分为15个刚体单元(上躯干、下躯干、头、左右上臂、前臂、手、大腿、小腿、脚),通过14个球铰链连结成链式系统。在求解方法上,对比了拉格朗日法(得到48个方程的拉格朗日方程组,但求导麻烦)和凯恩(Kane)方法(通过广义作用力与广义惯性力的平衡F_j+F_j*=0避免求导困难,且适合计算机数值实现)。这一刚体—铰链系统建模方法至今仍是人体运动仿真、数字人技术和仿人机器人动力学分析的主流方法。
关于步行运动分析,书中回顾了Muybridge的连续摄影研究,以及McGhee关于步行姿态组合数学的研究:在四足步行的某一时刻,即使把进行起落运动的足数目限定为一个,理论上可能步行姿态数也有5040种;若允许同时起落的足数目为一个以上,则可能多达65428种。而McGhee和Frank的静态稳定性分析表明:在同时着地或离地脚数为一的情况下,理论上5040种步行姿态中只有三种能经常保持静态稳定性,其中静态稳定度达到最大的只有一种——被称为“爬行”(crawl gait)。这是四足机器人步态规划的经典结论。南加州大学的四足步行机械采用这种步行姿态并实验完全成功,验证了该理论。
关于爬行运动分析,本章重点介绍了日本东京工业大学Hirose(广濑茂男)的仿蛇研究,将蛇看作“主动索状机构”(ACM, Active Cord Mechanism)。蛇的运动模式分为四种:螺旋状运动、直线运动、腹部运动和侧向运动。书中对ACM的二维运动学进行了严密的推导,建立了切向力、法向力、功率的连续分布表达式:

切向力密度函数 f_i(s) = dT(s)/ds · ρ(s)——表明驱动力矩产生的切向力比例于身体曲率的增加和力矩分布的梯度;
法向力密度函数 f_n(s) = d²T(s)/ds²——法向力与曲率分布ρ(s)无关,仅取决于力矩分布的二阶导数;
功率密度函数 P(s) = T(s)·dρ(s)/ds·v——运动期间该值必须低于致动器性能决定的功率上限。

尤为精彩的是Hirose提出的“蛇状曲线”(serpenoid curve)。作者从神经生理学角度批判了三角波、弧形波和正弦波假设的非自然性(三角波和弧形波的肌收缩变化率不连续,正弦波模式需要相当复杂的肌收缩),指出Hirose提出的沿曲线轴曲率呈正弦变化的蛇状曲线,“曲率的变化率由正弦波产生,沿身体曲率的变化是光滑的”,“从运动神经生理学的观点出发,这是迄今为止分析蛇的滑行运动的最贴近自然的描述。在这个描述中,肌以谐波振动的方式进行着最自然的收缩与松弛运动”。这一蛇状曲线已成为仿蛇机器人运动规划的标准曲线,广泛应用于蛇形机器人的步态生成。
第三章:生物体系统运动模型——面向控制的数学建模
本章将前两章的生物机理转化为可计算的数学模型,是连接生物学与工程学的桥梁。
类人型运动模型的建立采用了通用化建模策略:将系统视为n个刚性构件通过球窝形关节单纯连结的链式系统,为每个构件定义动坐标系、质量、惯性张量、质心位置矢量,用欧拉角描述姿态,并用三个结构矩阵([ε]、[δ]、[γ])以矩阵形式统一表达机械模型的结构。这种“结构矩阵化”的建模方法使得“可以用同一个数学模型来处理广泛的机械模型”,体现了通用性与简洁性的统一。本章详细推导了构件旋转运动的坐标变换矩阵、线运动中矢量l和d从动坐标系到静坐标系的变换,以及绕关节轴力矩的计算方法。最后指出实际问题往往是“力学第一类问题”(已知运动求力矩,解代数方程)与“第二类问题”(已知力矩求运动,积分微分方程)的混合问题。
四足动物运动模型和爬行动物运动模型部分则针对不同形态的生物分别建立模型,体现了“具体问题具体分析”的工程哲学。
第四章:感觉系统模型与感知信息融合——感知的仿生学
如果说前三章解决的是“动”的问题,第四章则开始解决“知”的问题。本章从生物体感觉系统的生理机制出发,建立了一系列经典的感知数学模型:

瞳孔尺度控制模型——模拟瞳孔对光强的自动调节;
视细胞模型——视觉信号转换的前端模型;
侧抑制模型——这是Hartline在鲎( horseshoe crab)复眼研究中发现的经典神经机制,相邻感受器之间相互抑制,其效果是增强图像的边缘对比(“马赫带”现象的神经基础),已被广泛应用于图像处理中的边缘增强算子;
感受野模型——描述视皮层神经元对特定空间频率、方向、位置刺激的响应特性,是卷积神经网络感受野概念的原型;
视觉计算模型——生物视觉的计算理论。

在多源信息融合方面,作者指出生物系统的集成传感信息处理是感知的精髓,进而系统阐述了仿生系统感知信息融合的原理、实现方法和系统结构(包括集中式、分布式、混合式等融合架构)。信息融合在当时的机器人学中还是较新的方向,如今已成为多传感器系统的标准技术(如SLAM中的多传感器融合、自动驾驶中的激光雷达+视觉+毫米波雷达融合)。
值得强调的是,从生物视觉机理(侧抑制、感受野)到工程图像处理(边缘增强、卷积运算)的这条路线,正是后来深度学习卷积神经网络(CNN)受Hubel-Wiesel视皮层研究启发的同一思想脉络。本书在1999年就系统梳理了这一仿生感知路线,可谓有先见之明。
第五章:仿生系统常用感知器与致动器——工程实现的物质基础
本章是面向工程实现的“器件章”,内容务实而全面。
在感知器方面,作者首先阐述了仿生系统对感知器和致动器的要求,然后依次介绍:运动传感器(位置、速度、加速度类)、力与力矩传感器、接近觉感知器(接近觉是自主移动机器人避障的关键)、触觉感知器(触觉是精细操作与安全交互的保障)。
在致动器方面,系统介绍了液压致动(功率密度高,适合重型应用)、气压致动(清洁、柔顺,但可控性较差)、电气致动(电机类,控制精确、易于集成)以及新型致动装置。其中“新型致动装置”一节最具前瞻性,涉及的形状记忆合金、压电致动、电致/磁致伸缩、人工肌肉(高分子凝胶/驱动聚合物)等技术,正是今天软体机器人、仿生致动领域的热点。
感知与致动的对称性设计思想在本书中已有体现:感知器是系统的“输入端”,致动器是系统的“输出端”,二者共同构成仿生系统与环境交互的界面。生物的感知—执行协调机制(如反射弧、牵张反射)为这种对称设计提供了原型。
第六章:神经控制——从生物神经到人工神经网络
本章是全书控制理论三部曲的第一部,对应控制层次的“底层”。
运动神经控制机理一节从生理学出发,阐述了生物运动控制的层级结构:脊髓水平的反射控制(如牵张反射、屈肌反射)、脑干水平的姿势控制、小脑的运动协调与学习、大脑皮层的随意运动发起。这一生物运动控制的分层架构,直接启发了机器人控制的分层设计(如目前的“反射层—反应层—慎思层”三层架构)。
人工神经网络一节系统介绍了神经网络的基本理论,包括神经元模型、网络拓扑、学习算法(如BP算法等)。神经控制方法一节则将二者结合,阐述如何用神经网络实现机器人控制,包括神经网络的在线学习、自适应控制、逆动力学控制、CMAC(小脑模型关节控制器)等。CMAC直接模仿小脑的局部泛化与快速学习特性,是神经控制模仿生物运动控制的典型范例。
神经控制的精髓在于:不依赖精确的数学模型,通过学习获得控制律。这对于难以精确建模的仿生系统(软体、多自由度、非线性强耦合)尤为合适。这一思想在今天“学习控制”“强化学习控制”的研究中仍在深化。
第七章:认知控制——知识与规划的高层控制
本章将控制层次提升到“认知”层面,研究基于知识的控制与运动规划。
认知控制系统的结构包括感知、认知(知识推理)、规划与执行的闭环。知识系统与运动规划一节讨论了如何将领域知识表示为知识库,并基于知识进行任务规划与运动规划;场景与知识信息描述一节讨论了环境建模(场景表示)与知识表示的结合;系统运动的认知控制一节给出了完整的认知控制实现方法。
认知控制的核心思想是:高层决策不是简单的数值计算,而是符号推理与知识运用。这在今天对应着机器人学中的任务规划(Task Planning)、语义导航、以及大模型驱动的具身智能(LLM-based Embodied AI)——让机器人“理解”任务、分解任务、规划动作。本书在1999年就确立了这一方向,可见其对“智能体”架构的把握是准确而超前的。
第八章:自主控制——复杂系统的自主决策
本章是控制三部曲的最高层,研究自主控制系统的结构、控制问题描述、信息结构、信息系统的嵌套、分类嵌套决策和多分辨率动态规划。
自主控制的特色内容是信息结构的嵌套与多分辨率动态规划:面对复杂环境与海量信息,自主系统需要分层次、多分辨率地组织信息与决策——在粗分辨率上快速决策大方向,在细分辨率上精确执行局部动作。这种“分级抽象”的思想与今天的分层强化学习、层级化规划一脉相承。
作者在“关于自主控制的讨论”中无疑会触及自主性与智能的本质问题:自主不是无条件的自由,而是在资源约束(传感、计算、时间、能量)下的最优决策能力。这一观点对于今天的自主驾驶、无人机群、太空机器人等应用仍具指导意义。
第九章:进化算法与人工生命——设计方法论的革命
本章将达尔文进化论引入机器人设计,代表了设计方法论的根本转变:从“设计”到“进化”。
生物进化一节回顾了自然选择、遗传变异的生物学原理;进化算法一节系统介绍了遗传算法、进化策略、遗传编程等进化计算方法;神经网络的进化一节讨论了“进化+学习”的结合(如进化神经网络、神经进化),用进化自动设计网络结构与权重;人工生命一节则展望了在计算机/物理载体中创造具有生命特征(自繁衍、自适应、自进化)的系统。
人工生命(Artificial Life)的核心思想是“生命如其所示”到“生命如其所能”——不必复制地球上已知的碳基生命,而应探索生命现象的一般规律,在任何载体(硅基、机械、虚拟)中实现生命的本质特征。作者在前言中即指出“仿生系统以其能体现生命特征的能力被看作是生命科学与工程(人工生命)领域相结合所创造出的最高目标”,本章正是这一最高目标的展开。
进化方法与人工生命思想对现代科技的影响深远:进化算法已成为全局优化的通用工具;神经进化方法在强化学习中复兴(如OpenAI的进化策略、用于超参数与结构搜索的进化方法);人工生命研究催生了群体智能(蚁群、粒子群)、涌现计算、数字生命等方向;而“进化机器人”正是今天“自动化机器学习+机器人自主学习”的雏形。
第十章:仿生系统实例——理论落地的验证
本章给出了六大类仿生系统实例,作为全书理论的落地验证:

类人型系统——仿人机器人的结构、运动与控制;
步行机器人——足式机器人的步态生成与稳定性控制;
仿蛇系统——基于ACM模型和蛇状曲线的蛇形机器人;
人工脑——大规模神经网络/认知系统的硬件实现;
自主机器人——具备自主感知与决策能力的移动机器人;
进化机器人——用进化算法自动设计的机器人系统。

这些实例覆盖了从形态仿生(蛇形、类人形)到功能仿生(人工脑、进化机器人)的不同层次,展示了仿生系统研究的广度与深度。
五、本书的学术贡献与方法论启示
(一)建立“生物机理—数学模型—工程实现”的完整方法论链条
本书最核心的方法论贡献,是建立了一条从生物到工程的完整转化链条:

生物机理层:解剖学(骨、肌、关节)→ 生理学(神经肌肉、感觉系统)→ 进化论(自然选择、遗传变异);
数学模型层:材料力学(骨的本构关系)→ 粘弹性理论(软组织、肌的准线性理论)→ 多体动力学(Hanavan模型、拉格朗日/凯恩方法)→ 控制理论(神经网络、动态规划)→ 优化理论(进化算法);
工程实现层:传感器(运动、力、接近觉、触觉)→ 致动器(液压、气压、电气、新型)→ 控制架构(神经/认知/自主控制)→ 系统集成(各类仿生实例)。

这条链条上的每一环都不是简单拼凑,而是有内在逻辑:生物体的“骨—肌—腱—关节”对应机器人的“连杆—致动器—传动—关节”;生物的“感受器—神经—中枢”对应机器人的“传感器—信号处理—控制器”;生物的“进化—学习—适应”对应机器人的“进化算法—机器学习—自适应控制”。
(二)分层控制体系的系统构建
第六、七、八章构成的“神经控制—认知控制—自主控制”三部曲,实质上构建了一个完整的分层智能控制体系:

神经控制(底层):对应反射与本能,特点是快速、鲁棒、无需精确模型,依赖学习与适应;
认知控制(中层):对应知识与推理,特点是符号化、可解释、基于规则与规划;
自主控制(高层):对应自主决策与进化,特点是在不确定环境与资源约束下独立完成目标。

这一分层体系与当代机器人学的经典架构(如三层架构:伺服层—行为层—慎思层)以及Brooks的包容式架构思想遥相呼应,且更强调“自主性”作为最高目标。
(三)“功能适应性”与自适应设计的哲学
书中骨的功能适应性理论(骨作为具有反馈装置的控制系统,根据外力自动调整截面与强度)蕴含着深刻的设计哲学:最优结构不是预先设计好的,而是在与环境交互中自适应生成的。这一哲学在本书中被推广到进化机器人的设计——不是工程师直接设计机器人,而是让进化算法在环境中“培育”出适应环境的机器人。今天这一思想已发展为形态计算、进化发育、软体机器人自组织等前沿方向。
(四)能耗与效率的仿生学视角
书中关于运动能耗的比较生物学分析(水中游动<空中飞行<陆上移动)、袋鼠高速跳跃省能、肌肉化学能—机械能直接高效转换等论述,确立了仿生学的另一个重要维度:不仅是功能的模仿,更是效率的学习。自然选择在亿万年时间尺度上优化了生物的运动效率,这些优化成果(如蛇状曲线的平滑肌收缩、鸟类飞行的诱导阻力最小化、鱼类游动的涡流能量回收)是人类工程设计取之不尽的灵感库。
六、对当代机器人学与技术发展的印证与启示
以2026年的今天回看这部1999年的著作,其前瞻性令人惊叹,主要体现在以下几方面:
(一)仿人机器人与足式机器人
本书的类人型运动模型(第三章)、Hanavan人体动力学模型(第二章)、步行稳定性分析(爬行步态最优性结论)为足式机器人奠定了理论基础。今天波士顿动力的Atlas/Spot、特斯拉的Optimus、宇树的四足/人形机器人,其运动控制的核心仍离不开书中所建立的刚体—铰链动力学、ZMP类稳定性判据、步态规划等理论框架。而书中关于“高速区域需考虑静态稳定性以外的机构”的论断,正对应现代足式机器人从静态稳定步态到动态平衡控制(倒立摆模型、全身控制WBC、模型预测控制MPC)的演进。
(二)软体机器人与人工肌肉
第一章关于软组织粘弹性、冯元桢准线性理论、肌肉三单元模型、化学能直接转换致动器的论述,正是今天软体机器人学和人工肌肉研究(介电弹性体、气动人工肌肉、形状记忆聚合物、响应水凝胶)的理论源头。书中“聚丙烯酸和聚乙烯薄膜交替输入酸碱实现化学能—机械能直接转换”的模型,与今天 stimuli-responsive 水凝胶致动器的原理几乎相同。
(三)蛇形机器人
第二章Hirose的ACM模型和蛇状曲线,直接催生了蛇形机器人这一重要分支。今天的管道检测蛇形机器人、微创手术蛇形机械臂、火星探测的蛇形机器人,其运动规划的核心仍是蛇状曲线及其推广。侧向运动模式(响尾蛇式)在沙漠环境低摩擦阻力高效率的特性分析,也已被用于开发沙地环境机器人。
(四)神经网络与深度学习
第四章的生物视觉模型(侧抑制、感受野)与第六章的神经网络控制,指向了今天深度学习的主干——卷积神经网络正是从视皮层感受野模型获得灵感。而第九章神经网络的进化,则预示了今天神经架构搜索(NAS)与进化强化学习的方法。本书对“学习控制优于模型控制”的判断,在深度强化学习成功解决机器人控制难题(如灵巧手操作、四足运动)的今天得到了最好的印证。
(五)具身智能与认知机器人
第七章认知控制中的“知识系统+运动规划+场景理解”架构,正是今天具身智能的雏形。当前大语言模型驱动的任务规划(LLM as Planner)+ 视觉语言模型的环境理解 + 底层运动控制的三层体系,与本书的“自主—认知—神经”三层控制框架在精神上高度一致。
(六)群体智能与人工生命
第九章人工生命的思想,在今天的集群机器人、群体智能优化、数字孪生、元宇宙中的虚拟生命等形式中不断延续。自繁衍、自适应、自进化作为生命系统本质特征的论断,也持续启发着自重构机器人、自修复材料等方向。
七、批判性思考与历史局限
作为一部负责任的读书笔记,也应指出本书的历史局限:
其一,时代技术条件的限制。1999年,深度学习尚未爆发(2012年AlexNet才标志CNN复兴),计算能力有限,本书的人工神经网络部分停留在浅层网络与经典学习算法;信息融合部分以贝叶斯、卡尔曼滤波等经典方法为主,未涉及今天的深度学习融合方法。
其二,生物机理的还原论倾向。本书主要采用“结构—功能”对应的还原分析方法(如骨的结构对应承力功能、肌的微结构对应收缩机理),对生物系统的整体性、涌现性(如神经系统的全脑协同、微生物组的系统作用)着墨较少。当代系统生物学和复杂性科学对此已有更深入的认识。
其三,进化与发育的结合不足。书中进化算法部分主要讨论基因层面的进化优化,对“发育”(形态发生、成长过程)与进化的耦合(今天的前沿方向)尚未展开。
其四,伦理与社会维度缺席。本书聚焦技术实现,对仿生系统/人工生命可能带来的伦理、安全、社会影响(今天的AI对齐问题)未有讨论。这固然是时代背景所限,但也提醒当代研究者:技术越接近“生命”,其伦理考量就越不可缺位。
八、总体评价与结语
《现代机器人学:仿生系统的运动感知与控制》是一部立意高远、体系严谨、内容扎实的跨学科著作。它的核心价值可以概括为三点:
第一,它在工程学与生物学之间架起了一座系统性的桥梁。在仿生学尚未形成完整学科体系的年代,本书以“运动—感知—控制”为主线,将分散在解剖学、生理学、生物力学、神经科学、控制工程、计算机科学中的知识整合为一个自洽的体系,为“仿生系统”这一新兴领域提供了第一份系统性的中文理论地图。
第二,它确立的“生物机理—数学模型—工程实现”方法论至今有效。无论是研究软体机器人、仿生飞行器还是神经形态计算,研究者依然在走“先理解生物、再建立模型、后工程实现”的路线。本书的方法论示范意义历久弥新。
第三,它对机器人学未来的预判大体应验。“进化机器人是机器人发展的新阶段”“具有生命特征的仿生系统是生命科学与工程结合的最高目标”——这些论断在软体机器人、进化学习、人工生命、具身智能蓬勃发展的今天,已然成为现实或正在成为现实。
从更深层的思想意义上看,本书代表了中国学者对“什么是生命、什么是智能、如何创造生命与智能”这一终极问题的工程学回答。作者在扉页上写“仅以此书献给所有多年来关心、支持和帮助过我的人们”,在前言中说“就算抛砖引玉吧”——谦逊背后,是对一个新兴领域的开拓担当。事实证明,这块“砖”引出的“玉”远超作者当年的想象:仿生学与机器人学的融合已成为全球科技竞争的战略高地,而生命系统的运动、感知与控制机理,依然是人类创造更智能、更灵巧、更自主的人工系统取之不竭的灵感源泉。
正如作者所言:“生命系统的自主与适应能力的人工实现不仅可以把人从繁重、危险、乏味的工作环境中解脱出来,而且能够替代人在需要的场合担负起自动(或半自动)决策的责任。”这既是本书写作的初心,也是仿生机器人研究永恒的使命。读罢全书,掩卷深思,最令人回味的仍是那条贯穿始终的信念:向生命学习,是机器通向智能的必由之路。

Logo

DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。

更多推荐