网易首页 > 网易号 > 正文 申请入驻

Science Robotics|人形机器人躺进婴儿床蹬腿玩床铃,重做发展心理学半个世纪的经典实验

0
分享至

科学家把一个「小孩」放进了婴儿床里。

床上方吊着一个会晃的床铃,一根弹性绳把床铃和它的一只手腕连在一起——它动一动胳膊,床铃就跟着晃。

躺在床里的不是婴儿,而是身高与儿童相仿的iCub人形机器人。



这项研究来自汉堡大学、捷克技术大学布拉格分校和巴黎西岱大学/CNRS的联合团队,昨日发表在国际顶级期刊《Science Robotics》上。



他们想搞清楚一件发展心理学里的老问题:婴儿是怎么发现「我动一下,世界就变一下」的?而这次给出答案的方式,是让机器人自己躺进婴儿床里,真的玩一遍。

01.

把发展心理学的经典实验,搬给机器人做一遍

被搬过来的实验叫mobile paradigm(床铃范式),1969年由Rovee和Rovee提出,是研究婴儿感觉运动关联(sensorimotor contingency,SMC)最经典的方法之一。

做法很简单:婴儿躺在小床里,只有一条肢体用绳子连到头顶的床铃上。到3~4个月大时,婴儿会发现是自己在让床铃动,然后更多地去动那条「连着的」肢体。如果这时把绳子解开,有些婴儿会出现「消退爆发」(extinction burst)——动作先猛增一下,再慢慢回落到基线。

但这个现象并不总能观测到,婴儿之间差异很大。到底是什么机制在起作用,一直不清楚。

之前也有不少计算模型试图解释这个范式,包括强化学习类、动力系统类和具身模型。但它们都只在仿真里跑过,没有真实世界的噪声、延迟和物理约束,也没怎么纳入预测误差、好奇心这些被认为支撑人类行为的认知机制。

这次研究团队把自己此前的仿真模型搬上了真机。iCub用的是肩部3个自由度、肘部1个、腕部1个,共5个关节;视觉只用右眼相机,分辨率320×240、15帧,经过池化后变成70个视觉单元,模型的输入就是「画面里有多少比例的格子发生了变化」这一个量。



实验一共七种条件,三种在真机上、四种在仿真里做。

真机部分:complex条件用的是接近原始实验的多部件床铃,被拉动后运动相当混乱;simple条件换成一根通过滑轮悬挂的泡沫管,运动方式确定得多;control条件干脆不挂床铃。仿真部分则包括simulated complex、把视觉输入与手腕位移做成1:1对应的simulated simple,以及两个「回放」条件——床铃的运动是从之前录好的数据里回放的,画面刺激一模一样,但和机器人的动作完全没关系。



每种条件都重复多次:真机complex和simple各20次,control 10次,四种仿真条件各60次。

模型这边,机器人的「大脑」是一个实时训练的神经网络,输入19个值(上一次动作的18个关节值+过去的画面变化),中间两层3000和1100个神经元,输出990+18+1个值——990个运动指令、18个关节值预测、1个画面变化预测。

990个运动指令怎么变成18个关节角度?靠的是群体编码(population coding):每个神经元同时影响同一肢体内的3个关节,还要加上±0.05的随机噪声来模拟婴儿的运动变异性。也就是说,机器人事先完全不知道自己的关节和肢体运动、环境效果之间是什么关系,必须自己学。

学习靠两个监督信号:预测损失(把自己的动作和环境的反应都预测对)和好奇损失(去探索那些结果不可预测、因此「有意思」的动作)。模型会把让自己惊讶的动作记在一张兴趣表里,惊讶就把兴趣值直接拉到1,不惊讶才每次减0.1。



02.

机器人确实学会了,但不是靠「动得更多」

怎么判断机器人到底有没有「发现」这个关联?

团队的思路是:训练一个多层感知机(MLP)当外部观察者。给它看两只手臂连续10个位置构成的序列,让它判断当时是左手还是右手连着床铃。用留一交叉验证,如果它能稳定分对,就说明机器人的探索行为里确实存在系统性差异。

结果如下(随机水平50%)



真机complex条件65%,显著高于随机;simple条件53%、control条件48%,都没超过随机。仿真里simulated complex 67%、simulated simple 58%,都显著;而两个回放条件掉到45%和48%。

七种条件里,四种有关联的条件有三种超过随机水平,无关联条件全部没有。

有意思的是出现了一个反直觉的规律:越简单、越确定的条件,反而越难分类。团队的解释是,complex条件恰好落在一个「难度甜区」——足够有挑战性,能激发主动探索,但又不至于永远学不会。真机simple条件里那根泡沫管占据了视野很大一块,画面变化过于剧烈反而难以预测;而仿真simple条件又太简单,探索不足、动作变少,留给MLP的线索也就少了。

那么,机器人到底是「怎么」表现出差异的?按婴儿文献的经典假设,应该是连着的那只手动得更多。

团队测了手腕走过的路径长度。



结果是:没有明显差别。不管哪种条件,连接手臂和非连接手臂的总路径长度都差不多。唯一一致的现象是,在有关联的条件里,真机约200步、仿真约450步之后,动作量会出现一次突然的转变。

换句话说,MLP抓到的东西,不是「动得多」。

03.

两种策略背后,是预测与好奇的拉锯

于是团队改用决策树,把轨迹先转换成一系列运动指标——运动发生在空间的哪个区域、变异性、两臂之间的相关性等等,再让分类器去找边界。





在complex条件下,四种主导策略覆盖了87%的样本。

比如其中一种:只要左臂在靠近躯干的一小片区域里活动(横向不超过约9厘米),就能判定是右臂连着——因为在那个位置,绳子是松的,左臂再怎么动床铃也不会动。另一种覆盖了75%左手连接样本的策略则相反:连着的手臂待在远离躯干、绳子绷紧的区域,只需要非常小的动作就能让床铃晃起来。

还有两种策略是大幅度的探索性运动,动的不一定只有连接的那只手。

四种策略可以归成两大类:要么大范围、大幅度地探索,要么在绳子有张力的特定区域做小而精准的动作。

更关键的是第二棵决策树——团队用模型的内部变量(预测损失的两个分量、好奇损失、画面变化、目标关节值)又训练了一次分类器,找出8组内部状态,再算它们与外部行为策略的条件概率对应。

前两种「精准小动作」策略,出现在损失都很低的优化状态:模型已经学会控制身体、也能准确预测环境反应,不再感到惊讶,于是转向「维持现状」,用最小的动作把关联握在手里。

后两种「大范围探索」策略,出现在运动前向模型还没学好的时候:动作预测损失偏高,行为主要由好奇心驱动,于是就是大幅、多变、不局限于连接肢体的乱动。

这正好是强化学习里那一对:探索与利用(exploration vs. exploitation)。

而它和婴儿数据也对得上。Watanabe和Taga 2006年的研究发现,2个月大、运动控制还不成熟的婴儿会增加所有肢体的运动;4个月大、运动能力更好的婴儿则专门增加连着床铃那条肢体的运动。

此外,机器人在部分试次里也出现了类似婴儿那种时有时无的消退爆发。

团队还做了消融和降自由度实验,结论有点反直觉:对模型来说最难的其实是运动控制本身,而复杂的关联反而可能帮助学习——因为相比只有「开/关」两种状态的二元关联,它提供了更多可操作的可能性、更精细的比例式反馈,以及更丰富的刺激来持续引发好奇。

所以这项研究给婴儿研究者留下的建议是:别只用「动了多少」这一个指标去判断婴儿有没有学会。婴儿相关文献里那些「不符合典型模式」而被排除掉的试次,说不定正是另一种有效策略。研究者还可以反过来用MLP和决策树这套框架,去更定量地刻画婴儿的策略,甚至通过给肢体加小重物、给床铃加噪声来分别操纵「动作可预测性」「环境可预测性」和「好奇心」这三个因素。

论文数据和代码都已公开。

论文地址:

https://www.science.org/doi/10.1126/scirobotics.aed4106

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
亚洲4队冰火两重天!朝鲜提前晋级,中、日接近出线,韩国已命悬一线

亚洲4队冰火两重天!朝鲜提前晋级,中、日接近出线,韩国已命悬一线

绿茵舞着
2026-09-11 23:46:10
网传北大张丹丹被免职,评论区炸锅,一片叫好声…

网传北大张丹丹被免职,评论区炸锅,一片叫好声…

慧翔百科
2026-09-10 12:19:31
简直就是奇迹:美国林肯号航母5000多大兵在芭堤雅疯狂玩了5天,竟然仅有2个打架的!

简直就是奇迹:美国林肯号航母5000多大兵在芭堤雅疯狂玩了5天,竟然仅有2个打架的!

步论天下事
2026-09-07 09:40:52
人有本事,一眼便知:有本事的人,都有4个特征,遇见要深交

人有本事,一眼便知:有本事的人,都有4个特征,遇见要深交

金沛的国学笔记
2026-09-10 16:42:52
第二个菲律宾出现?主动邀请美国重启军演,中方近70年友谊喂了狗

第二个菲律宾出现?主动邀请美国重启军演,中方近70年友谊喂了狗

真的好爱你
2026-09-10 18:48:38
交涉失败,欧洲议会保台当局参会,大陆已下通牒,事态严重了

交涉失败,欧洲议会保台当局参会,大陆已下通牒,事态严重了

新一说史
2026-09-12 05:10:05
50岁李小冉自曝离婚后真实处境:父母身体不好,一个人住,庆幸身边还有朋友

50岁李小冉自曝离婚后真实处境:父母身体不好,一个人住,庆幸身边还有朋友

动物奇奇怪怪
2026-09-12 09:51:47
招行退休多年的高管突然被查、年薪曾达500万,田惠宇之后3位副行长相继落马

招行退休多年的高管突然被查、年薪曾达500万,田惠宇之后3位副行长相继落马

湘财Plus
2026-09-11 19:45:47
湖南满族人宋剑仁,因煽动民族仇恨民族歧视被判刑三年半

湖南满族人宋剑仁,因煽动民族仇恨民族歧视被判刑三年半

张可象
2026-09-11 14:05:48
“摊上这种同学,家长肯定要调班!”狼尾小学生火了,毛病太多被喷

“摊上这种同学,家长肯定要调班!”狼尾小学生火了,毛病太多被喷

妍妍教育日记
2026-09-11 15:13:18
1500亿的鲍尔默彻底怒了!硬刚萧华,直接把伦纳德事件闹进司法部

1500亿的鲍尔默彻底怒了!硬刚萧华,直接把伦纳德事件闹进司法部

篮球小布丁
2026-09-12 02:44:24
美股科技巨头暴涨近12%创新高,市值一夜飙升2500亿元

美股科技巨头暴涨近12%创新高,市值一夜飙升2500亿元

21世纪经济报道
2026-09-12 08:29:45
绿军交易方案:拿下2.17亿三届全明星,保罗乔治成为重要交易筹码

绿军交易方案:拿下2.17亿三届全明星,保罗乔治成为重要交易筹码

夜白侃球
2026-09-11 11:48:11
美媒:万斯为特朗普“每个选民发5000美元”许诺辩护,被猛烈抨击

美媒:万斯为特朗普“每个选民发5000美元”许诺辩护,被猛烈抨击

环球网资讯
2026-09-11 12:00:31
“典型的上梁不正下梁歪!”家长发视频炫耀,家里没有一个正常人!

“典型的上梁不正下梁歪!”家长发视频炫耀,家里没有一个正常人!

林林先生
2026-08-29 10:51:30
注意!商业地产到期需补缴巨款!

注意!商业地产到期需补缴巨款!

樱桃大房子
2026-09-09 12:12:20
如何判断领导值得跟随?网友:年轻女领导中年男领导待退休老领导

如何判断领导值得跟随?网友:年轻女领导中年男领导待退休老领导

夜深爱杂谈
2026-09-11 22:51:07
湖人消息:佩总操作封神,人事变动官宣,两将离队在即

湖人消息:佩总操作封神,人事变动官宣,两将离队在即

冷月小风风
2026-09-12 10:55:54
魔幻!13年前围堵法布雷加斯的4位曼城大将,如今齐聚欧冠教练席

魔幻!13年前围堵法布雷加斯的4位曼城大将,如今齐聚欧冠教练席

体坛老球迷
2026-09-11 10:27:11
方媛好能忍!郭富城本人满脸皱纹,还有老年斑,个子不高像小老头

方媛好能忍!郭富城本人满脸皱纹,还有老年斑,个子不高像小老头

八卦王者
2026-09-09 14:23:41
2026-09-12 11:40:50
机器人大讲堂 incentive-icons
机器人大讲堂
立德机器人平台,是一个集媒体品牌、智库咨询、投资孵化、引智招商为一体的机器人垂直领域服务平台
7066文章数 4603关注度
往期回顾 全部

科技要闻

苹果折叠屏比小米华为贵5000元,该怎么选

头条要闻

上海7岁女童遭搅拌车辗轧双腿高位截肢 奶奶当场死亡

头条要闻

上海7岁女童遭搅拌车辗轧双腿高位截肢 奶奶当场死亡

体育要闻

老鹰真正的底气来自于什么?

娱乐要闻

港媒曝钟丽淇疑患渐冻症,本人发文

财经要闻

继房子茅台之后 中产的第"神话"也破灭了

汽车要闻

买菜车也有小乐趣 风云T7不止是台合格家用SUV

态度原创

本地
家居
房产
时尚
公开课

本地新闻

Onestage x 乐华娱乐暑期巡回选拔2026

家居要闻

2026建博会(广州) 公装联探展交流活动

房产要闻

别再等了!广州改善好房,正在进入“卖一套少一套”时代

女友BELLA+封面 | Fort&Peat:长日无尽

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版