
9月1日,他山科技与2024年图灵奖得主、“强化学习之父”理查德·萨顿(Richard Sutton)团队Openmind联合共建的机器人强化学习实验场在北京石景山正式启用。首批不同形态机器人正式入场开始强化学习实验。
在以往的具身智能数据训练中心,机器人通过模仿人类动作学习技能,而在机器人强化学习实验场,机器人通过不断“试错”来学习。记者看到,在实验场内,来自加速进化、宇树科技、高擎动力、节卡机器人等不同企业、不同形态的机器人,正在进行或自主或遥控地不间断探索,比如绕过障碍物、与参观者互动、自由行走。
他山科技研发副总裁侯广东介绍,实验场分为测试区、学习区、交互区三个核心区域。在测试区,搭载他山触觉皮肤的机器人展示了触觉感知能力,在感受到参观者触碰后作出回应;学习区内,机器人在安全环境中尝试与环境交互;交互区是基于远期目标设立的区域,未来计划让机器人在此学习对其他智能体的理解与自主协作能力。
侯广东对中国证券报记者表示,第一阶段,机器人将在实验场内适应环境变化,以“延长在线时间”“减少损伤”为目标,长时间与环境互动,并自主完成充电,这一基础能力可以让机器人未来在家庭等非结构化场景中具备自适应能力。后续,研发团队逐步引入更复杂的算法与实验设计,让机器人建立自我认知(区分自身与外界)、掌握运动控制、理解物体交互、最终实现多智能体间的协作。
配资炒股首选侯广东表示,实验场的价值不仅体现在使机器人自主习得若干技能,更在于构建一套可跨不同机器人本体完成迁移的学习机制,“我们的目标是开发出能够赋予机器人学习能力的模型,而非对单一技能做固化编码,让机器人执行。”
他山科技CEO马扬表示,具身智能的未来需要多种多样的学习方式如何验证成交与持仓,在真实物理世界中通过自主触摸和试错获得成长,是其中重要的进化路径。新启用的机器人强化学习实验场将提供高容错的试错环境、分阶递进的学习路径、持续的多模态真实交互和内在动机驱动的自适应反馈,推动具身智能从被动模仿走向自主进化。
优选杠杆配资网提示:本文来自互联网,不代表本网站观点。