0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

AI算法教机器人从零开始学走路

天津机器人 来源:cg 2019-01-03 11:05 次阅读
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

2018年12月,来自加利福尼亚大学伯克利分校和谷歌大脑的科学家们开发出了一套人工智能系统,它可以让机器人自己学会走路。这一成果发表于预印本网站arXiv.org上,论文题为《通过深度强化学习来学习走路》(Learning to Walk via Deep Reinforcement Learning)。

在研究人员公布的视频资料中,四足机器人Minitaur试图走过一个平整的缓坡。在视频开头,时间显示为0,这是四足机器人学习走路的开始。此时的四足机器人Minitaur如一个蹒跚学步的婴儿,时而摇晃、时而原地踏步,它尝试着迈开“腿”前进,但身体却“诚实”地留在原地,整个行走过程进展缓慢。转变发生在Minitaur学习走路的第18分钟,这时它已经可以持续性地前进了,但平衡性稍显不足。后续的练习中,Minitaur的步伐逐渐变得稳定且迅速。54分钟、72分钟、108分钟,不到2小时的时间,Minitaur基本学会了快速且平稳地走过缓坡。

这就是四足机器人Minitaur学习走路的全过程。加利福尼亚大学伯克利分校和谷歌大脑的科学家们研发出的人工智能算法“教”会了这个四足机器人穿越熟悉或陌生的地形。

在整个训练过程中,研究人员需要“手动”把走到缓坡尽头的机器人“请”回缓坡的起点以重新开始新一轮的练习,这一手动复位的过程稍显繁琐。不过,从结果来看,这一耗时2小时的学步过程实属高效,不少网友就此评价称“AI真是个好老师”。

在人工智能领域中经常提到“强化学习”的概念,这是一种使用奖励或惩罚的驱动来实现特定目标的人工智能方法,目的是获得一个策略以指导行动。比如围棋博弈中,这个策略可以根据盘面形势指导每一步应该在哪里落子。而在四足机器人Minitaur学习走路的过程中,这个策略可以根据地形等要素告诉机器人下一步应该怎么走。

强化学习会从一个初始的策略开始。通常,初始策略不一定很理想,正如四足机器人Minitaur在刚开始学走路的时候所表现的那样。不过。在学习的过程中,作为决策主体的四足机器人Minitaur会通过行动和环境进行交互,不断获得反馈,即回报或者惩罚,并根据反馈调整优化策略。

强化学习是一种非常强大的学习方式。持续不断的强化学习甚至能够获得比人类更优的决策机制。最好的例子就是阿尔法狗。2016年,谷歌通过深度学习训练的阿尔法狗( AlphaGo)程序以4比1的比分战胜了曾经的围棋世界冠军李世石。它的改进版更在2017年战胜了当时世界排名第一的中国棋手柯洁,其令世人震惊的博弈能力就是通过强化学习训练出来的。

但强化学习也有其局限性。它需要大量数据,在某些情况下需要数万个样本才能获得良好的结果。这就需要四足机器人Minitaur像阿尔法狗那样进行多次训练,但过多的训练可能会对四足机器人造成损坏。

因此,这项“学习走路”的研究选择了强化学习的“升级版”——深度强化学习的方法,将深度学习的感知能力和强化学习的决策能力相结合。这种方法可以直接根据输入的图像进行控制,是一种更接近人类思维方式的人工智能方法。

用研究人员的话说,为了“使一个系统在没有模拟训练的情况下学习运动技能成为可能”,他们采用了一种名为“最大熵RL”强化学习框架。最大熵RL可以优化学习策略,以最大化预期收益。在这个框架中,人工智能代理通过从策略中抽取某些行动并接收奖励的方式不断地寻找最佳的行动路径。

研究人员表示,“据我们所知,本实验是在现实世界中不经过模仿和预训练而直接学习欠驱动四足运动的第一个深度强化学习算法案例。

2018年5月,同个课题组的研究人员曾在arXiv.org上发表了另一篇关于四足机器人Minitaur的研究论文。当时,研究人员使用深度强化学习的方法使Minitaur从零开始学习四足运动,并最终实现了小跑和疾驰。

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 机器人
    +关注

    关注

    213

    文章

    31481

    浏览量

    223724
  • 人工智能
    +关注

    关注

    1820

    文章

    50355

    浏览量

    267011

原文标题:人工智能算法教机器人学走路:从零开始,耗时两小时

文章出处:【微信号:tjrobot,微信公众号:天津机器人】欢迎添加关注!文章转载请注明出处。

收藏 人收藏
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

    评论

    相关推荐
    热点推荐

    基于米尔RK3576核心板的国产割草机器人解决方案

    障决策 :利用NPU加速运行轻量化YOLO等国产优化模型,精准识别草坪中的障碍物。 全覆盖路径规划 :利用A72大核运行弓字形覆盖算法、边界回充算法,相比传统随机式机器人,作业效率可提升80%以上
    发表于 04-24 17:31

    杰和科技亮相机器人大会,边缘AI驱动机器人场景落地

    4月22日,业内领先的嵌入式边缘AI厂商杰和科技亮相FAIRplus2026机器人全产业链接会。基于在工业嵌入式、边缘AI领域的深厚积累,杰和科技立足机器人底层功能需求,聚焦
    的头像 发表于 04-22 16:39 597次阅读
    杰和科技亮相<b class='flag-5'>机器人</b>大会,边缘<b class='flag-5'>AI</b>驱动<b class='flag-5'>机器人</b>场景落地

    人形机器人爆发背后,一个被忽视的核心技术:机器人运动控制

    前言近两年,中国人形机器人产业进入快速发展阶段。从特斯拉Optimus到国内众多创新企业,人形机器人正逐渐从实验室走向工业制造、服务机器人、医疗康复等更多应用场景。但在炫目的机械结构与AI
    的头像 发表于 03-10 17:04 1304次阅读
    人形<b class='flag-5'>机器人</b>爆发背后,一个被忽视的核心技术:<b class='flag-5'>机器人</b>运动<b class='flag-5'>学</b>控制

    AI机器人控制进阶教程(入门版)》阅读指引

    一、为何要学习“AI+机器人”?在开始动手实验前,理解“AI”与“机器人”结合的价值至关重要。这不仅是技术的融合,更是开启智能体(Agent
    的头像 发表于 01-07 10:56 2446次阅读
    《<b class='flag-5'>AI</b><b class='flag-5'>机器人</b>控制进阶教程(入门版)》阅读指引

    探索RISC-V在机器人领域的潜力

    SLAM等轻量级算法时表现出了不错的性能,CPU占用率在可接受范围内。整个系统响应及时,证明了MUSE Pi Pro完全有能力作为小型移动机器人的“大脑”。 四、 其他功能浅尝 • AI模型部署
    发表于 12-03 14:40

    高精度机器人控制的核心——基于 MYD-LT536 开发板的精密运动控制方案

    ISP多媒体接口,适合构建机器人视觉-运动融合系统,实现工件识别与动态定位。 3. 支持闭环控制与误差校正 可结合高分辨率编码器反馈数据,运行机器人闭环控制算法; 利用AI 协处理
    发表于 11-14 15:48

    德赛西威推出机器人智能基座AI Cube

    近日,德赛西威正式发布机器人智能基座AI Cube,该产品是面向机器人领域的AI计算终端,集成了业界领先的高性能计算平台、中间件与算法框架。
    的头像 发表于 11-05 18:05 2769次阅读

    RK3576机器人核心:三屏异显+八路摄像头,重塑机器人交互与感知

    ?RK3576的强大并非偶然,其架构设计完美契合了现代机器人的核心需求:· 强大的异构计算与AI能力:内置的NPU为机器人的视觉AI算法(如
    发表于 10-29 16:41

    小萝卜机器人的故事

    经过我的申请, 马老师发放了, 小萝卜机器人的, 开发权限, 原来的小萝卜公司, 因为经营不善倒闭, 作为科研产品, 几个技术对此惋惜, 自掏腰包, 要让小萝卜机器人, 再生, 每次听到小萝卜说
    发表于 10-23 05:24

    再掀语音交互革命,广和通AI解决方案加速机器人听觉进化

    ”。面对机器人等新一代智能终端对AI语音交互的新需求,广和通深度整合硬件SoC平台与AI语音算法,通过端云协同方案,助力机器人听觉突破噪声与
    的头像 发表于 08-26 17:44 1046次阅读

    工业机器人的特点

    的基础,也是三者的实现终端,智能制造装备产业包括高档数控机床、工业机器人、自动化成套生产线、精密仪器仪表、智能传感器、汽车自动化焊接线、柔性自动化生产线、智能农机、3D 打印机等领域。而智能制造装备中工业
    发表于 07-26 11:22

    江智机器人公司自制的常用机器人及其主要部件检测装备

    1宗旨江智机器人公司自2016年开始生产机器人至今近10年,已根据自己机器人实际订单需要,自行研制开发生产了机器人以及主要
    的头像 发表于 07-13 19:28 1790次阅读
    江智<b class='flag-5'>机器人</b>公司自制的常用<b class='flag-5'>机器人</b>及其主要<b class='flag-5'>零</b>部件检测装备

    松下机器人编程教学课件资料

    松下机器人编程教学课件(新)
    发表于 06-11 17:23 1次下载

    盘点#机器人开发平台

    地瓜机器人RDK X5开发套件地瓜机器人RDK X5开发套件产品介绍 旭日5芯片10TOPs算力-电子发烧友网机器人开发套件 Kria KR260机器人开发套件 Kria KR260-
    发表于 05-13 15:02

    【「# ROS 2智能机器人开发实践」阅读体验】视觉实现的基础算法的应用

    的本质是解决“鸡与蛋”问题:机器人需要地图来定位,又需要准确定位来构建地图。书中从前端(传感器数据处理)和后端(位姿优化)两个层面解析了SLAM的算法逻辑。 激光雷达和视觉SLAM各有优劣,例如激光
    发表于 05-03 19:41