0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

忆阻器是什么?基于忆阻器的硬件系统有何优势?

工程师邓生 来源:雷锋网 作者:刘琳 2020-02-27 09:43 次阅读

有很多童鞋可能不知道忆阻器是什么?在开始今天的话题之前,雷锋网(公众号:雷锋网)编辑先为大家普及下忆阻器是什么。

所谓忆阻器,全称记忆电阻器(Memristor),是继电阻电容、电感之后的第四种电路基本元件,表示磁通与电荷之间的关系,这种组件的的电阻会随着通过的电流量而改变,而且就算电流停止了,它的电阻仍然会停留在之前的值,直到接受到反向的电流它才会被推回去,等于说能“记住”之前的电流量。

简言之,忆阻器(memristor)可以在断电之后,仍能“记忆”通过的电荷,其所具备的这种特性与神经突触之间的相似性,使其具备获得自主学习功能的潜力。因此,基于忆阻器的神经形态计算系统能为神经网络训练提供快速节能的方法,但是,图像识别模型之一 的卷积神经网络还没有利用忆阻器交叉阵列的完全硬件实现。

不过,最近雷锋网了解到,清华大学微电子所、未来芯片技术高精尖创新中心钱鹤、吴华强教授团队与合作者在《自然》在线发表了题为“ Fully hardware-implemented memristor convolutional neural network ”的研究论文,报道了基于忆阻器阵列芯片卷积网络的完整硬件实现。

他们提出用高能效比、高性能的均匀忆阻器交叉阵列实现 CNN,该实现共集成了 8个 PE ,每个 PE 包含2048 个单元的忆阻器阵列,以提升并行计算效率。此外,研究者还提出了一种高效的混合训练方法,以适应设备缺陷,改进整个系统的性能。研究者构建了基于忆阻器的五层 CNN 来执行 MNIST 图像识别任务,识别准确率超过 96%。

除了使用不同卷积核对共享输入执行并行卷积外,忆阻器阵列还复制了多个相同卷积核,以并行处理不同的输入。相较于当前最优的图形处理器GPU),基于忆阻器的 CNN 神经形态系统的能效要高出一个数量级,且实验证明该系统可扩展至大型网络,如残差神经网络。该结果或可促进针对深度神经网络和边缘计算提供基于忆阻器的非冯诺伊曼(non-von Neumann)硬件解决方案,在处理卷积神经网络(CNN)时的能效比图形处理器芯片(GPU)高两个数量级,大幅提升了计算设备的算力,成功实现了以更小的功耗和更低的硬件成本完成复杂的计算。

首个完全基于忆阻器的 CNN 硬件实现

据介绍,当前国际上的忆阻器研究还停留在简单网络结构的验证,或者基于少量器件数据进行的仿真。基于忆阻器阵列的完整硬件实现仍然有很多挑战。

比如,器件方面,需要制备高一致、可靠的阵列;系统方面,忆阻器因工作原理而存在固有缺陷(如器件间波动、器件电导卡滞、电导状态漂移等),会导致计算准确率降低;架构方面,忆阻器阵列实现卷积功能需要以串行滑动的方式连续采样、计算多个输入块,无法匹配全连接结构的计算效率。

在这些研究成果的基础之上,钱鹤、吴华强团队逐渐优化材料和器件结构,制备出了高性能的忆阻器阵列。

在器件方面,该研究成功实现了一个完整的五层 mCNN,用于执行 MNIST 手写数字图像识别任务。优化后的材料堆栈(material stack)能够在 2048 个单晶体管单忆阻器(one-transistor–one-memristor,1T1R)阵列中实现可靠且均匀的模拟开关行为。使用该研究提出的混合训练机制后,实验在整个测试集上的识别准确率达到了 96.19%。

利用混合训练方法得到 mCNN

此外,该研究在三个并行忆阻器卷积器中复制了卷积核,从而将 mCNN 的延迟降低约 2/3。该研究得到的高度集成神经形态系统弥补了基于忆阻器的卷积运算和全连接 VMM 之间的吞吐量差距,从而为大幅提升 CNN 效率提供了可行的解决方案。

架构方面,之前基于忆阻器的 demo 依赖于单一阵列,其主要原因是生成高度可重复的阵列面临巨大挑战。忆阻器设备的易变性和不完美特性被认为是神经形态计算应用的主要瓶颈。该研究提出了一种基于忆阻器的灵活计算架构,适用于神经网络。

存算一体系统架构

忆阻器单元使用 TiN/TaO_x/HfO_x/TiN 的材料堆叠,通过调节电场和热,在增强(SET)和抑制(RESET)这两种情况下均展现出连续电导率调节能力。材料和制造流程与传统的 CMOS 流程兼容,从而使忆阻器阵列可以方便地内置在晶圆的后段制程中,以减少流程变动,实现高复现性。得到的交叉阵列在同等的编程条件下具备均匀的模拟开关行为。因此,多忆阻器阵列硬件系统基于自定义印刷电路板(PCB)和 FPGA 评估板(ZC706, Xilinx)构建。

系统方面,该系统主要包含八个基于忆阻器的处理元件(PE)。每个 PE 集成了 2048 个单元的忆阻器阵列。每个忆阻器与晶体管的漏级端相连,即 1T1R 配置。核心 PCB 子系统具备八个忆阻器阵列芯片,每个忆阻器阵列具备 128 x 16 个 1T1R 单元。在水平方向上共有 128 条并行字线和 128 条源线,在垂直方向上共有 16 条位线。

基于忆阻器的硬件系统具备可靠的多级电导率状态

该阵列展示了极具可重复性的多级电导率状态,成功证明了存算一体架构全硬件实现的可行性。

有何优势?

众所周知,CNN 是最重要的深度神经网络之一,在图像处理相关任务中发挥关键作用,如图像识别、图像分割和目标检测

CNN 的典型计算步骤需要大量滑动卷积操作。从这个方面来看,CNN 需要支持并行乘积累加运算(MAC)的计算单元。而这需要重新设计传统的计算系统,以便以更高的性能、更低的能耗来运行 CNN,这些计算系统包括通用应用平台(如 GPU)、应用特定的加速器等。

但是,计算效率的进一步提升最终受限于系统的冯诺伊曼架构,该架构中的内存和处理单元是物理分离的,从而导致大量能耗,以及不同单元之间数据搬运的高延迟。

与之相反,基于忆阻器的神经形态计算可以提供非冯诺伊曼计算范式,即存储数据,从而消除数据迁移的消耗。忆阻器阵列直接使用欧姆定律进行加法运算,使用基尔霍夫定律(Kirchhoffs law)进行乘法运算,因而能够实现并行存内(in-memory)MAC 运算,从而模拟存内计算(in-memory computing),并实现速度和能效的大幅提升,减小误差。
责任编辑:wv

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 忆阻器
    +关注

    关注

    8

    文章

    72

    浏览量

    19834
  • cnn
    cnn
    +关注

    关注

    3

    文章

    351

    浏览量

    22168
收藏 人收藏

    评论

    相关推荐

    吉时利源表软件在测试中的应用

    吉时利源表软件在测试中的应用及其优势。 一、什么是吉时利源表软件? 吉时利源表软件是一种用于控制和记录测试设备状态的专用软件。它能够通过精确控制电流、电压等参数,帮助工程师进行各
    的头像 发表于 11-19 16:24 112次阅读
    吉时利源表软件在<b class='flag-5'>忆</b><b class='flag-5'>阻</b><b class='flag-5'>器</b>测试中的应用

    联荣获2024年度闪存控制金奖

    近日,由百易传媒(DOIT)主办的2024中国数据与存储峰会,以“智数据 AI未来”为主题在北京举行,《2024年度存储风云榜》也在会议期间同步揭晓,联企业级控制Phoenix8030和消费级
    的头像 发表于 11-08 18:11 408次阅读

    TDK成功研发出用于神经形态设备的自旋

    委员会(CEA)合作,TDK证明了其“自旋”可以作为神经形态设备的基本元件。今后,TDK将与日本东北大学创新集成电子系统研发中心合作开展此项技术的实际开发工作。
    的头像 发表于 10-14 11:00 384次阅读

    山区风电场接地网长效降的方法哪些

    山区风电场接地网长效降的方法哪些
    发表于 08-22 12:22 0次下载

    诱导的超混沌、多涡旋和极端多稳态小数阶HNN:镜像加密和FPGA实现

    电子发烧友网站提供《诱导的超混沌、多涡旋和极端多稳态小数阶HNN:镜像加密和FPGA实现.pdf》资料免费下载
    发表于 06-03 14:46 0次下载

    通向计算新未来,自旋进一步降低能耗

    电子发烧友网报道(文/李宁远)人工智能、机器学习、大数据是现在蓬勃发展的领域,这些技术的飞速发展拉动了对高性能计算和存储的需求。在这些背景下,独特的性能展现出其广泛的应用前景。  
    的头像 发表于 04-30 00:53 3695次阅读

    如何利用技术改变高精度的科学计算

    当组织成纵横阵列时,这种电路通过以大规模并行方式使用物理定律进行模拟计算,从而大大加速矩阵运算,这是神经网络中最常用但非常耗电的计算。
    发表于 04-03 15:18 601次阅读

    AI时代,恒创源如何定义SSD?

    电子发烧友网报道(文/黄山明) 作为专注于存储技术和应用的产业峰会,今年的CFMS如期在深圳召开。与往期很大区别的是,今年的分享中,聊的更多的其实是AI,或者说是AI将对存储带来的影响。   随着
    的头像 发表于 03-21 18:19 3298次阅读
    AI时代,<b class='flag-5'>忆</b>恒创源如何定义SSD?

    基于VO2的无线物联网混合系统

    针对此问题,北京大学集成电路学院/集成电路高精尖创新中心的杨玉超教授团队首次提出以VO2 为主体的高一致性、可校准的频率振荡,在此基础上构建了8×8的VO2
    的头像 发表于 02-22 09:30 626次阅读

    什么是性负载?什么是感性负载?

    负载具有不同的性质和特点,下面将详细介绍这两种负载类型。 一、性负载: 性负载是指电阻、电子元器件或电阻模拟等负载中的电阻部分。
    的头像 发表于 02-19 13:49 1.4w次阅读

    是什么意思 热符号

    (Thermal Resistance),通常用符号Rth表示,是衡量材料或系统对热能传递的阻碍程度的物理量。类似于电阻对电流流动的阻碍作用,热描述了温度差与通过材料的热流量之间的关系
    的头像 发表于 02-06 13:44 3623次阅读
    热<b class='flag-5'>阻</b>是什么意思 热<b class='flag-5'>阻</b>符号

    适配版图再扩大!联多项产品通过Intel VROC技术认证

    近日,深圳联信息系统有限公司(简称:联)的数据中心级固态硬盘UH711a以及企业级固态硬盘UH811a/UH831a与英特尔VROC7.8完成兼容认证,测试期间,整体运行稳定,在功能、性能
    的头像 发表于 01-09 10:14 666次阅读
    适配版图再扩大!<b class='flag-5'>忆</b>联多项产品通过Intel VROC技术认证

    和电阻的区别 排可以用电阻代替吗

    的含义。排,也称为电流互感,是一种用于测量电流的传感。它的主要作用是将大电流转换为小电流,并提供给仪表或控制系统进行测量、分析和监测
    的头像 发表于 12-29 13:54 2008次阅读

    清华大学研究小组开发出了创新性的超分子纳米RRAM

    其中,电阻式随机存取存储(RRAM)依靠改变电阻水平来存储数据。最近发表在《Angewandte Chemie》杂志上的一项研究详细介绍了清华大学李原领导的研究小组的工作,他们开创了一种制造超分子
    的头像 发表于 12-06 16:05 840次阅读
    清华大学研究小组开发出了创新性的超分子<b class='flag-5'>忆</b><b class='flag-5'>阻</b><b class='flag-5'>器</b>纳米RRAM