0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

从算法到RTL实现的问题

OpenFPGA 来源:OpenFPGA 作者:OpenFPGA 2022-04-28 09:50 次阅读

针对近日技术交流群里讨论的算法与RTL实现问题,写篇文章,做一次总结。

微信公众号《FPGA算法工程师》技术交流群里,交流气氛十分热烈,大家针对学习和工作中遇到的难点进行交流和讨论,可谓受益匪浅。

新手遇到的是新问题,对于有相关经验的工程师而言,可能都遇到过。

作为算法、FPGA和IC等集中交流的平台,群贤毕至,集思广益,解决大家对相关知识和技术上的困惑,让问题变得更简单。

群友们提到一个很多人都会遇到的现实问题:

“把一个算法用RTL实现,有哪些比较科学的步骤?第一步干什么?第二步干什么?第三步干什么……?”

25fd8232-c68c-11ec-bce3-dac502259ad0.png

这个问题,对于FPGA、ASIC等逻辑电路设计人员来讲,是非常重要的问题。

通常来讲,我们做算法实现,需要有对标的算法模型,作为验证硬件逻辑设计是否正确的参考依据。

我们首先要根据实际需求,针对某方面的信号处理问题,做一个链路级或模块级快速仿真验证设计。最常见的比如通过MATLAB/C/C++等软件环境进行设计和验证。

26274ebe-c68c-11ec-bce3-dac502259ad0.png

软件环境可以快速搭建仿真模型,并且进行验证,为硬件RTL实现提供参考依据。在具体算法设计时,必须考虑数据流的处理过程:数据从哪里来,数据需要经过哪些步骤处理,处理之后送到哪里。

接下来,我们需要将MATLAB、C++等算法模型由浮点转为定点,这个工作可以做好之后再去做逻辑设计,也可以省略,但一定要清楚是如何定点的。

做好算法设计后,需要进行性能评估,看是否符合预期要求,不符合则进一步优化,或者换一种设计方法。

在做逻辑实现之前,还有一个重要工作,就是对算法处理步骤进行一步一步分解,解决如何从a到b再到c的过程,落实到加减乘除。

当算法实际满足要求后,则考虑逻辑实现的问题。

首先,建议采用自顶向下的设计思想,进行系统架构设计,明确整个处理过程,需要执行哪些功能,涉及哪些接口

26520e7e-c68c-11ec-bce3-dac502259ad0.png

接下来,选芯片器件,评估资源占用情况,评估需要用多少乘法器,除法器,DSP,BRAM,GT等。

其次,评估处理时间要求,是否需要实时性处理,给予多少时间来处理,进而评估所需时钟频率,以及是否需要存在多个时钟域处理。

2674f1f0-c68c-11ec-bce3-dac502259ad0.png

对于信号处理系统,有的需要实时处理,有的则不需要实时处理。最具挑战的无疑是实时性要求高的通信、雷达和图像等领域的信号处理问题。

首先解决信号处理中的算法问题,为实现某一处理过程,需要分哪些步骤,最终得到什么样的结果。

为了实现实时处理,逻辑电路该怎么去设计?

26932094-c68c-11ec-bce3-dac502259ad0.png

于是,算法问题既要研究如何处理数据流的问题,也要研究如何快速处理的问题。

电路实现时,则需要考虑资源消耗、并行处理结构,流水处理和控制逻辑。

26a9990a-c68c-11ec-bce3-dac502259ad0.png

如果有处理速率要求,则需考虑并行+流水的处理方式,并考虑单时钟下的数据位宽。

同时,务必明确数据流向,前后级接口,功能模块内部RTL逻辑处理,细化到每个时钟应该怎么处理,step by step。

26d59852-c68c-11ec-bce3-dac502259ad0.png

以上都比较明确后,可以着手进行RTL设计。RTL设计的核心,便是寄存器RAM和FSM的灵活使用。其中,FSM占据了大部分功能。通常情况下,我们不只是操作纯数据流,而是在各种控制信号和参数下进行设计,此时涉及各种FSM和选择器设计,并注意是否需要进行流控。

26ee1b66-c68c-11ec-bce3-dac502259ad0.png

RTL代码设计完成之后,进行TestBench平台搭建和仿真验证是必要的,特别是对于复杂功能模块或系统设计而言。经验再丰富的工程师,也不敢保证,不经过仿真验证直接上板一定没问题。

验证也是一门重要的技术,这也是为什么存在IC验证岗位,目的就是为芯片成功流片严格把关,一旦流片失败,损失重大,影响深远。

FPGA的开发设计,同样需要进行仿真验证。通常,我们可以通过算法链路产生所需激励源,通过TestBench对功能模块进行验证,并进行结果对比分析。重点解决两个问题:

一是验证逻辑时序是否存在问题,比如信号是否对齐,有无接口处理不当导致数据丢失等。

二是信号处理过程是否得当,数据位宽、精度等是否符合算法要求。

解决功能性问题后,就需要考虑性能问题。定点是否合适,与浮点算法性能的差异有多大,或者软件中的定点处理与逻辑电路定点处理,误差有多大。在不断验证过程中,优化算法设计和逻辑电路设计。

剩下的逻辑综合、实现、比特流生成和调试等环节,属于常规操作,但对于逻辑综合、实现中的时序约束和相关策略设置,也是十分重要的。

26fabb28-c68c-11ec-bce3-dac502259ad0.png

最后,用一张图总结如何从算法到RTL实现。

2709a3c2-c68c-11ec-bce3-dac502259ad0.png

本文只是粗略地分析了算法到RTL代码实现之间的逻辑关系,以及从实现角度,我们应该怎么去着手。

具体到某个信号处理算法实现时,必须清楚整个信号处理过程,对算法一步一步分解,再对信号流、定点和接口进行设计。

做任何事情之前,先谋划布局,磨刀不误砍柴工,扎扎实实做好每一步,功到自然成。

---END---

审核编辑 :李倩

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 算法
    +关注

    关注

    23

    文章

    4599

    浏览量

    92613
  • RTL
    RTL
    +关注

    关注

    1

    文章

    385

    浏览量

    59692

原文标题:从算法到RTL实现,FPGA工程师该怎么做?

文章出处:【微信号:Open_FPGA,微信公众号:OpenFPGA】欢迎添加关注!文章转载请注明出处。

收藏 人收藏

    评论

    相关推荐

    【「算法电路—数字芯片算法的电路实现」阅读体验】+内容简介

    内容简介这是一本深入解读基础算法及其电路设计,以打通算法研发到数字IC设计的实现屏障,以及指导芯片设计工程师从底层掌握复杂电路设计与优化方法为目标的专业技术书。任何芯片(如WiFi芯片、5G芯片
    发表于 11-21 17:14

    【「算法电路—数字芯片算法的电路实现」阅读体验】+介绍基础硬件算法模块

    作为嵌入式开发者往往比较关注硬件和软件的协调。本书介绍了除法器,信号发生器,滤波器,分频器等基本算法的电路实现,虽然都是基础内容,但是也是最常用到的基本模块。 随着逆全球化趋势的出现,过去的研发
    发表于 11-21 17:05

    【「算法电路—数字芯片算法的电路实现」阅读体验】+第九章sigma delta adc阅读与分享

    思想几行代码实现降帧率算法。 https://mp.weixin.qq.com/s/9Vhe1rUCI8ZGBGGy3todcwPDM系列文章之二:一文搞懂PDM编码基本原理1bit
    发表于 11-20 13:58

    【「算法电路—数字芯片算法的电路实现」阅读体验】+一本介绍基础硬件算法模块实现的好书

    作为嵌入式开发者往往比较关注硬件和软件的协调。本书介绍了除法器,信号发生器,滤波器,分频器等基本算法的电路实现,虽然都是基础内容,但是也是最常用到的基本模块,本书的内容比较对本人胃口。 我们先来
    发表于 11-20 13:42

    RTL8192CU驱动

    RTL8192CU驱动,支持WINXP/7/10
    发表于 10-29 10:17 1次下载

    名单公布!【书籍评测活动NO.46】算法电路 | 数字芯片算法的电路实现

    :elecfans123)领取书籍进行评测,如在5个工作日内未联系,视为放弃本次试用评测资格! 《算法电路——数字芯片算法的电路实现
    发表于 10-09 13:43

    RTL8187L和802.11n

    802.11n:802.11n是IEEE制定的一种无线传输标准,用于实现高速无线网络连接。它支持多输入多输出(MIMO)和40MHz频带宽度,可以将数据传输速率提高600Mbps或更高。此标准通常在
    发表于 08-24 14:23

    名单公布!【书籍评测活动NO.40】数字IC设计入门,多角度透视芯片设计

    共4项。移知课程“算法RTL实现”主讲人。 申请时间 2024年8月8日——2024年9月8日 活动参与方式 1、在本帖下方留言回帖
    发表于 08-08 15:31

    FCom解读热敏晶振与温补晶振:结构原理,差异使用条件

    解读热敏晶振与温补晶振:结构原理,差异使用条件 一、结构组成 二、工作原理 三、相似点 四、区别 五、使用条件
    的头像 发表于 05-23 12:04 1582次阅读
    FCom解读热敏晶振与温补晶振:<b class='flag-5'>从</b>结构<b class='flag-5'>到</b>原理,<b class='flag-5'>从</b>差异<b class='flag-5'>到</b>使用条件

    基于树莓派5的RTL仿真体验

    《基于树莓派5的RTL仿真体验》 对于FPGA或者RTL爱好者来讲,树莓派5开发板可以运行RTL仿真,仿真工具使用iverilog,波形工具使用gtkwave。为什么是这些?因为工具免费且对硬件性能
    发表于 04-30 17:35

    数月几小时,这枚Multi-Die系统芯片是如何快速交付的?

    软件已成为当今电子系统中不可或缺的组成部分。虚拟现实(VR)头显,高等级自动驾驶汽车,这些由软件驱动的系统都依赖于精密的复杂算法,才能让元宇宙沉浸式体验
    的头像 发表于 12-26 17:53 734次阅读

    浮点LMS算法的FPGA实现

    引言 LMS(最小均方)算法因其收敛速度快及算法实现简单等特点在自适应滤波器、自适应天线阵技术等领域得到了十分广泛的应用。为了发挥算法的最佳性能,必须采用具有大动态范围及运算精度的浮点
    的头像 发表于 12-21 16:40 716次阅读

    详解均值滤波非局部均值滤波算法的原理及实现方式

    将再啰嗦一次,详解均值滤波非局部均值滤波算法的原理及实现方式。 细数主要的2D降噪算法,如下图所示,
    的头像 发表于 12-19 16:30 1113次阅读
    详解<b class='flag-5'>从</b>均值滤波<b class='flag-5'>到</b>非局部均值滤波<b class='flag-5'>算法</b>的原理及<b class='flag-5'>实现</b>方式

    如何用RTL原语实现MUX门级映射呢?

    对于前端设计人员,经常会需要一个MUX来对工作模式,数据路径进行明确(explicit)的声明,这个对于中后端工程师下约束也很重要。这里介绍一种巧用的RTL原语,实现MUX的方法。
    的头像 发表于 12-14 16:26 1333次阅读
    如何用<b class='flag-5'>RTL</b>原语<b class='flag-5'>实现</b>MUX门级映射呢?

    数字前端生存指南—RTL

    在数字前端领域,RTL几乎与“设计代码”概念相同。
    的头像 发表于 12-04 10:14 8375次阅读
    数字前端生存指南—<b class='flag-5'>RTL</b>