0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

RISC-V迈入HPC市场,性能与生态缺一不可

E4Life 来源:电子发烧友 作者:周凯扬 2024-03-23 00:10 次阅读

电子发烧友网报道(文/周凯扬)近年来,RISC-V已经成了业界不可忽视的成功ISA之一,出货核心数超过百亿颗,但这百亿核心中大部分用在了低功耗IoT等应用上。随着高性能计算已经进入Exascale时代,后发的RISC-V是否有机会在HPC市场占据一席之地,是不少厂商和开发者都在琢磨的问题。

其实从去年开始,RISC-V就已经在往这个方向发力了,各种高性能RISC-V处理器的横空出世,终结了RISC-V只能做中低端的论点。RISC-V国际基金会也在去年将HPC标记为RISC-V发展的战略优先领域之一。倪光南院士在上周举办的玄铁RISC-V生态大会上,也强调了发展基于RISC-V架构的DSA新型服务器是中国的一大机遇。既然如此,市面上已有的高性能RISC-V处理器究竟表现如何,又是否已经建立起相关的生态呢?

SiFive

作为RISC-V IP生态的中坚力量之一,SiFive已经推出了一系列RISC-V IP产品,包括主打高性能的Performance系列、主打AI算力的Intelligence、面向汽车市场的Automotive系列和面向低功耗IoT应用的Essential。

P670作为SiFive Performance系列的主打产品,采用了四发射13级流水线的设计,相较上一代P550,有了50%以上的性能提升。即便是相比Arm的Cortex-A78,依然有着明显的PPA优势。P670的SpecINT2K6/GHz跑分在12以上,已经可以满足部分商用服务器的性能要求。

以算能的SG2380为例,这是一款2.5GHz 16核 RISC-V处理器,也是计划于今年出货的高性能大模型加速器。算能宣称这是RISC-V在LLM应用架构设计上的全新尝试,旨在为移动终端提供最强的大模型性能,支持Llama、StableDiffusion等语言、视觉类大模型支持。SG2380采用了RISC-V CPU+TPU的设计,而CPU部分正是基于SiFive P670打造,TPU则是基于SiFive的X280打造。

为了追求更高的性能,为数据中心提供更高的通用算力支持,SiFive于去年发布Performance的下一代旗舰产品P870。P870采用了6-wide、4发射、最多配置16核的设计,SpecINT2K6/GHz跑分高达18以上。SiFive表示P870非常适合用于消费级应用,或是搭配Vector处理器用于数据中心。

为支持下一代高性能应用,SiFive也已经围绕其RISC-V打造了一系列解决方案,比如Hypervision拓展和系统级的虚拟化IP,WorldGuard系统安全保护等,都能进一步加快RISC-V在HPC和数据中心等应用上的部署。

除此之外,SiFive也已经在规划下一代高性能核心,Napa。不过SiFive目前尚未透露更多关于Napa的情报,可以预想Napa会支持更多的核心数量,采用更先进的工艺,并提供更高的性能。

平头哥

平头哥的C910在2020年面世之际可谓是当时为数不多的RISC-V处理器中,性能最靠前的产品。这个在当时就采用了12级流水线设计的处理器,在台积电12nm的工艺支持下,跑分达到了6 DIMPS/MHz和7 Coremark/MHz,已经可以超越Arm Cortex-A73,更是超越了当时市面上其他乱序RISC-V处理器。

今年,法国云服务厂商Scaleway推出了基于平头哥曳影1520 SoC打造的云服务器实例,这也是首个登录公开商用云服务平台的RISC-V产品,而曳影1520 SoC的CPU部分正是基于四核玄铁C910的设计。除了云实例之外,全球首款RISC-V笔记本电脑ROMA,也是基于曳影1520 SoC打造,足以说明C910在通用计算性能上的优秀。

去年11月,平头哥进一步发布了C920这个加强AI计算的9系列玄铁处理器,维持了12级流水线的设计,但增加了可选配的乱序Vector运算单元,支持最新的Vector 1.0扩展。得益于新的运算单元,C920主要应用于有高并发算力需求的人工智能自动驾驶网络通信等领域。

算能科技也基于玄铁C920打造了SG2042,作为全球首个商用量产的64核RISC-V CPU,SG2042还支持双路CPU互联,典型功耗却只有120W。且在PLCT的支持下,SG2042目前已经适配了Ubuntu、Arch Linux、openEuler、Deepin等多款操作系统,Firefox 和 LibreOffice 等常用办公软件也能成功运行。

今年的玄铁RISC-V生态大会上,达摩院院长张建锋透露C930也将在年内发布,玄铁C930兼容RVA24 Profile,SpecINT2006最高跑分可达15/GHz,令人期待未来会有哪些产品基于玄铁C930打造,以及阿里云是否会开始基于RISC-V硬件提供云实例。

Tenstorrent

Tenstorrent作为业界炙手可热的初创企业之一,已然成为绝大多数RISC-V会议的常客了,基于同一设计,Tenstorrent于短短一年的时间内,发布了五款RISC-V乱序处理器IP,其中Alastor和Ascalon是他们的高性能RISC-V处理器产品,前者针对客户和边缘端市场,后者针对服务器、笔记本和HPC市场。

Tenstorrent的RISC-V处理器IP的高性能设计,主要体现在指令集解码器的宽度。要知道目前的主流x86处理器架构设计,一般不会超过six-wide,比如AMD的Zen 4为4-wide,而英特尔的Golden Cove为6-wide,上面提到的P870也只是6-wide。

而Alastor采用了6-wide指令集解码器宽度的设计,Ascalon更是做到了6-wide指令集解码器宽度。这自然也离不开Tenstorrent的“苹果背景”,毕竟无论是现任CEO,被誉为硅仙人的Jim Keller,还是Tenstorrent的首席CPU架构师Wei-Han Lien,都是苹果宽CPU微架构背后的功臣,苹果M1、A14等芯片的CPU均采用了8-wide的设计。

Ascalon集成了六个ALU、两个FPU和两个Vector单元,规格相当高,所以主要用于高端服务器、数据中心、科学计算、大规模虚拟化以及实时数据分析之类的商业高性能计算应用。从去年Tenstorrent给出的SpecINT2017/GHz成绩来看(Alastor 1.9,Ascalon 2.2),Ascalon 跑分甚至超过了市面上所有主流服务器CPU核心,仅次于预测的AMD Zen 5跑分。

除了高性能计算通用核心外,Tensorrent打造了专用于神经网络推理和训练的专用核心,Tensix。Tensix支持主流数据精度,比如BF4、BF8、INT8、FP16甚至是FP64。相较只提供IP和Chiplet解决方案的RISC-V IP,Tensorrent将提供为Tensix提供IP、Chiplet、芯片、板卡、系统到云的一整套方案。不过将于今年推出的Grendel,将采用CPU+ML Chiplet的设计方案,届时应该会打通Tensorrent现有的RISC-V CPU和AI IP方案。

除了已经开放购买的一些开发板、扩展卡产品外,Jim Keller也在不遗余力地为Tenstorrent寻找生态链伙伴,无论是三星、台积电这样的晶圆代工厂,还是Silicon Box 这样的Chiplet制造厂商等,都与其达成了合作。

写在最后

如果单从绝对性能上看,目前RISC-V处理器和主流x86产品还是存在一些差距,但其实随着HPC和AI需求暴涨,在相关的应用开发上,大家已经意识到一味地追求计算性能本身带来的收益越来越少,反而是对架构、指令集等进行优化带来的收益越来越高。而RISC-V架构的灵活可定制性,恰恰给到了弯道超车的机会。

不过高性能处理器依然是一个必备的敲门砖,因此RISC-V在HPC领域还有很长的一段路要走。除此之外,如何与现有的HPC供应链和开发生态达成协作,是RISC-V必须考虑的一件事,比如如何与服务器OEM合作,按照OCP项目的标准打造通用的服务器解决方案;又或是如何把尽快将众多关键HPC库和工具移植到RISC-V的硬件平台之上。

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • HPC
    HPC
    +关注

    关注

    0

    文章

    331

    浏览量

    24152
  • RISC-V
    +关注

    关注

    46

    文章

    2464

    浏览量

    48114
收藏 人收藏
    相关推荐
    热点推荐

    RISC-V生态崛起:政策落地与高性能芯片的崛起

    近期,RISC-V生态取得重要进展,包括高性能核心板的推出和在工业自动化、物联网等领域的广泛应用。其中,致远电子MR6450系列RISC-V核心板,凭借高
    的头像 发表于 03-06 11:35 541次阅读
    <b class='flag-5'>RISC-V</b><b class='flag-5'>生态</b>崛起:政策落地与高<b class='flag-5'>性能</b>芯片的崛起

    2025中国RISC-V生态大会-运营商分论坛成功举办

    2月28日,为推动运营商与RISC-V生态深度融合,加速RISC-V产业发展,共建RISC-V生态繁荣,由中国移动、中国电信联合主办的中国
    的头像 发表于 02-28 18:52 346次阅读
    2025中国<b class='flag-5'>RISC-V</b><b class='flag-5'>生态</b>大会-运营商分论坛成功举办

    关于RISC-V芯片的应用学习总结

    性、模块化、低功耗、高性能以及可扩展性等优势,在多个领域展现出广泛的应用潜力和市场竞争力。随着技术的不断发展和生态系统的日益完善,RISC-V芯片有望在更多领域发挥重要作用。
    发表于 01-29 08:38

    RISC-V近期市场情况调研

    RISC-V种开源的指令集架构(ISA),近年来在全球范围内迅速崛起,尤其在中国,RISC-V的发展势头十分强劲。以下是目前RISC-V芯片的发展情况,以及中国在这
    的头像 发表于 10-23 15:10 1466次阅读

    RISC-V拥有巨大市场潜力的原因

    旬发布了第三代“香山”开源高性能RISC-V处理器核,其性能水平已进入全球第梯队,可广泛应用于服务器芯片、AI芯片、GPU、DPU等高端芯片领域。 2、技术进步:
    发表于 09-30 14:20

    RISC-V和arm指令集的对比分析

    市场占有率。同时,ARM架构也在服务器领域得到应用,尤其是在低功耗、高性能的服务器中。 四、指令集特点 RISC-VRISC-V的指令集设计简洁,指令数量相对较少(不超过50个)
    发表于 09-28 11:05

    RISC-V Summit China 2024 | 青稞RISC-V+接口PHY,赋能RISC-V高效落地

    与接口PHY的多快少省”主题演讲,从全栈研发模式、内核+接口PHY的矩阵技术体系、产品特色优势和生态建设等视角,系统性地总结了青稞RISC-V系列量产芯片的创新成果和实践经验。 04 少花份钱,多
    发表于 08-30 17:37

    2024 RISC-V 中国峰会:华秋电子助力RISC-V生态

    方案与技术,致力于将峰会的每个精彩瞬间、每项创新成果,精准传递给广大开发者与爱好者,以促进技术交流与合作,共同推动RISC-V生态在中国乃至全球的蓬勃发展。为此,华秋电子<电
    发表于 08-26 16:46

    risc-v的发展历史

    源到公开、标准化、扩展与成熟再到广泛应用与生态系统建设的过程。随着技术的不断进步和市场的不断扩大,RISC-V架构的未来发展前景广阔。
    发表于 07-29 17:20

    rIsc-v的缺的是什么?

    的支持和合作。 综上所述,RISC-V架构在性能生态系统支持、市场份额和技术挑战等方面仍存在定的不足之处。然而,随着
    发表于 07-29 17:18

    RISC-V在中国的发展机遇有哪些场景?

    的理想选择。 生态系统建设:多家头部芯片公司和生态厂商正在积极推进RISC-V在车规级产品的布局,这将有助于RISC-V在汽车领域的快速发展。 4. 数据中心和高
    发表于 07-29 17:14

    浅析RISC-V领先ARM的优势

    和成本要求。 ARM虽然也具有定的可定制性,但受限于其指令集架构的复杂性和历史包袱,其定制化的灵活性和自由度相对较低。 生态系统的快速发展: 随着RISC-V的开源特性得到越来越多开发者和企业的认可
    发表于 06-27 08:45

    risc-v的mcu对RTOS兼容性如何

    设计、中断响应速度以及RTOS的调度策略。 RISC-V MCU可能具有特定的硬件特性(如快速中断响应、低延迟I/O等),这些特性可以增强RTOS的实时性能。 软件生态和工具链
    发表于 05-27 16:26

    RISC-V的MCU关于USB高速通信设计的难点

    竞争力。 综上所述,RISC-V的MCU在USB高速通信设计方面需要解决硬件集成、性能优化、软件生态和成本效益等方面的难点。通过不断的技术创新和市场拓展,
    发表于 05-27 16:23

    RISC-V的MCU与ARM对比

    生态系统与市场 RISC-VRISC-V具有个活跃的开源社区,吸引了全球开发者参与其生态
    发表于 05-27 15:58

    有几种电平转换电路,适用于不同的场景

    一.起因一般在消费电路的元器件之间,不同的器件IO的电压是不同的,常规的有5V,3.3V,1.8V等。当器件的IO电压一样的时候,比如都是5V,都是3.3V,那么其之间可以直接通讯,比如拉中断,I2Cdata/clk脚双方直接通讯等。当器件的IO电压不一样的时候,就需要进行电平转换,不然无法实现高低电平的变化。二.电平转换电路常见的有几种电平转换电路,适用于

    张飞实战电子官方
    21小时前
    208

    瑞萨RA8系列教程 | 基于 RASC 生成 Keil 工程

    对于不习惯用 e2 studio 进行开发的同学,可以借助 RASC 生成 Keil 工程,然后在 Keil 环境下愉快的完成开发任务。

    RA生态工作室
    05-01 10:00
    408

    共赴之约 | 第二十七届中国北京国际科技产业博览会圆满落幕

    作为第二十七届北京科博会的参展方,芯佰微有幸与800余家全球科技同仁共赴「科技引领创享未来」之约!文章来源:北京贸促5月11日下午,第二十七届中国北京国际科技产业博览会圆满落幕。本届北京科博会主题为“科技引领创享未来”,由北京市人民政府主办,北京市贸促会,北京市科委、中关村管委会,北京市经济和信息化局,北京市知识产权局和北辰集团共同承办。5万平方米的展览云集

    芯佰微电子
    1天前
    450

    道生物联与巍泰技术联合发布 RTK 无线定位系统:TurMass™ 技术与厘米级高精度定位的深度融合

    道生物联与巍泰技术联合推出全新一代 RTK 无线定位系统——WTS-100(V3.0 RTK)。该系统以巍泰技术自主研发的 RTK(实时动态载波相位差分)高精度定位技术为核心,深度融合道生物联国产新兴窄带高并发 TurMass™ 无线通信技术,为室外大规模定位场景提供厘米级高精度、广覆盖、高并发、低功耗、低成本的一站式解决方案,助力行业智能化升级。

    道生物联
    1天前
    390

    智能家居中的清凉“智”选,310V无刷吊扇驱动方案--其利天下

    炎炎夏日,如何营造出清凉、舒适且节能的室内环境成为了大众关注的焦点。吊扇作为一种经典的家用电器,以其大风量、长寿命、低能耗等优势,依然是众多家庭的首选。而随着智能控制技术与无刷电机技术的不断进步,吊扇正朝着智能化、高效化、低噪化的方向发展。那么接下来小编将结合目前市面上的指标,详细为大家讲解其利天下有限公司推出的无刷吊扇驱动方案。▲其利天下无刷吊扇驱动方案一

    其利天下技术
    05-10 16:29
    844

    电源入口处防反接电路-汽车电子硬件电路设计

    一、为什么要设计防反接电路电源入口处接线及线束制作一般人为操作,有正极和负极接反的可能性,可能会损坏电源和负载电路;汽车电子产品电性能测试标准ISO16750-2的4.7节包含了电压极性反接测试,汽车电子产品须通过该项测试。二、防反接电路设计1.基础版:二极管串联二极管是最简单的防反接电路,因为电源有电源路径(即正极)和返回路径(即负极,GND),那么用二极

    张飞实战电子官方
    05-09 19:34
    845

    半导体芯片需要做哪些测试

    首先我们需要了解芯片制造环节做⼀款芯片最基本的环节是设计->流片->封装->测试,芯片成本构成⼀般为人力成本20%,流片40%,封装35%,测试5%(对于先进工艺,流片成本可能超过60%)。测试其实是芯片各个环节中最“便宜”的一步,在这个每家公司都喊着“CostDown”的激烈市场中,人力成本逐年攀升,晶圆厂和封装厂都在乙方市场中“叱咤风云”,唯独只有测试显

    汉通达
    05-09 10:02
    791

    解决方案 | 芯佰微赋能示波器:高速ADC、USB控制器和RS232芯片——高性能示波器的秘密武器!

    示波器解决方案总述:示波器是电子技术领域中不可或缺的精密测量仪器,通过直观的波形显示,将电信号随时间的变化转化为可视化图形,使复杂的电子现象变得清晰易懂。无论是在科研探索、工业检测还是通信领域,示波器都发挥着不可替代的作用,帮助工程师和技术人员深入剖析电信号的细节,精准定位问题所在,为创新与发展提供坚实的技术支撑。一、技术瓶颈亟待突破性能指标受限:受模拟前端

    芯佰微电子
    05-09 10:36
    1.5k

    硬件设计基础----运算放大器

    1什么是运算放大器运算放大器(运放)用于调节和放大模拟信号,运放是一个内含多级放大电路的集成器件,如图所示:左图为同相位,Vn端接地或稳定的电平,Vp端电平上升,则输出端Vo电平上升,Vp端电平下降,则输出端Vo电平下降;右图为反相位,Vp端接地或稳定的电平,Vn端电平上升,则输出端Vo电平下降,Vn端电平下降,则输出端Vo电平上升2运算放大器的性质理想运算

    张飞实战电子官方
    05-08 19:34
    594

    ElfBoard技术贴|如何调整eMMC存储分区

    ELF 2开发板基于瑞芯微RK3588高性能处理器设计,拥有四核ARM Cortex-A76与四核ARM Cortex-A55的CPU架构,主频高达2.4GHz,内置6TOPS算力的NPU,这一设计让它能够轻松驾驭多种深度学习框架,高效处理各类复杂的AI任务。

    ElfBoard
    05-08 15:01
    1.1k

    米尔基于MYD-YG2LX系统启动时间优化应用笔记

    1.概述MYD-YG2LX采用瑞萨RZ/G2L作为核心处理器,该处理器搭载双核Cortex-A55@1.2GHz+Cortex-M33@200MHz处理器,其内部集成高性能3D加速引擎Mail-G31GPU(500MHz)和视频处理单元(支持H.264硬件编解码),16位的DDR4-1600/DDR3L-1333内存控制器、千兆以太网控制器、USB、CAN、

    米尔电子
    05-08 08:07
    395

    运放技术——基本电路分析

    虚短和虚断的概念由于运放的电压放大倍数很大,一般通用型运算放大器的开环电压放大倍数都在80dB以上。而运放的输出电压是有限的,一般在10V~14V。因此运放的差模输入电压不足1mV,两输入端近似等电位,相当于“短路”。开环电压放大倍数越大,两输入端的电位越接近相等。“虚短”是指在分析运算放大器处于线性状态时,可把两输入端视为等电位,这一特性称为虚假短路,简称

    张飞实战电子官方
    05-07 19:32
    547

    飞凌嵌入式携手中移物联,谱写全国产化方案新生态

    4月22日,飞凌嵌入式“2025嵌入式及边缘AI技术论坛”在深圳成功举办。中移物联网有限公司(以下简称“中移物联”)携OneOS操作系统与飞凌嵌入式共同推出的工业级核心板亮相会议展区,操作系统产品部高级专家严镭受邀作《OneOS工业操作系统——助力国产化智能制造》主题演讲。

    飞凌嵌入式
    05-07 11:26
    1.7k

    ATA-2022B高压放大器在螺栓松动检测中的应用

    实验名称:ATA-2022B高压放大器在螺栓松动检测中的应用实验方向:超声检测实验设备:ATA-2022B高压放大器、函数信号发生器,压电陶瓷片,数据采集卡,示波器,PC等实验内容:本研究基于振动声调制的螺栓松动检测方法,其中低频泵浦波采用单频信号,而高频探测波采用扫频信号,利用泵浦波和探测波在接触面的振动声调制响应对螺栓的松动程度进行检测。通过螺栓松动检测

    Aigtek安泰电子
    05-06 18:44
    1.1k

    MOS管驱动电路——电机干扰与防护处理

    此电路分主电路(完成功能)和保护功能电路。MOS管驱动相关知识:1、跟双极性晶体管相比,一般认为使MOS管导通不需要电流,只要GS电压(Vbe类似)高于一定的值,就可以了。MOS管和晶体管向比较c,b,e—–>d(漏),g(栅),s(源)。2、NMOS的特性,Vgs大于一定的值就会导通,适合用于源极接地时的情况(低端驱动),只要栅极电压达到4V或10V就可以

    张飞实战电子官方
    05-06 19:34
    574