0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

DeepX的AI加速器能够脱颖而出吗?

Astroys 来源:Astroys 2023-06-08 16:48 次阅读

在评估AI硬件时,规格竞赛(能效、性能和对各种算法的支持)绝对是重要的。

但是,当系统公司把在GPU上开发的AI模型移植到其他类型的硬件时发生的精度损失怎么处理呢?这就是DeepX的特色。

上周,AI芯片初创公司DeepX的创始人Lokwon Kim,在加州Santa Clara的展会上推出了一系列AI加速器。Kim声称,这些芯片将实现“无处不在的AI,人人可用的AI。”

Kim选择了嵌入式视觉峰会作为他的首次公开亮相。需明确的是,DeepX是一个刚加入这个拥挤赛道的初创公司。然而,DeepX在韩国却有着深厚的根基。通过向韩国政府积极地营销,Kim已经把DeepX在AI领域的研发变成了一个国家项目。

DeepX从政府那里筹集了4000万美元,还在韩国的风投圈中筹集了2000万美元。根据Kim的说法,今年晚些时候将计划进行B轮融资。

DeepX正在推出一系列用于边缘设备嵌入式视觉产品的AI加速器。它还开发了包括编译器和运行时在内的软件开发套件DXNN。DeepX认为DXNN是其皇冠上的明珠。

据报道,DXNN可以简化深度学习模型部署到DeepX的AI SoC的过程。其编译器提供了高性能量化、模型优化和NPU推理编译的工具。其运行时包括NPU设备驱动程序、带有API的运行时和NPU固件。

最重要的是,该公司声称,DXNN支持“以浮点格式训练的DNN模型的自动量化”。

DeepX并没有凭空创造出其AI硬件架构。Kim说,自2016年创立公司以来,“我们实际上已经与数百家全球公司坐下来进行了面谈。”

Kim观察到,“可扩展性、AI精度以及功率/性能效率”是边缘AI系统开发者一直在苦苦挣扎的三个领域。DeepX的目标是在其AI加速器上实现GPU级的AI精度,同时提供高吞吐量和低功耗。

DeepX的源起

在DeepX之前,Kim是Apple的AP的首席设计师,参与开发了A10、A11 Bionic和A12 Bionic。

Kim创办DeepX的灵感来源于他2010年在IBM的T.J. Watson研究中心做访问学者的经历。他当时的工作是开发深度学习MPU,这是DARPA指派给IBM的一个项目。

当时Kim是UCLA的博士生,自那以后,他一直沉迷于在MPU上运行DNN的想法。

即使在加入Apple后,Kim也一直坚持着自己的AI创业梦想。“我实际上已经把我的想法带给了Apple的高层管理人员。”他们拒绝了,于是Kim结束了在Apple的工作,并返回韩国。

Kim表示,他非常敬仰张忠谋。半导体行业对张忠谋的贡献有很大的感激之情。张忠谋离开美国,在台湾创办了TSMC。这个起初并不被看好的企业最终成为了全球最大的代工巨头。

Kim说,TSMC对台湾的重要性(无论是经济上还是政治上)已不言而喻。通过利用AI的力量,Kim希望在他的祖国取得类似的重要地位。

这是一个大胆的说法。但是Kim的想法反映了这个时代。无论是好是坏,地缘政治已经成为先进半导体发展的内在因素。

战略

DeepX设计了同属一系列的四款AI加速器,所有的焦点都集中在视觉应用上。其策略是为多个边缘视觉AI领域提供可扩展的解决方案。

DX-L1,适用于IP摄像头、车内监控、机器人摄像头和无人机等摄像头应用。

DX-L1包含四核RISC-V、ISP、MIPI和视频编码器,提供12 eTOPS的AI性能。Kim指的eTOPS是“相当于GPU的TOPS的性能度量标准”。

DX-L2支持3-4个摄像头的边缘AI视觉系统,提供38 eTOPS。

DX-M1,配备了双核ARM核和ISP,支持10个摄像头,提供200 eTOPS。

DX-H1,提供1600 eTOPS,将以PCIe卡的形式生产,可以部署在能够执行大规模AI操作的边缘服务器中。通过支持10,000个摄像头,DX-H1可以服务于安装了大量监控摄像头的工厂。H1具有与M1类似的双核ARM核和ISP模块。

所有四种芯片都由三星代工,其中L1和L2采用28nm制程。M1是14nm,H1则使用5nm工艺。价格范围从10美元(L1)、20美元(L2)到50美元(M1)和1500美元(H1)不等。

准确性

除了提供低功耗和性能效率外,DeepX还将资源集中在量化工作上,以保证GPU级的准确性。

基于自身经验,DeepX专注于解决准确性降低的问题上。Kim指出,将原本在浮点格式GPU上训练的AI模型移植到其它硬件上,都会导致准确性降低。

因此,DeepX的团队寻找了每个数据路径中准确性降低的点。结果就是DeepX在其SDK,即DXNN中称之为“世界顶级的量化器”。

396034be-05d8-11ee-962d-dac502259ad0.jpg

市场细分

过去几年中,许多AI硬件创业公司被汽车行业所诱惑,梦想着他们的AI芯片将成为下一代车辆平台的计算机大脑。

相反,Kim得出的结论是,对于一家初创公司来说,向车厂销售AI芯片是一个糟糕的选择。因为汽车芯片需要经过漫长的验证时间,ASIL B和C等认证作业增加了很多困难。即使解决了这些障碍,芯片销量也微乎其微。

相反,Kim的策略是与车厂合作,为DeepX MPU授权IP,包括软件。Kim解释说,DeepX一直被OEM忽视,现在却开始收到OEM要求评估DeepX芯片的请求。

这可能意味着两件事。

首先,许多欧洲车厂向Kim暗示,他们对下一代车辆平台仍未做出决定。

其次,一些领先的车厂已经投入资源使用Nvidia的GPU开发自己的AI模型。但现在,当他们将模型移植到其他硬件上时,准确性降低问题正在出现。这迫使他们重新寻找另一种AI硬件解决方案。

Kim表示,DeepX只会为车厂提供IP授权。对于其他应用领域,其业务模式则是直接销售芯片。

Kim表示,DeepX的AI芯片的最佳应用场景是机器人,无论是配送机器人还是在工厂内作业的机器人。

Nvidia显然已经通过GPU赢得了AI市场。然而,AI竞赛的下一章或许在于如何将在GPU上训练的AI模型有效地移植到非GPU硬件上。





审核编辑:刘清

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 加速器
    +关注

    关注

    2

    文章

    799

    浏览量

    37873
  • SoC设计
    +关注

    关注

    1

    文章

    148

    浏览量

    18774
  • MPU
    MPU
    +关注

    关注

    0

    文章

    359

    浏览量

    48796
  • NPU
    NPU
    +关注

    关注

    2

    文章

    284

    浏览量

    18611
  • ai硬件
    +关注

    关注

    0

    文章

    12

    浏览量

    2400

原文标题:DeepX的AI加速器能够脱颖而出吗?

文章出处:【微信号:Astroys,微信公众号:Astroys】欢迎添加关注!文章转载请注明出处。

收藏 人收藏

    评论

    相关推荐

    从版本控制到全流程支持:揭秘Helix Core如何成为您的创意加速器

    加速器
    龙智DevSecOps
    发布于 :2024年11月26日 13:42:47

    SiFive发布MX系列高性能AI加速器IP

    AI技术日新月异的今天,RISC-V IP设计领域的领军企业SiFive再次引领行业潮流,正式推出了其革命性的SiFive Intelligence XM系列高性能AI加速器IP。这一创新产品专为
    的头像 发表于 09-24 14:46 362次阅读

    NAS设备铁威马F4-424是如何从市场中脱颖而出

    简便又性能卓越的家用NAS,成为了众多家庭面临的难题。今天,我们将聚焦于铁威马F4-424这款NAS设备,探讨它是如何凭借其出色的性能与易用性,在家用NAS市场中脱颖而出,成为家庭用户的理想之选。
    的头像 发表于 07-18 17:28 779次阅读

    运动相机为什么会脱颖而出

      01 运动相机为什么会脱颖而出 与传统相机或手机拍摄相比,运动相机具备防水和耐冲击的特性,适合在户外活动中使用。运动相机通常具有的广角镜头、高分辨率和高帧率的功能,可以拍摄的范围更广,画面也更
    的头像 发表于 06-27 16:01 657次阅读
    运动相机为什么会<b class='flag-5'>脱颖而出</b>

    西门子推出Catapult AI NN软件,赋能神经网络加速器设计

    西门子数字化工业软件近日发布了Catapult AI NN软件,这款软件在神经网络加速器设计领域迈出了重要一步。Catapult AI NN软件专注于在专用集成电路(ASIC)和芯片级系统(SoC)上实现神经网络的高层次综合(H
    的头像 发表于 06-19 11:27 861次阅读

    Visa宣布五家初创企业入选2024年亚太区加速器计划

    北京2024年6月5日 /美通社/ -- 近日,全球领先的数字支付公司 Visa 宣布入选2024年亚太区 Visa 加速器计划(Visa Accelerator Program)的五家新晋初创企业
    的头像 发表于 06-05 14:22 277次阅读

    美国限制向中东AI加速器出口,审查国家安全

    AI加速器能协助数据中心处理大量人工智能聊天机器人和其他工具的开发信息。如今,它们已然成为构建AI基础设施的企业和政府的必需品。
    的头像 发表于 05-31 09:20 589次阅读

    新一代驱动产品,PI SCALE-iFlex™ XLT如何脱颖而出

    即插即用!作为新一代驱动产品,看SCALE-iFlex™ XLT如何以其独特的设计和出色的性能,在市场中脱颖而出! 在电力电子领域,高效、紧凑且安全的门极驱动产品设计一直是研发的焦点。随着储能
    的头像 发表于 05-27 14:55 317次阅读
    新一代驱动<b class='flag-5'>器</b>产品,PI SCALE-iFlex™ XLT如何<b class='flag-5'>脱颖而出</b>?

    深兰AI数字伙伴项目入选“AI Partner·2024 AI应用标杆案例”

    近期,36氪揭晓了“AI Partner·2024 AI应用标杆案例”,深兰AI数字伙伴项目从200多个报名项目中脱颖而出,当选标杆案例。一起入选的还有腾讯、vivo、360、商汤等公
    的头像 发表于 05-23 10:34 446次阅读
    深兰<b class='flag-5'>AI</b>数字伙伴项目入选“<b class='flag-5'>AI</b> Partner·2024 <b class='flag-5'>AI</b>应用标杆案例”

    Arm发布新一代Ethos-U AI加速器 Arm旨在瞄准国产CPU市场

    Arm发布的新一代Ethos-U AI加速器确实在业界引起了广泛关注。
    的头像 发表于 04-18 15:59 761次阅读

    Arm推动生成式AI落地边缘!全新Ethos-U85 AI加速器支持Transformer 架构,性能提升四倍

    电子发烧友网报道(文/黄晶晶)在嵌入式领域,边缘与端侧AI推理需求不断增长,Arm既有Helium 技术使 CPU 能够执行更多计算密集型的 AI 推理算法,也有Ethos 系列 AI
    的头像 发表于 04-16 09:10 4618次阅读
    Arm推动生成式<b class='flag-5'>AI</b>落地边缘!全新Ethos-U85 <b class='flag-5'>AI</b><b class='flag-5'>加速器</b>支持Transformer 架构,性能提升四倍

    解锁AI时代的利器——讯飞AI鼠标AM30助你在AI时代脱颖

    解锁AI时代的利器——讯飞AI鼠标AM30助你在AI时代脱颖而出 随着AI时代的到来,人们对于人工智能的需求越来越迫切。 在这个竞争激烈的时
    的头像 发表于 03-25 13:37 561次阅读
    解锁<b class='flag-5'>AI</b>时代的利器——讯飞<b class='flag-5'>AI</b>鼠标AM30助你在<b class='flag-5'>AI</b>时代<b class='flag-5'>脱颖</b>

    家居智能化,推动AI加速器的发展

    电子发烧友网报道(文/黄山明)AI加速芯片,也称为人工智能加速器AI Accelerator),是一种专为执行机器学习和深度学习任务而设计的ASIC或定制化处理
    的头像 发表于 02-23 00:18 4594次阅读

    回旋加速器原理 回旋加速器的影响因素

    回旋加速器(Cyclotron)是一种用于加速带电粒子的可再生粒子加速器。它的工作原理基于带电粒子在恒定强磁场中的运动。本文将详细介绍回旋加速器的原理以及影响因素。 一、回旋
    的头像 发表于 01-30 10:02 3973次阅读

    回旋加速器中粒子的最大动能与什么有关

    影响。回旋加速器通常由多个环形磁体和电极组成,这些器件产生的磁场和电场可以加速粒子。回旋加速器的尺寸越大,通常其能够加速粒子的能力也越强。由
    的头像 发表于 01-18 10:42 3197次阅读