0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

如何解决GPU短缺和成本飙升问题?

sakobpqhz 来源:算力基建 2023-09-14 11:32 次阅读

9月14-15日,2023全球AI芯片峰会将在深圳湾万丽酒店举行。清华大学教授、中国半导体行业协会副理事长魏少军领衔50+位演讲嘉宾,NVIDIA高通英特尔AMD齐聚,近30家中国AI芯片与算力企业登台交锋,4家Chiplet创业创新团队亮相,6位分析师和投资人带来报告分享。峰会最终议程已公布,欢迎大家报名,线下参会交流。

由 GPT-4 等大型语言模型 (LLM) 支持的生成式人工智能科技界引起了巨大震动。ChatGPT 的迅速崛起引发了全球科技行业对人工智能的重新评估和优先考虑,实时重塑了产品战略。

LLM 的整合为产品开发人员提供了一种简便的方法,将人工智能驱动的功能融入到他们的产品中。但并非一帆风顺。产品领导者面临着一个巨大的挑战:GPU 短缺和成本飙升。

01.LLMs的兴起和GPU短缺

越来越多的人工智能初创公司和服务导致对 A100 和 H100 等高端 GPU 的高需求,从而压垮了 Nvidia 及其制造合作伙伴台积电,两者都在努力满足供应。Reddit 等在线论坛上充斥着对 GPU 可用性的不满,这呼应了整个技术社区的情绪。情况变得如此可怕,AWS 和 Azure 都别无选择,只能实施配额系统。

这个瓶颈不仅挤压了初创企业,也挤压了初创企业的发展。对于 OpenAI 这样的科技巨头来说,这是一个绊脚石。最近在伦敦举行的一次非正式会议上,OpenAI 首席执行官 Sam Altman坦诚承认,计算机芯片短缺正在阻碍 ChatGPT 的进步。据报道,Altman 感叹计算能力的缺乏导致 API 可用性低于标准,并阻碍 OpenAI 为 ChatGPT 推出更大的“上下文窗口”。

推荐一场会议。2023全球AI芯片峰会将于9月14-15日在深圳湾万丽酒店举行,NVIDIA 解决方案与架构技术总监张瑞华首次参会,将围绕《生成式 AI 与大语言模型时代的 NVIDIA GPU 生态》这一主题带来演讲。欢迎大家报名参会~

02.优先考虑AI功能

一方面,产品领导者发现自己陷入了不懈的创新之中,面临着利用新一代人工智能的力量提供尖端功能的期望。另一方面,他们还要应对 GPU 容量限制的严峻现实。这是一个复杂的杂耍行为,无情的优先顺序不仅成为战略决策,而且成为必要。 鉴于 GPU 可用性在可预见的未来仍将是一个挑战,产品领导者必须战略性地考虑 GPU 分配。传统上,产品领导者依赖于优先级划分技术,例如客户价值/需求与努力矩阵。无论这种方法在计算资源丰富的世界中多么合乎逻辑,现在都需要进行一些重新评估。 在我们当前的范式中,计算是限制因素,而不是软件人才,产品领导者必须重新定义如何确定各种产品或功能的优先级,将 GPU 的限制带到战略决策的最前沿。 对于科技行业来说,围绕容量限制进行规划似乎不寻常,但在其他行业却是一种常见策略。基本概念很简单:最有价值的因素是在受限资源上花费的时间,目标是优化在该约束上花费的每单位时间的价值。

03.技术成功指标

作为一名前顾问,我已成功地将这个框架应用于各个行业。我相信,在 GPU 限制存在的情况下,科技产品领导者也可以使用类似的方法来确定产品或功能的优先级。应用此框架时,最直接的价值衡量标准是盈利能力。 然而,在科技领域,盈利能力可能并不总是合适的衡量标准,特别是在涉足新市场或新产品时。因此,我调整了该框架,以与技术中普遍使用的成功指标保持一致,概述了一个简单的四个步骤过程:

1.贡献 首先也是最重要的,确定你的北极星指标。这是每个产品或功能的贡献,概括了其价值的本质。一些具体的例子可能包括:

收入和利润增加

市场份额的增长

日/月活跃用户数增长

2. 所需GPU数量 衡量每个产品或功能所需的 GPU 数量。重点关注关键因素,包括:

每个用户每天的查询数

日活跃用户数

查询的复杂性(每个查询消耗多少令牌)

3.计算每个GPU的贡献

把它分解到具体细节。每个 GPU 对总体目标有何贡献?了解这一点将使您清楚地了解 GPU 的最佳分配位置。 根据每个 GPU 的贡献确定产品的优先级 现在,是时候做出艰难的决定了。根据每个 GPU 的贡献对您的产品进行排名,然后进行相应的排列。首先关注每 GPU 贡献最高的产品,确保将有限的资源投入到能够产生最大影响的领域。 由于GPU 限制不再是盲点,而是决策过程中的可量化因素,您的公司可以更有策略地应对 GPU 短缺问题。为了使这个框架变得生动起来,让我们想象一个场景,在这个场景中,作为产品领导者,您正在努力应对在四种不同产品之间确定优先级的挑战:

b244f470-4f8c-11ee-a25d-92fbcf53809c.png

尽管产品 A 具有最高的收入潜力,但它并没有为每个 GPU 带来最高的贡献。令人惊讶的是,产品 D 的收入潜力最小,但每个 GPU 的回报却最高。通过根据此指标确定优先级,您可以最大化总潜在收入。 假设您总共有 1,000 个 GPU 可供使用。一个简单的选择可能会让您选择产品 A,从而产生 1 亿美元的潜在收入。但是,通过应用上述优先级策略,您可以获得 1.55 亿美元的收入:

b2775e92-4f8c-11ee-a25d-92fbcf53809c.png

同样的方法可以应用于其他贡献指标,例如市场份额增益:

b2a03420-4f8c-11ee-a25d-92fbcf53809c.png

同样,选择产品 A 会导致市场份额增加 5%。然而,应用上述优先级策略,您可以获得 7.75% 的市场份额增益:

b2bff120-4f8c-11ee-a25d-92fbcf53809c.png

04.优点和限制

这种替代的优先级框架引入了一种更加细致和更具战略性的方法。通过专注于每个 GPU 的贡献,您可以战略性地调整资源,使其能够发挥最大的作用,无论是在收入、市场份额还是任何其他定义指标方面。 但优点还不止于此。这种方法还可以增强产品团队的清晰度和客观性。根据我的经验,包括我早期在一家医疗保健公司领导数字化转型以及后来与麦肯锡的各种客户合作时,这种方法在容量限制是关键因素的情况下改变了游戏规则。它使我们能够以更加数据驱动和理性的方式确定计划的优先顺序,从而将传统政治边缘化,否则决策可能会落在房间里最响亮的声音的手中。 然而,不存在一刀切的解决方案,并且值得承认这种方法的潜在局限性。例如,这种方法可能并不总是体现某些投资的战略重要性。因此,虽然可以而且应该对框架做出例外,但应该仔细考虑例外情况,而不是规范。这样可以保持流程的完整性,并确保任何偏差都是在考虑到更广泛的战略背景的情况下做出的。

05.结论

产品领导者面临着前所未有的GPU 短缺局面,因此需要寻找新的资源管理方法。用伟大的军事家孙子的话来说,“混乱之中也蕴藏着机遇”。 GPU 短缺确实是一个挑战,但如果采取正确的方法,它也可能成为差异化和成功的催化剂。所提出的优先级框架侧重于每个 GPU 的贡献,提供了一种确定优先级的战略方法。通过专注于每个 GPU 的贡献,公司可以最大限度地提高投资回报,将资源调整到能够产生最大影响的地方,并专注于对公司长期成功最重要的事情。

编辑:黄飞

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • NVIDIA
    +关注

    关注

    14

    文章

    4838

    浏览量

    102683
  • gpu
    gpu
    +关注

    关注

    28

    文章

    4661

    浏览量

    128526
  • 人工智能
    +关注

    关注

    1789

    文章

    46544

    浏览量

    236819
  • AI芯片
    +关注

    关注

    17

    文章

    1849

    浏览量

    34819
  • ChatGPT
    +关注

    关注

    29

    文章

    1540

    浏览量

    7315

原文标题:GPU短缺和成本问题,如何破?

文章出处:【微信号:算力基建,微信公众号:算力基建】欢迎添加关注!文章转载请注明出处。

收藏 人收藏

    评论

    相关推荐

    【一文看懂】大白话解释“GPUGPU算力”

    随着大模型的兴起,“GPU算力”这个词正频繁出现在人工智能、游戏、图形设计等工作场景中,什么是GPU,它与CPU的区别是什么?以及到底什么是GPU算力?本篇文章主要从以下5个角度,让您全方位了解
    的头像 发表于 10-29 08:05 80次阅读
    【一文看懂】大白话解释“<b class='flag-5'>GPU</b>与<b class='flag-5'>GPU</b>算力”

    常见GPU问题及解决方法

    GPU(图形处理单元)是计算机硬件的重要组成部分,负责处理图形和视频渲染任务。随着技术的发展,GPU在深度学习、游戏、视频编辑等领域扮演着越来越重要的角色。然而,在使用GPU的过程中,我们可能会遇到
    的头像 发表于 10-27 14:12 265次阅读

    何解决工字电感噪音大的问题

    电子发烧友网站提供《如何解决工字电感噪音大的问题.docx》资料免费下载
    发表于 09-04 11:46 0次下载

    何解决电感的漏感问题

    电子发烧友网站提供《如何解决电感的漏感问题.docx》资料免费下载
    发表于 09-02 14:48 0次下载

    暴涨预警!NVIDIA GPU供应大跳水

    gpu
    jf_02331860
    发布于 :2024年07月26日 09:41:42

    Anthropic AI模型训练成本飙升,预计未来将达百亿级

    在人工智能领域的激烈竞争中,Anthropic公司以其高昂的研发投入引发了广泛关注。据公司CEO达里奥·阿莫代透露,当前正在开发的AI模型训练成本飙升至惊人的10亿美元,这一数字不仅彰显了Anthropic在技术创新上的不遗余力,也预示着AI研发
    的头像 发表于 07-09 15:38 384次阅读

    英伟达数据中心GPU出货量飙升,市场份额持续领跑

    在全球半导体和计算技术不断革新的浪潮中,英伟达(NVIDIA)再次凭借其卓越的技术实力和市场洞察力,在数据中心GPU领域取得了令人瞩目的成绩。根据半导体分析公司TechInsights的最新报告
    的头像 发表于 06-13 17:08 746次阅读

    FPGA在深度学习应用中或将取代GPU

    它们在高温下运行时需要及时冷却,而这并不总是可以实现的。要做到这点需要更多的电力、维护成本等。” 使用寿命也是一个问题。一般来说,GPU 的使用 寿命约为 2-5 年,这对那些每隔几年就换一次电脑
    发表于 03-21 15:19

    GPU理想成本揭秘,性价比之选

    如果新的 GPU 能够为频繁和不频繁升级的玩家提供最佳性能提升,从而满足最广泛的 PC 游戏玩家的需求,那么这一代将被认为更加成功。
    发表于 03-15 11:15 554次阅读
    <b class='flag-5'>GPU</b>理想<b class='flag-5'>成本</b>揭秘,性价比之选

    煤气柜泄漏问题如何解

    电子发烧友网站提供《煤气柜泄漏问题如何解决.docx》资料免费下载
    发表于 03-05 17:49 0次下载

    何解决键槽滚键磨损问题

    电子发烧友网站提供《如何解决键槽滚键磨损问题.docx》资料免费下载
    发表于 02-04 14:24 0次下载

    2024年,GPU还会维持天价吗?

    云厂商作为AI算力需求的主要承载方,一场由GPU主导的变革正在悄然兴起,这场变革的突出表现在云厂商纷纷下场造芯,结合GPU短缺、高昂成本、应对云服务更加智能化、自主化、灵活化和可扩展
    的头像 发表于 01-14 11:28 1243次阅读
    2024年,<b class='flag-5'>GPU</b>还会维持天价吗?

    揭秘GPU: 高端GPU架构设计的挑战

    在计算领域,GPU(图形处理单元)一直是性能飞跃的代表。众所周知,高端GPU的设计充满了挑战。GPU的架构创新,为软件承接大模型训练和推理场景的人工智能计算提供了持续提升的硬件基础。GPU
    的头像 发表于 12-21 08:28 817次阅读
    揭秘<b class='flag-5'>GPU</b>: 高端<b class='flag-5'>GPU</b>架构设计的挑战

    什么是虚拟GPU?虚拟GPU的优势有哪些?

    虚拟 GPU,也称为 vGPU,是通过将数据中心 GPU 进行虚拟化,用户可在多个虚拟机中共享该 GPU
    的头像 发表于 11-10 09:48 1728次阅读
    什么是虚拟<b class='flag-5'>GPU</b>?虚拟<b class='flag-5'>GPU</b>的优势有哪些?

    #GPU显卡 #中国制造  中国GPU面临至暗时刻吗?

    半导体元器件gpu
    深圳市浮思特科技有限公司
    发布于 :2023年11月07日 14:43:15