0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

如何解决GPU短缺和成本飙升问题?

sakobpqhz ? 来源:算力基建 ? 2023-09-14 11:32 ? 次阅读
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

9月14-15日,2023全球AI芯片峰会将在深圳湾万丽酒店举行。清华大学教授、中国半导体行业协会副理事长魏少军领衔50+位演讲嘉宾,NVIDIA高通英特尔AMD齐聚,近30家中国AI芯片与算力企业登台交锋,4家Chiplet创业创新团队亮相,6位分析师和投资人带来报告分享。峰会最终议程已公布,欢迎大家报名,线下参会交流。

由 GPT-4 等大型语言模型 (LLM) 支持的生成式人工智能科技界引起了巨大震动。ChatGPT 的迅速崛起引发了全球科技行业对人工智能的重新评估和优先考虑,实时重塑了产品战略。

LLM 的整合为产品开发人员提供了一种简便的方法,将人工智能驱动的功能融入到他们的产品中。但并非一帆风顺。产品领导者面临着一个巨大的挑战:GPU 短缺和成本飙升。

01.LLMs的兴起和GPU短缺

越来越多的人工智能初创公司和服务导致对 A100 和 H100 等高端 GPU 的高需求,从而压垮了 Nvidia 及其制造合作伙伴台积电,两者都在努力满足供应。Reddit 等在线论坛上充斥着对 GPU 可用性的不满,这呼应了整个技术社区的情绪。情况变得如此可怕,AWS 和 Azure 都别无选择,只能实施配额系统。

这个瓶颈不仅挤压了初创企业,也挤压了初创企业的发展。对于 OpenAI 这样的科技巨头来说,这是一个绊脚石。最近在伦敦举行的一次非正式会议上,OpenAI 首席执行官 Sam Altman坦诚承认,计算机芯片短缺正在阻碍 ChatGPT 的进步。据报道,Altman 感叹计算能力的缺乏导致 API 可用性低于标准,并阻碍 OpenAI 为 ChatGPT 推出更大的“上下文窗口”。

推荐一场会议。2023全球AI芯片峰会将于9月14-15日在深圳湾万丽酒店举行,NVIDIA 解决方案与架构技术总监张瑞华首次参会,将围绕《生成式 AI 与大语言模型时代的 NVIDIA GPU 生态》这一主题带来演讲。欢迎大家报名参会~

02.优先考虑AI功能

一方面,产品领导者发现自己陷入了不懈的创新之中,面临着利用新一代人工智能的力量提供尖端功能的期望。另一方面,他们还要应对 GPU 容量限制的严峻现实。这是一个复杂的杂耍行为,无情的优先顺序不仅成为战略决策,而且成为必要。 鉴于 GPU 可用性在可预见的未来仍将是一个挑战,产品领导者必须战略性地考虑 GPU 分配。传统上,产品领导者依赖于优先级划分技术,例如客户价值/需求与努力矩阵。无论这种方法在计算资源丰富的世界中多么合乎逻辑,现在都需要进行一些重新评估。 在我们当前的范式中,计算是限制因素,而不是软件人才,产品领导者必须重新定义如何确定各种产品或功能的优先级,将 GPU 的限制带到战略决策的最前沿。 对于科技行业来说,围绕容量限制进行规划似乎不寻常,但在其他行业却是一种常见策略。基本概念很简单:最有价值的因素是在受限资源上花费的时间,目标是优化在该约束上花费的每单位时间的价值。

03.技术成功指标

作为一名前顾问,我已成功地将这个框架应用于各个行业。我相信,在 GPU 限制存在的情况下,科技产品领导者也可以使用类似的方法来确定产品或功能的优先级。应用此框架时,最直接的价值衡量标准是盈利能力。 然而,在科技领域,盈利能力可能并不总是合适的衡量标准,特别是在涉足新市场或新产品时。因此,我调整了该框架,以与技术中普遍使用的成功指标保持一致,概述了一个简单的四个步骤过程:

1.贡献 首先也是最重要的,确定你的北极星指标。这是每个产品或功能的贡献,概括了其价值的本质。一些具体的例子可能包括:

收入和利润增加

市场份额的增长

日/月活跃用户数增长

2. 所需GPU数量 衡量每个产品或功能所需的 GPU 数量。重点关注关键因素,包括:

每个用户每天的查询数

日活跃用户数

查询的复杂性(每个查询消耗多少令牌)

3.计算每个GPU的贡献

把它分解到具体细节。每个 GPU 对总体目标有何贡献?了解这一点将使您清楚地了解 GPU 的最佳分配位置。 根据每个 GPU 的贡献确定产品的优先级 现在,是时候做出艰难的决定了。根据每个 GPU 的贡献对您的产品进行排名,然后进行相应的排列。首先关注每 GPU 贡献最高的产品,确保将有限的资源投入到能够产生最大影响的领域。 由于GPU 限制不再是盲点,而是决策过程中的可量化因素,您的公司可以更有策略地应对 GPU 短缺问题。为了使这个框架变得生动起来,让我们想象一个场景,在这个场景中,作为产品领导者,您正在努力应对在四种不同产品之间确定优先级的挑战:

b244f470-4f8c-11ee-a25d-92fbcf53809c.png

尽管产品 A 具有最高的收入潜力,但它并没有为每个 GPU 带来最高的贡献。令人惊讶的是,产品 D 的收入潜力最小,但每个 GPU 的回报却最高。通过根据此指标确定优先级,您可以最大化总潜在收入。 假设您总共有 1,000 个 GPU 可供使用。一个简单的选择可能会让您选择产品 A,从而产生 1 亿美元的潜在收入。但是,通过应用上述优先级策略,您可以获得 1.55 亿美元的收入:

b2775e92-4f8c-11ee-a25d-92fbcf53809c.png

同样的方法可以应用于其他贡献指标,例如市场份额增益:

b2a03420-4f8c-11ee-a25d-92fbcf53809c.png

同样,选择产品 A 会导致市场份额增加 5%。然而,应用上述优先级策略,您可以获得 7.75% 的市场份额增益:

b2bff120-4f8c-11ee-a25d-92fbcf53809c.png

04.优点和限制

这种替代的优先级框架引入了一种更加细致和更具战略性的方法。通过专注于每个 GPU 的贡献,您可以战略性地调整资源,使其能够发挥最大的作用,无论是在收入、市场份额还是任何其他定义指标方面。 但优点还不止于此。这种方法还可以增强产品团队的清晰度和客观性。根据我的经验,包括我早期在一家医疗保健公司领导数字化转型以及后来与麦肯锡的各种客户合作时,这种方法在容量限制是关键因素的情况下改变了游戏规则。它使我们能够以更加数据驱动和理性的方式确定计划的优先顺序,从而将传统政治边缘化,否则决策可能会落在房间里最响亮的声音的手中。 然而,不存在一刀切的解决方案,并且值得承认这种方法的潜在局限性。例如,这种方法可能并不总是体现某些投资的战略重要性。因此,虽然可以而且应该对框架做出例外,但应该仔细考虑例外情况,而不是规范。这样可以保持流程的完整性,并确保任何偏差都是在考虑到更广泛的战略背景的情况下做出的。

05.结论

产品领导者面临着前所未有的GPU 短缺局面,因此需要寻找新的资源管理方法。用伟大的军事家孙子的话来说,“混乱之中也蕴藏着机遇”。 GPU 短缺确实是一个挑战,但如果采取正确的方法,它也可能成为差异化和成功的催化剂。所提出的优先级框架侧重于每个 GPU 的贡献,提供了一种确定优先级的战略方法。通过专注于每个 GPU 的贡献,公司可以最大限度地提高投资回报,将资源调整到能够产生最大影响的地方,并专注于对公司长期成功最重要的事情。

编辑:黄飞

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • NVIDIA
    +关注

    关注

    14

    文章

    5348

    浏览量

    106850
  • gpu
    gpu
    +关注

    关注

    28

    文章

    4980

    浏览量

    132105
  • 人工智能
    +关注

    关注

    1810

    文章

    49221

    浏览量

    251559
  • AI芯片
    +关注

    关注

    17

    文章

    1994

    浏览量

    36057
  • ChatGPT
    +关注

    关注

    29

    文章

    1591

    浏览量

    9250

原文标题:GPU短缺和成本问题,如何破?

文章出处:【微信号:算力基建,微信公众号:算力基建】欢迎添加关注!文章转载请注明出处。

收藏 人收藏
加入交流群
微信小助手二维码

扫码添加小助手

加入工程师交流群

    评论

    相关推荐
    热点推荐

    aicube的n卡gpu索引该如何添加?

    请问有人知道aicube怎样才能读取n卡的gpu索引呢,我已经安装了cuda和cudnn,在全局的py里添加了torch,能够调用gpu,当还是只能看到默认的gpu0,显示不了gpu1
    发表于 07-25 08:18

    中国为何同时面临算力过剩与短缺

    中国为何同时面临算力过剩与短缺
    的头像 发表于 04-24 15:02 ?635次阅读
    中国为何同时面临算力过剩与<b class='flag-5'>短缺</b> ?

    SMT加工成本飙升:原材料短缺与价格上涨的双重夹击

    小批量PCBA快速打样厂家今天为大家讲讲SMT加工成本上涨的原因有哪些?SMT加工成本上涨的三大原因。近年来,电子行业的飞速发展推动了PCBA(Printed Circuit Board
    的头像 发表于 04-17 09:17 ?349次阅读

    可以手动构建imx-gpu-viv吗?

    使用 imx-gpu-viv-6.4.3.p4.2.aarch64.bin。 https://www.nxp.com/lgfiles/NMG/MAD/YOCTO//imx-gpu-viv-6.4.3.p4.2-aarch64.bin 我需要
    发表于 03-28 06:35

    无法在GPU上运行ONNX模型的Benchmark_app怎么解决?

    在 CPU 和 GPU 上运行OpenVINO? 2023.0 Benchmark_app推断的 ONNX 模型。 在 CPU 上推理成功,但在 GPU 上失败。
    发表于 03-06 08:02

    OpenVINO?检测到GPU,但网络无法加载到GPU插件,为什么?

    OpenVINO?安装在旧的 Windows 10 版本 Windows? 10 (RS1) 上。 已安装 GPU 驱动程序版本 25.20.100.6373,检测到 GPU,但网络无法加载
    发表于 03-05 06:01

    《CST Studio Suite 2024 GPU加速计算指南》

    GPU Computing Guide》是由Dassault Systèmes Deutschland GmbH发布的有关CST Studio Suite 2024的GPU计算指南。涵盖GPU计算
    发表于 12-16 14:25

    如何构建及优化GPU云网络

    并从计算节点成本优化、集群网络与拓扑的选择等方面论述如何构建及优化GPU云网络。
    的头像 发表于 11-06 16:03 ?1157次阅读
    如何构建及优化<b class='flag-5'>GPU</b>云网络

    【「算力芯片 | 高性能 CPU/GPU/NPU 微架构分析」阅读体验】--了解算力芯片GPU

    本篇阅读学习第七、八章,了解GPU架构演进及CPGPU存储体系与线程管理 █从图形到计算的GPU架构演进 GPU图像计算发展 ●从三角形开始的几何阶段 在现代图形渲染中,三角形是最常用的基本图形元素
    发表于 11-03 12:55

    【一文看懂】大白话解释“GPUGPU算力”

    随着大模型的兴起,“GPU算力”这个词正频繁出现在人工智能、游戏、图形设计等工作场景中,什么是GPU,它与CPU的区别是什么?以及到底什么是GPU算力?本篇文章主要从以下5个角度,让您全方位了解
    的头像 发表于 10-29 08:05 ?3023次阅读
    【一文看懂】大白话解释“<b class='flag-5'>GPU</b>与<b class='flag-5'>GPU</b>算力”

    常见GPU问题及解决方法

    GPU(图形处理单元)是计算机硬件的重要组成部分,负责处理图形和视频渲染任务。随着技术的发展,GPU在深度学习、游戏、视频编辑等领域扮演着越来越重要的角色。然而,在使用GPU的过程中,我们可能会遇到
    的头像 发表于 10-27 14:12 ?4055次阅读

    如何选择适合的GPU

    在现代计算领域,GPU(图形处理单元)的作用已经远远超出了传统的图形渲染。从深度学习到科学计算,再到视频编辑,GPU都在发挥着越来越重要的作用。然而,市场上的GPU型号繁多,性能和价格也各不相同
    的头像 发表于 10-27 11:07 ?1106次阅读

    GPU算力租用平台怎么样

    GPU算力租用平台以其成本效益、灵活性与可扩展性、简化运维以及即时访问等优势,在深度学习、科学计算、图形渲染等多个领域发挥着重要作用。
    的头像 发表于 10-17 10:03 ?592次阅读

    何解决工字电感噪音大的问题

    电子发烧友网站提供《如何解决工字电感噪音大的问题.docx》资料免费下载
    发表于 09-04 11:46 ?0次下载

    何解决电感的漏感问题

    电子发烧友网站提供《如何解决电感的漏感问题.docx》资料免费下载
    发表于 09-02 14:48 ?0次下载