0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

这次人工智能和机器学习“盯”上了数据中心

如意 来源:今日头条 作者:计算机世界 2020-10-29 14:27 次阅读

关于人工智能的讨论目前主要还集中在自动驾驶汽车、聊天机器人、数字孪生技术、机器人技术以及从大数据集中利用基于AI的“智能”系统获取业务洞察力等方面。目前尽管可以自主运维的数据中心和自动驾驶汽车一样还没有成为现实,但是数据中心人工智能已经在技术、运维和人员等方面取得了许多重大突破。

人工智能(AI)和机器学习(ML)终究有一天将在企业数据中心内发挥重要作用。未来人工智能或许可以帮助企业创建高度自动化的、安全的且具有自我修复功能的数据中心。这些数据中心能够以更高的效率和更高的弹性运行,几乎不再需要进行人工干预。

人工智能提升数据中心效率和扩展业务的潜力主要在以下4个方面:

安全性:公安部在16个城市试点基础上,在全国分两批推广机动车检验标志电子化。

工作负载管理:AI系统可实现工作负载实时地自动向效率最高的基础设施迁移,这些基础设施既可以在数据中心内部,也可以在混合云环境上;既可以在本地,也可以在云端,还可以在边缘环境中。

电源管理:基于AI的电源管理可优化冷却系统,降低电费成本,减少人员数量,提高效率。

设备管理:AI系统可以检查系统是否配置正确,监视服务器、存储和网络设备的健康状况,预测设备的故障时间。

人工智能与安全

安全运营中心(SOC)的安全专业人员常常会被大量的警报搞得精疲力尽。基于AI的系统可以扫描大量遥测数据和日志信息,处理一些简单的工作,从而使得安全专家有时间展开深入的调查。基于AI的系统可以检测、阻止和隔离威胁,并展开溯源以确定到底发生了什么,以及黑客能够利用哪些漏洞。这使得人工智能在实时入侵检测方面极为有用。

迅速进行根本原因分析可以帮助运维人员做出明智的决定并采取行动。人工智能和机器学习可以通过对事件进行快速分类和聚类的方式,识别出重要事件并将其与噪音分离,从而简化事件处理(事件响应)。

除了可以帮助解译那些超出人类能力水平的数据外,AI自动化还可在优化能源使用、工作负载分配和数据中心资产利用效率最大化等方面帮助获取深刻的洞察力。

基于AI的工作负载优化

无论是在本地还是在云端,AI在应用程序层可自动将工作负载移动到适当的位置。例如,将工作负载自动迁移到最节能的服务器上,同时确保服务器以最高效率(利用率为70%~80%)运行。

人工智能系统还可将时间敏感性高的应用程序迁移到高效率服务器上运行,同时确保那些不需要迅速执行的应用程序不会消耗过多的电力。

未来,AI/ML还可根据性能、成本、治理、安全性、风险和可持续性等因素,实时决定将工作负载迁移至何处。

将电源管理与服务器工作负载管理整合在一起

AI带来的好处与出色硬件设计所带来的好处不在一个层次上。电源管理则是最容易进行改进的地方。这关乎生产力,关系到每个BTU是否可以完成更多的工作,关系到每瓦特电能是否能做更多的工作。

这也意味着工作要更加智能化,以及设备是否能够更加智能地工作。如果传感器检测到服务器运行温度过高,那么系统可自动地快速将工作负载转移到未充分利用的服务器上,以避免关键任务应用程序出现中断的危险。同时系统会调查服务器过热的原因,是风扇出现了故障(HVAC问题),还是物理组件出现了故障(设备问题),亦或是服务器出现了过载(工作负荷问题)。

AI系统还可以通过关联HVAC系统数据和环境传感器数据来了解设施目前的状态。例如,基于AI的系统可以帮助数据中心管理员了解当前或潜在的冷却问题。如HVAC单元性能不佳、冷热通道之间的空气量不足,以及由于机柜密度过高阻碍了空气流通导致冷气输送不足等问题。

容量规划也是一个可能改进的地方。除了寻找发热点和冷却点之外,AI系统还能确保数据中心只为适当数量的物理服务器提供电力,如果出现临时性需求激增的情况,系统还可以启动新的物理服务器以提高可用容量。

许多企业之所以正在花大力气研究数据中心电源管理,一方面是为了节省资金,另一方面也是为了承担起企业的环保责任。有数据显示,数据中心消耗了全球3%的电力供应,并造成了约2%的温室气体排放。

谷歌在2018年曾宣布已将其多个超大规模数据中心的冷却系统控制权交给AI程序控制,由AI算法提供的建议使得耗电量下降了40%。

运行状态监控和配置管理监督

安装了大量组件的IT机柜是劳动密集型工作,因此检查工作可能会存在不及时和不彻底情况。运行状态监视可检查设备配置是否正确以及性能是否达到预期效果。

数据中心内还有许多需要定期维护的物理设备。AI系统不仅可以对这些物理设备进行定期维护,还可收集和分析遥测数据,帮助确定需要立即关注的特定区域。以大量传感数据日志为基础的预测性设备故障建模可以发现迫在眉睫的组件或设备故障,并评估是否需要立即维护以避免服务中断。

人工智能系统最终可能会实现“告诉我问题出在哪里,我去解决这些问题”,但是即便实现了这一功能,许多数据中心运营商可能只会接受“如果出了问题,请告诉我要去哪里查看就行了。”

保持设备平稳安全运行的另一个重要环节是控制“配置漂移”。AI可作为“额外的安全检查”,可帮助识别出由于配置导致的数据中心问题。(注:配置漂移为数据中心术语,指临时配置随着时间的变化可能会导致一些问题的发生。)

部署AI所面临的挑战

优化和自动化数据中心是数字化转型计划中不可或缺的一部分。新冠疫情让许多公司开始寻求数据中心的进一步自动化,实现数字数据中心由AI驱动并可自我修复。这使得AI在数据中心中具有广阔的应用前景。一些AI/ML功能可用于事件处理、基础设施运行状况和散热优化。

尽管如此,要想让AI/ML模型超越目前的标准数据中心基础设施管理(DCIM)需要有更多突破,和更多的时间。这与自动驾驶汽车的发展极为类似,早期阶段可能非常具有吸引力,但是与最终承诺的颠覆性经济/商业案例相比仍然相去甚远。

AIOps平台的成熟度、IT技能和运维成熟度均为重大挑战。更高级别的部署面临的挑战还包括数据质量,以及IT基础设施和运维团队缺乏数据科学技能。此外,需要雇用或培训合适的人来管理系统,以及需要数据标准和相关体系结构都是部署AI时所面临的挑战。

但是自始至终最大的挑战还是在于人。各种基础设施的运维人员都在做放权给AI的准备。但是如果人们并不信任做出决定的决策者,那么在如此大规模的过渡期间人员如何培训,如何安抚人员的情绪?在过渡期间,人们普遍会想一个问题,那就是如果自己照做了,自己会失业吗?

对许多企业来说,不仅聘用到资深的数据科学家是一个挑战,就连培训现有员工也困难重重。因为企业员工抵制技术的传统由来已久。以软件定义网络(SDN)为例,SDN已经推出十年了,但是仍有3/4以上的IT运维在使用命令行界面。
责编AJX

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 数据中心
    +关注

    关注

    16

    文章

    4764

    浏览量

    72100
  • 人工智能
    +关注

    关注

    1791

    文章

    47208

    浏览量

    238284
  • 机器学习
    +关注

    关注

    66

    文章

    8408

    浏览量

    132573
收藏 人收藏

    评论

    相关推荐

    嵌入式和人工智能究竟是什么关系?

    人工智能的结合,无疑是科技发展中的一场革命。在人工智能硬件加速中,嵌入式系统以其独特的优势和重要性,发挥着不可或缺的作用。通过深度学习和神经网络等算法,嵌入式系统能够高效地处理大量数据
    发表于 11-14 16:39

    人工智能对数据中心的挑战

    在加密货币和人工智能/机器学习(AI/ML)等新兴应用的驱动下,数据中心的能耗巨大,并将快速增长以满足用户需求。根据国际能源署(IEA)的最新报告,2022 年
    的头像 发表于 11-13 16:05 364次阅读
    <b class='flag-5'>人工智能对数据中心</b>的挑战

    人工智能机器学习和深度学习存在什么区别

    人工智能指的是在某种程度上显示出类似人类智能的设备。AI有很多技术,但其中一个很大的子集是机器学习——让算法从数据
    发表于 10-24 17:22 2480次阅读
    <b class='flag-5'>人工智能</b>、<b class='flag-5'>机器</b><b class='flag-5'>学习</b>和深度<b class='flag-5'>学习</b>存在什么区别

    《AI for Science:人工智能驱动科学创新》第一章人工智能驱动的科学创新学习心得

    人工智能:科学研究的加速器 第一章清晰地阐述了人工智能作为科学研究工具的强大功能。通过机器学习、深度学习等先进技术,AI能够处理和分析海量
    发表于 10-14 09:12

    Molex连接器助力构建未来数据中心 充分发挥人工智能AI的力量

    随着高性能计算,在人工智能(AI)和机器学习(ML)领域中不断演进,各种应用对复杂计算能力、海量存储容量和无缝连接提出了前所未有的需求。电子组件之间实现更快速、更高效的通信,能够促使专门构建的生成式
    的头像 发表于 08-29 11:57 1763次阅读
    Molex连接器助力构建未来<b class='flag-5'>数据中心</b> 充分发挥<b class='flag-5'>人工智能</b>AI的力量

    借助电源完整性测试提高人工智能数据中心的能效

    数据中心正在部署基于人工智能 (AI) 的技术,处理器密集型服务器正在推动能源需求的增长,下表说明了这种发展趋势所带来的巨大影响。国际能源署 (IEA) 预测,到2030年,数据中心的耗电量将占全球耗电量的7%,相当于印度全国的
    的头像 发表于 07-30 09:36 536次阅读
    借助电源完整性测试提高<b class='flag-5'>人工智能</b><b class='flag-5'>数据中心</b>的能效

    FPGA在人工智能中的应用有哪些?

    FPGA(现场可编程门阵列)在人工智能领域的应用非常广泛,主要体现在以下几个方面: 一、深度学习加速 训练和推理过程加速:FPGA可以用来加速深度学习的训练和推理过程。由于其高并行性和低延迟特性
    发表于 07-29 17:05

    人工智能机器学习和深度学习是什么

    在科技日新月异的今天,人工智能(Artificial Intelligence, AI)、机器学习(Machine Learning, ML)和深度学习(Deep Learning,
    的头像 发表于 07-03 18:22 1271次阅读

    人工智能数据中心的新型连接解决方案

    (AI)和机器学习(ML)应用对复杂计算能力、海量存储容量和无缝连接提出了前所未有的要求。电子元件之间高速、高效的通信使人工智能数据中心能够计算庞大的
    的头像 发表于 06-13 08:26 550次阅读
    <b class='flag-5'>人工智能</b><b class='flag-5'>数据中心</b>的新型连接解决方案

    夏普讨论建立人工智能数据中心

    近日,夏普公司宣布与KDDI公司达成重要合作意向,双方将针对建立人工智能数据中心进行深入讨论。据悉,此次合作将围绕英伟达的人工智能计算平台和Supermicro平台展开,共同探索人工智能
    的头像 发表于 06-05 09:17 462次阅读

    5G智能物联网课程之Aidlux下人工智能开发(SC171开发套件V2)

    ://t.elecfans.com/v/27221.html *附件:初学者完整学习流程实现手写数字识别案例_V2-20240506.pdf 人工智能 语音对话机器人案例 26分03秒 https
    发表于 05-10 16:46

    机器学习怎么进入人工智能

    人工智能已成为一个热门领域,涉及到多个行业和领域,例如语音识别、机器翻译、图像识别等。 在编程中进行人工智能的关键是使用机器学习算法,这是
    的头像 发表于 04-04 08:41 301次阅读

    5G智能物联网课程之Aidlux下人工智能开发(SC171开发套件V1)

    *附件:初学者完整学习流程实现手写数字识别案例.pdf 人工智能 语音对话机器人案例 26分03秒 https://t.elecfans.com/v/27185.html *附件:语音对话
    发表于 04-01 10:40

    嵌入式人工智能的就业方向有哪些?

    联网ARM开发 NB-IoT开发及实战 七:python工程师,人工智能工程师 python语法基础 python核心编程 基于OpenCV的机器视觉开发 嵌入式人工智能渗入生活的方方面面,广泛应用
    发表于 02-26 10:17

    KakaoBank 入驻 Digital Realty 的 ICN10 数据中心以推动人工智能创新

    人工智能 (AI) 支持 KakaoBank 的金融技术研究和发展,为消费者提供安全、便捷的移动银行服务 北京2024年2月16日 /美通社/ -- 世界领先的云和运营商中立数据中心、主机托管
    的头像 发表于 02-18 09:33 751次阅读
    KakaoBank 入驻 Digital Realty 的 ICN10 <b class='flag-5'>数据中心</b>以推动<b class='flag-5'>人工智能</b>创新