re:Invent 2024:亚马逊云科技在AI时代“芯”洞未来 原创

8个月前 科技 52观看
摘要 今年,瘦身成功的亚马逊云科技高级副总裁Peter DeSantis,用生成式AI亲手创作了几张re:Invent《周一晚间直播》的配图,来可视化他的演讲。这也为整场活动定下了基调,其实亚马逊云科技在底层创新上

今年,瘦身成功的亚马逊云科技高级副总裁Peter DeSantis,用生成式AI亲手创作了几张re:Invent《周一晚间直播》的配图,来可视化他的演讲。M2V喜好网-记录每日喜好的科技时尚娱乐生活

这也为整场活动定下了基调,其实亚马逊云科技在底层创新上一直有着悠久的历史,从芯片设计到计算架构,再到AI加速,每一步都在推动技术边界的发展。M2V喜好网-记录每日喜好的科技时尚娱乐生活

re:Invent 2024:亚马逊云科技在AI时代“芯”洞未来M2V喜好网-记录每日喜好的科技时尚娱乐生活

亚马逊云科技高级副总裁Peter DeSantisM2V喜好网-记录每日喜好的科技时尚娱乐生活

自研芯片的技术版图M2V喜好网-记录每日喜好的科技时尚娱乐生活

亚马逊云科技已经拥有超过十年“自研芯片”的历程,已推出的四大自研芯片产品组合包括:六代Nitro系统、四代Graviton、两代Trainium和Inferentia。M2V喜好网-记录每日喜好的科技时尚娱乐生活

亚马逊云科技在2018年re:Invent大会上发布了基于ARM架构的第一代Amazon Graviton。此后,Graviton芯片不断针对现实的工作负载进行性能优化:第二代专注于横向扩展性能,第三代聚焦高计算需求的专业工作负载,而第四代则成为专为云计算打造的性能最强芯片。M2V喜好网-记录每日喜好的科技时尚娱乐生活

Peter DeSantis指出,过去两年间,新投产的CPU算力中有超过50%运行在Amazon Graviton上。M2V喜好网-记录每日喜好的科技时尚娱乐生活

与此同时,AWS Nitro System重新定义了服务器架构,从根本上革新了云的构建和保护云的方式。AWS也将AWS Nitro System的安全性拓展到Amazon Graviton4,通过两者的结合,打造出亚马逊云科技迄今为止最安全的计算产品之一。M2V喜好网-记录每日喜好的科技时尚娱乐生活

AI加速器的硬核进化M2V喜好网-记录每日喜好的科技时尚娱乐生活

Trainium加速器不属于传统的CPU或GPU,其采用了脉动阵列架构,是专门针对AI工作负载优化过的硬件架构。M2V喜好网-记录每日喜好的科技时尚娱乐生活

“人工智能工作负载不是横向扩展型的工作负载,而是扩张类型的工作负载。”Peter DeSantis说道。亚马逊云科技采用“扩张”的方式,专注于提高单个系统的容量,而不是采用“横向扩展”的方式,构建多个相同的系统,在多台机器上分配工作负载。M2V喜好网-记录每日喜好的科技时尚娱乐生活

在传统CPU和GPU中,每个计算步骤通常需要从内存读取数据、执行计算后,再将结果写回内存。这种频繁的内存操作会导致性能瓶颈,尤其是在需要大量带宽的AI任务中。M2V喜好网-记录每日喜好的科技时尚娱乐生活

脉动阵列设计目的是高效处理大规模的矩阵或张量运算,脉动阵列通过将计算结果直接从一个处理单元传递到下一个处理单元,减少了对内存的访问需求,从而降低了内存带宽的压力。M2V喜好网-记录每日喜好的科技时尚娱乐生活

re:Invent 2024:亚马逊云科技在AI时代“芯”洞未来M2V喜好网-记录每日喜好的科技时尚娱乐生活

Trainium2 Server也得益于此,其是目前亚马逊云科技最强大的机器学习服务器,其扩张的速度也超过了曾经所有的服务器。现场还第一次展示了AWS Trainium2 UltraServer,其设置2个机架、4个服务器和64个Trainium加速器,以超高速的NeuronLink连接在一起。AWS Trainium2 UltraServer提供相比当前EC2 AI服务器多达5倍的计算容量和10倍的内存,算力峰值扩展到83.2PFLOPS。M2V喜好网-记录每日喜好的科技时尚娱乐生活

re:Invent 2024:亚马逊云科技在AI时代“芯”洞未来M2V喜好网-记录每日喜好的科技时尚娱乐生活

同时推出全新Trainium3,其采用3nm制程的芯片,与上代Trainium2相比,计算能力增加2倍,能源效率提升40%。Trainium3专为满足下一代生成式AI工作负载的高性能需求而设计,有助客户更快地建立更大的模型,由Trainium3驱动的UltraServers预计将比 AWS Trainium2 UltraServer的效能高出四倍。M2V喜好网-记录每日喜好的科技时尚娱乐生活

亚马逊云科技同时也注意到推理性能优化的关键性需求,宣布了Latency-optimized inference option for Amazon Bedrock,使各种模型可以获得最佳的推理性能。借助这一优化,Claude 3.5 Haiku在亚马逊云科技上的运行速度比其他平台快了60%。M2V喜好网-记录每日喜好的科技时尚娱乐生活

AI生态的未来棋局M2V喜好网-记录每日喜好的科技时尚娱乐生活

Anthropic 从成立那天起,就靠着前沿的 AI 技术圈足了眼球。11 月 23 日,亚马逊再度追加40亿美元投资,使总投资推高到80亿。这可不只是砸钱,而是在下一盘关于AI未来的大棋。M2V喜好网-记录每日喜好的科技时尚娱乐生活

Anthropic快速发展的背后,离不开亚马逊云科技的强大技术支撑。其Amazon Trainium和 Amazon Inferentia芯片,不仅显著提升了Claude模型的训练和推理性能,还显著降低了成本。11月4日,Claude 3.5 Haiku也在Amazon Bedrock中正式可用。M2V喜好网-记录每日喜好的科技时尚娱乐生活

Anthropic还在《周一晚间直播》中宣布了Project Rainier项目,计划在数百个Amazon Trainium 集群上进行训练,构建出更快的、更可扩展的AI,以支持Anthropic的未来模型开发。M2V喜好网-记录每日喜好的科技时尚娱乐生活

亚马逊云科技还有很多底层基础架构的创新,从性能提升到成本降低,每一项突破都在重新定义AI的技术边界。M2V喜好网-记录每日喜好的科技时尚娱乐生活

展开全文
猜你感兴趣
映泰推出 MT-N97 工业计算机:无风扇设计,配英特尔 N97 处理器

映泰推出 MT-N97 工业计算机:无风

11 月

11-19 104阅读
‌上汽奥迪首款B级车型将明年年中发布‌

‌上汽奥迪首款B级车型将明年年

11-19 121阅读
炒过Labubu,再也忘不掉日入2万的滋味

炒过Labubu,再也忘不掉日入2万的

“家

11-19 127阅读
这个东北小镇,拿捏年轻人的第一件貂

这个东北小镇,拿捏年轻人的第一件

你会

11-19 130阅读
打工人,靠新中式按摩“续命”

打工人,靠新中式按摩“续命”

26岁

11-19 116阅读
《芝麻胡同》郭秉惠人设崩了?她竟嫌弃起杏儿的出身

《芝麻胡同》郭秉惠人设崩

《芝麻胡同》中郭秉惠前期是一个

11-19 101阅读
电视剧《三大队》今日开播,秦昊演刑警队长程兵

电视剧《三大队》今日开播

由张译领衔主演,王骁、曹炳琨、魏

11-19 126阅读
吐槽黄焖鸡不要点的博主被禁言:自称不是骑手 作品都是段子

吐槽黄焖鸡不要点的博主被

11月19日消息,据

11-19 115阅读
73岁张纪中为四胎女儿办满月宴 晒全家福庆祝

73岁张纪中为四胎女儿办满

11月18日导演张

11-19 108阅读
马斯克赌大赢大 部分广告商准备重返推特

马斯克赌大赢大 部分广告

多位媒体高管透

11-19 108阅读
《维纳斯璀璨假期 死或生XTREME》公开实机游玩

《维纳斯璀璨假期 死或生X

台湾光荣特库摩宣布,家机新作沉浸式恋爱

11-19 134阅读
《Amerzone:探险家的记忆传承》跳票至明年第二季度

《Amerzone:探险家的记忆传

Microids已将重制版游戏《Amerzone:探

11-19 137阅读
杀手6第一章变色龙挑战攻略巴黎挑战变色龙教程

杀手6第一章变色龙挑战攻

杀手6是Hitman系列的最新作,这是一款优

11-19 102阅读
ePSXe模拟器安卓版怎么导入游戏?ePSXe模拟器安卓版导入游戏教程

ePSXe模拟器安卓版怎么导

ePSXe模拟器安卓版是一款非常棒的可以

11-19 173阅读
饥荒龙心怎么获得?饥荒快速获得龙心的技巧分享

饥荒龙心怎么获得?饥荒快

龙心是饥荒游戏里面的重要材料,可以从龙

11-19 109阅读