网界
网络资讯 网界财经 科技人物 数据洞察 行业动态 智能出行 智能手机 数码极客 商业资讯

阿里云斩获SIGCOMM首篇AI智算网络架构论文,HPN7.0有望成为新范式

2024-05-13来源:互联网编辑:芳华

5月13日记者获悉,网络通信领域国际顶会SIGCOMM2024确定了收录论文名单,中国企业表现亮眼,阿里云6篇论文入选,其中,介绍阿里云最新一代的智算集群网络架构HPN 7.0的成果论文,成为SIGCOMM历史上在AI智算集群网络架构领域的首篇论文。据了解,SIGCOMM2024将于8月在悉尼线下召开会议。

大模型的火热对AI基础设施提出了更高要求,HPN7.0架构即面向AI时代对网络高性能需求而研发。据介绍,HPN 7.0针对大模型训练场景下规模大、大流多、突发强烈、稳定性需求高的特点,创新性地设计了“双上联+多轨+双平面”的网络架构,并配合最新一代的51.2Tbps单芯片以太网交换机和400G 高性能网卡,自研Solar-RDMA和ACCL通信库,实现了单层千卡、两层万卡的高性能和高稳定互联。

(HPN7.0架构:为AI设计的高性能网络集群)

从2023年9 月开始,HPN7.0在阿里云展开大规模部署,大模型训练性能较上一代架构在典型场景下提升14.9%,且大幅提高了智算网络整体稳定性。前不久阿里云发布通义千问2.5版本大模型,就是基于HPN7.0高性能网络架构训练。通义千问2.5版本较2.1版本在理解能力、逻辑推理、指令遵循、代码能力上分别提升9%、16%、19%、10%,中文性能全面赶超GPT-4Turbo。

阿里云基础设施网络负责人蔡德忠介绍称:“阿里云从2017年开始探索端网融合的可预期网络,HPN7.0更进一步,把端网融合的体系结构从网络协议栈拓展到网络架构和通信库,实现了面向AI智算时代的全新网络集群架构创新。”

网络架构是网络技术及系统的基石,重大创新如连城之璧般稀少。据了解,SIGCOMM此前关于传统数据中心网络的架构领域文章还是Google提出的Jupiter网络,现已成为业界经典网络架构范式。有专家指出,此次由阿里云提出的新一代网络架构HPN7.0,有望成为下一代AI高性能网络架构的新范式。

在SIGCOMM近50年的发展历程中,来自中国大陆的论文仅50余篇,其中阿里累计入选25篇,是国内被收录数量最多的科技公司。据了解,阿里云在高性能网络领域已深耕多年,提出了端网融合的可预期网络技术体系,并在业界率先实践完成RDMA低延时网络、智算集群网络架构HPN 7.0等先进网络技术的大规模实践。阿里巴巴还曾获评权威机构AMiner全球十大最具影响力的网络研究机构。

(完)

赛彼思获阿里飞猪数千万战略投资 深耕AI直播赋能电商文旅行业
赛彼思公司自2024年2月成立以来,已为电商、文旅等多个行业客户提供定制化AI直播解决方案,助力企业提升直播效率与用户体验。 据悉,赛彼思已与多家知名电商平台、文旅企业建立合作关系,未来将围绕"AI+直播"…

2025-10-23

微信AI机器人客户管理系统:黑名单功能如何设置?管理策略有哪些?
黑名单功能允许企业将某些客户标记为不希望继续互动的对象,这在处理恶意骚扰、低质量互动或不符合企业服务标准的客户时非常有用。 在实际应用中,黑名单功能可以与ChatWave的其他功能相结合,如自动回复、客户分类…

2025-10-22

企业级AI大模型落地全解析:现状挑战、架构方法与未来趋势
现状方面,2025年国内AI市场规模预计超7000亿元,备案大模型超500个,覆盖通用与垂直领域,政务、金融、制造等行业渗透率较高,部署模式分私有化、混合云、公有云API,其中金融、医疗等强监管行业偏好私有化…

2025-10-22

马斯克:xAI研发的Grok 5有10%概率实现AGI 且概率持续上升
特斯拉与SpaceX首席执行官埃隆·马斯克在社交平台上发布预测,称其旗下人工智能公司xAI正在研发的Grok5大型语言模型有10%的概率实现通用人工智能(AGI),且该概率呈持续上升趋势。 这一目标与xAI…

2025-10-21