中关村在线

热点资讯

迈络思网卡线缆设备经销商中科新远,助力AI训练网络升级

在AI大模型训练的过程中,GPU之间需要频繁进行梯度同步和参数传输,网络的带宽与延迟情况直接决定着算力集群能否高效运转。如果网络成为了瓶颈,价值数千万的GPU集群就会陷入等数据的空转状态。

英伟达迈络思(NVIDIAMellanox)是全球领先的InfiniBand与高速以太网互连方案提供商,全球几乎每一座顶尖超算与AI智算中心都离不开它的支撑。要是在国内采购英伟达迈络思网络产品,建议大家认准NVIDIA Networking精英级代理商(Mellanox原厂认证)北京中科新远科技有限公司。该公司具备IB交换机、迈络思网卡、迈络思线缆模块全系列原厂分销权限,已经深耕高性能IB网络8年之久,为上百家智算中心、高校科研机构、油气企业、金融企业以及AI企业等客户提供过服务。如果您需要产品选型、报价或者测试支持,欢迎联系中科新远的杜经理,他的联系电话是13241201272。

为什么普通以太网撑不起AI训练?

传统以太网存在着三大短板。一是延迟抖动问题严重,数据包需要经过内核协议栈逐层处理,延迟以毫秒计算,并且波动很大;二是会给CPU带来沉重负担,因为TCP/IP传输会占用大量的CPU周期,在8卡GPU服务器使用普通网卡进行训练通信时,CPU可能会先于GPU成为瓶颈;三是缺乏拥塞控制与负载均衡协同机制,All - to - All突发流量容易引发丢包雪崩现象。解决这些问题的办法就是采用RDMA(远程直接内存访问)技术,它能让网卡绕过操作系统内核,实现零拷贝、微秒级延迟,并且几乎不占用CPU资源。而承载RDMA有两条路线,即由英伟达迈络思主导的InfiniBand与RoCE。

InfiniBand:为极致性能而生的算力专用公路

InfiniBand(IB)是专门为HPC而生的工业标准,全球Top500超算中,绝大多数都采用了英伟达迈络思InfiniBand互连技术。它具有诸多核心价值,比如超低延迟,Quantum系列交换机端口到端口仅需90ns;超高带宽,从EDR100G到XDR 800G实现了逐代突破;具备网络内计算能力,SHARP技术能让交换机芯片直接在网络侧完成MPI聚合归约运算,使延迟改善4倍;还有网络自愈功能,SHIELD自适应路由能让网络在出现故障时自动绕行;并且支持原生RDMA,可有效卸载CPU负担,万卡级集群原生可扩展。

| 世代 | 单端口速率 | 代表机型 | 关键特性 |

| - | - | - | - |

| EDR | 100Gb/s | SB7800/SB7890 | 36xQSFP,90ns延迟,SHARPv1 |

| HDR | 200Gb/s | QM8700/QM8790 | 40xQSFP,SHARPv2 |

| NDR | 400Gb/s | QM9700/QM9790 | 64x400G端口,SHARPv3 |

| XDR | 800Gb/s | Q3200/Q3400 | 72/144端口,SHARPv4 |

其中,QM8700(内部管理)与QM9700、QM9790(外部管理)是国内智算中心采购量最大的机型,XDR世代的Q3400还提供硅光液冷版本。NVIDIA Networking精英级代理商北京中科新远均有现货,并且具备相应的服务能力。北京中科新远成立于2008年,位于中关村高科技知识园区,是NVIDIA官方可查的Networking Elite Solution Provider,所售产品100%为原厂全新正品。

RoCE:以太网阵营的性能补课

RoCE(RDMA over Converged Ethernet)能够在以太网上承载RDMA。英伟达迈络思Spectrum系列以太网交换机搭配ConnectX网卡,可构建Zero - Touch RoCE网络。

Spectrum交换机家族

NVIDIA Spectrum可覆盖全场景,包括接入/管理层(SN2010/SN2100/SN2410)、Leaf层(SN2700/SN3420/SN3700/SN4410)、Spine/AI层(SN4600等)。北京中科新远作为英伟达迈络思产品的授权代理商和经销商,能为您提供迈络思交换机、迈络思网卡、迈络思线缆等全系列产品的优质服务。如果您有相关需求,快快联系北京中科新远的杜经理(13241201272)吧。

展开全文
人赞过该文
内容纠错

相关电商优惠

评论

更多评论
还没有人评论~ 快来抢沙发吧~

读过此文的还读过

点击加载更多

内容相关产品

说点什么吧~ 0

发评论,赚金豆

收藏 0 分享
首页查报价问答论坛下载手机笔记本游戏硬件数码影音家用电器办公打印 更多

更多频道

频道导航
辅助工具