云上弹性RDMA能力来了!腾讯云助力算力加速
EFI 是什么
EFI 有什么优势特点
低延迟。传统 RDMA 将数据传输到网络上不需要经过 Kernel 以及无内存拷贝,从而实现低延迟。EFI 具有传统 RDMA 网卡的优点,超低的延迟让用户在云网络中体验到 RDMA 带来的优越性能。
高吞吐。为达到高带宽的目的,传统 RDMA 将可靠传输协议和内存地址转换卸载到 HCA 中,以降低 CPU 和内存带宽开销。EFI 采用相似的技术路线实现高吞吐目标。
高可用性。EFI 设备底层采用腾讯自研传输协议,其包含高可用设计:在网络设备故障时,可在数毫秒内感知故障并自动规避,从而降业务层长尾延迟。
规模部署。传统 RDMA 基于无损网络,规模部署成本高且困难。EFI 仅依赖有损的以太网络,基于自研的拥塞控制算法实现类似无损网络,从而实现规模化部署。
EFI 功能点
Message:Message 是一种基于 RDMA 的点对点通信模式,用于在两个节点之间进行消息传递。在 Message 模式下,发送方将消息写入本地内存,然后通过 RDMA 操作将消息发送到接收方的内存中。接收方可以通过 RDMA 操作读取消息,并进行相应的处理。
Memory:Memory 是一种基于 RDMA 的内存访问模式,用于在两个节点之间进行内存读取和写入。在 Memory 模式下,发送方可以直接访问接收方的内存,从而实现高效的内存读取和写入。
Event:Event 是一种高效的 RDMA 操作模式,可以在不阻塞 CPU 的情况下进行 RDMA 操作。在 Event 模式下,EFI 可以直接将 RDMA 操作的结果通知给应用程序,而不需要 CPU 的干预。
Inline data:Inline data 是一种高效的 RDMA 操作模式,可以将数据直接嵌入到 RDMA 操作中,从而避免了数据传输的额外开销。在 Inline data 模式下,EFI 可以直接将数据写入到内存中,而不需要通过 DMA(Direct Memory Access)操作进行数据传输。
| 功能 | 支持情况 |
|---|---|
| RDMA语义 | - Message: Send, Send with IMM - Memory: Write, Write with IMM, Read, Atomic |
| QP类型 | Reliable Connection(RC) |
| Event模式 | 支持 |
| Inline Data模式 | 支持 |
EFI 性能表现
EFI 最佳实践
NCCL(Nvidia Collective Communications Library):NCCL 是一种由 Nvidia 开发的集合通信库,可以实现多个 GPU 之间的通信和协同计算。EFI 可以与 NCCL 库配合使用,提供高效的 GPU 集合通信能力,从而加速深度学习和机器学习的训练速度和效率。 TensorFlow-Parameter Server:TensorFlow-Parameter Server 是一种用于分布式训练的架构,可以将模型参数存储在一个或多个参数服务器上,并将训练任务分配给多个工作节点进行并行计算。在 TensorFlow-Parameter Server 架构中,参数服务器负责存储和更新模型参数,而工作节点负责计算梯度和更新模型参数。