NVIDIA 精英级合作伙伴 · AI 基础设施技术资料
资讯中心
中科新远资讯中心围绕GPU与整机、NVIDIA网络产品、AI算力网络架构、选型兼容、部署验收及企业网络提供工程化技术内容。
最新文章
发布后的技术文章会按时间汇总在这里。
InfiniBand SHARP 为什么值得重新评估:网络内计算的收益与采用边界
结合 NVIDIA SHARP 与 InfiniBand 官方资料,分析网络内集合操作对 AI/HPC 通信、软件、拓扑和验收提出的采用条件。
NVIDIA Air 反映了什么变化:网络验证从设备实验走向数字孪生
结合 NVIDIA Air 官方资料,分析网络验证从单设备实验转向可重复数字孪生,对配置、自动化、升级和团队流程的影响。
AI 网络 IPAM 怎么规划:管理、训练、存储与租户地址的可追溯方法
说明 AI 网络如何用 IPAM 管理训练、存储、管理、租户与互联地址,支持汇总、自动化、扩容和故障追溯。
AI 数据中心防火墙放在哪里:训练 Fabric、服务入口与管理面的边界
说明 AI 数据中心防火墙在训练 Fabric、存储、服务入口、园区互联和管理面中的部署边界、容量与故障影响。
RoCE 网络 PFC 异常怎么做恢复测试:拥塞扩散、队列和业务回归
说明 RoCE 网络如何设计 PFC 异常与拥塞恢复测试,关联队列、ECN、暂停帧、丢包、RDMA 和 NCCL 业务结果。
高速网卡 PCIe 链路降速怎么验收:代际、宽度、拓扑与持续负载
说明高速网卡验收时如何检查 PCIe 协商代际和宽度、插槽拓扑、共享上行、错误计数及持续负载下的降速问题。
AI 机房单模与多模光纤怎么选:距离、布线生命周期和链路预算
比较 AI 机房单模与多模光纤在距离、模块、配线、链路预算、测试、扩容和生命周期方面的选择条件。
OSFP 与 QSFP-DD 怎么选:设备笼口、热设计和链路兼容边界
比较 OSFP 与 QSFP-DD 在设备笼口、模块散热、功耗、线缆、速率模式和运维备件方面的选择与兼容边界。
AI 网络多租户怎么隔离:VRF、队列、作业与运维责任的组合设计
说明共享 AI 网络如何组合 VRF、地址、队列、路由、作业调度和运维权限,建立可验证的多租户隔离与容量边界。