技术博客
高性能计算、AI训练优化、并行算法等领域的技术文章
千卡GPU集群训练大模型的挑战与实践
深入解析在大规模GPU集群上进行分布式训练时面临的核心挑战,包括通信瓶颈、显存优化、故障恢复等关键问题的解决方案。
分布式训练GPU集群通信优化
2024-12-1512分钟
并行计算中的负载均衡策略详解
从静态分区到动态调度,系统梳理并行计算中负载均衡的演进路线,并给出在不同场景下的最佳实践建议。
负载均衡动态调度并行算法
2024-11-288分钟
科学仿真中的高性能计算优化技巧
针对分子动力学、CFD等典型科学仿真场景,分享计算任务分解、内存访问模式优化等实战经验。
科学仿真分子动力学内存优化
2024-11-1015分钟
从零搭建高性能计算集群:架构选型指南
全面对比GPU、CPU、存储、网络四大组件的选型策略,帮助团队根据业务需求做出最优技术决策。
架构选型集群搭建技术决策
2024-10-2210分钟
InfiniBand与RoCE:高性能网络方案深度对比
详细分析两种主流RDMA网络方案在延迟、带宽、成本、生态等方面的差异,为集群网络选型提供数据支撑。
InfiniBandRoCERDMA网络选型
2024-10-0514分钟