挖掘有趣 Github 的猫。


有事联系:https://t.me/qumaobot
🍭 #自动化测试 #GPU调度 #VLM模型


🏵 TurboPrefill-VLM-Validation - 多GPU预加载流水线调度验证


🍥 简介:
该项目旨在验证多GPU环境下的处理器内流水线调度机制。通过部署VLM(视觉语言模型)工作负载,对预加载过程进行压力测试与性能评估,确保在大规模并行处理任务中,数据预加载策略能够有效优化多显卡协同计算的执行效率与资源调度逻辑。


🎈 【进入项目】


🗣 活动线报 | 掘金项目
🍭 #深度学习 #GPU性能优化


🏵 Copy-Space Guard - GPU集群数据传输延迟监控工具

🍥 简介:
该程序通过分析NCCL日志或调度计划,评估GPU集群在数据传输过程中的闲置时间。其不涉及修改模型权重及原始数据,仅通过计算分析,精准定位数据传输效率瓶颈,评估当前调度方案与最优解的差距,并量化估算潜在的计算资源节省空间,旨在优化大规模模型训练的硬件利用率。

🎈 【进入项目】


🗣 活动线报 | 掘金项目
🗣 每日羊毛线报 👈


🏵 Rust CUDA Project - Rust 实现 GPU 高速计算

🍥 简介:
Rust CUDA Project 是一个旨在使 Rust 成为利用 NVIDIA CUDA Toolkit 进行高性能 GPU 计算的一流语言的生态系统。它提供了一整套库和工具,让开发者能完全使用 Rust 编写并执行高效的 GPU 加速代码。该项目致力于解决先前 Rust 编译到 PTX 的技术瓶颈,通过提供专门的编译器后端(如 rustc_codegen_nvvm )生成高度优化的 PTX 代码。其核心库包括用于 GPU 端开发的 cuda_std 和 CPU 端 CUDA 交互的 cust ,同时还封装了 cuDNN、OptiX 等关键 CUDA 库,方便 Rust 开发者利用 GPU 算力。

🍭 #Rust #GPU计算


🎈 【进入项目】


🎯 关注频道 🤖 合作/投稿
 
 
Back to Top