#3 · 主分类: GPU 计算框架
dstack
供应商无关的编排,支持训练、推理和代理工作负载,适用于 NVIDIA、AMD、TPU、Tenstorrent,可在云、Kubernetes 和裸金属上运行。
项目最后更新:08/28/26
GitHub Stars
2.2K
Forks数量
252
贡献者数量
74
许可证
MPL-2.0
收录理由
如果你经常在多个GPU云厂商之间切换,或者需要把租来的算力和自建机房设备混在一起用,dstack值得花点时间看看。它省去了为每家云商单独写脚本的麻烦:只要在YAML文件里描述好训练任务、开发环境或推理负载,dstack就会自动去匹配并拉起合适的实例,跑完任务后还能顺手清理资源。由于编排层位于硬件之上,同一份配置可以直接跑在NVIDIA、AMD、TPU或Tenstorrent上,不需要改动任何东西。对于多节点场景,它也能借助torchrun和Ray处理分布式训练,省掉了小团队通常要自己拼凑的一大堆基础设施胶水代码。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
kompute
基于Vulkan的通用GPU计算框架,支持数千种跨厂商显卡(AMD、高通、NVIDIA等)。极速、支持移动端、异步,并针对高级GPU数据处理场景优化。由Linux基金会支持。
lupine
LUPINE 是一种基于 IP 的 GPU 桥接技术,可将远程 GPU 挂载到仅 CPU 的机器上。
MetalPetal
基于Metal构建的GPU加速图像和视频处理框架。
tt-metal
:metal: TT-NN 算子库,以及 TT-Metalium 低级内核编程模型。
blazingsql
BlazingSQL 是一个轻量级的、GPU加速的Python SQL引擎,基于RAPIDS cuDF构建。