#99 · 主分类: 深度学习框架
xla
compiler
deep-learning
pytorch
xla
在XLA设备(如Google TPU)上启用PyTorch
项目最后更新:05/27/26
GitHub Stars
2.8K
Forks数量
570
贡献者数量
264
许可证
Other
收录理由
PyTorch/XLA 是让 PyTorch 模型在 Google Cloud TPU 上跑起来的主要通道。它把张量操作交给 XLA 编译器处理,编译器会对计算图做融合与优化,让 TPU 的硬件能力真正发挥出来,而不是沦为慢吞吞的兼容层。这个包可以直接用 pip 装到 TPU 虚拟机上,通过 PJRT 运行时支持跨芯片的分布式训练,像 Stable Diffusion 这种吃算力的负载也扛得住。很多场景下 TPU 每 flop 的成本比 GPU 低不少,对想保留现有 PyTorch 代码、又打算迁到 TPU 基础设施的团队来说,这是一条很实在的路。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。