#77 · 主分类: 推理与本地部署

TensorRT

cuda deep-learning jetson libtorch machine-learning nvidia pytorch tensorrt

面向NVIDIA GPU的PyTorch/TorchScript/FX编译器,基于TensorRT

项目最后更新:08/30/26

GitHub Stars

3.0K

Forks数量

409

贡献者数量

143

许可证

BSD-3-Clause

收录理由

Torch-TensorRT 能把 PyTorch 模型直接编译成 TensorRT 引擎,省去手工改写模型的功夫,在 NVIDIA GPU 上跑得更快。把它挂到 torch.compile 后端,一行代码就能拿到大部分加速收益,推理延迟相比 eager 模式最高能降低 5 倍;走导出流程还可以把优化后的模块序列化,之后在 C++/libtorch 的生产环境里加载使用。无论是视觉模型、扩散流程还是大语言模型推理,数据中心或 Jetson 设备上都能用,Linux、Windows(仅 Dynamo)以及通过源码编译的 Jetson 都有支持。工具链本身涵盖 FP8 量化与预编译,PyTorch 和 NVIDIA 团队持续维护,版本跟进也及时,不会落后于主流框架。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目