#77 · 主分类: 推理与本地部署
TensorRT
面向NVIDIA GPU的PyTorch/TorchScript/FX编译器,基于TensorRT
项目最后更新:08/30/26
GitHub Stars
3.0K
Forks数量
409
贡献者数量
143
许可证
BSD-3-Clause
收录理由
Torch-TensorRT 能把 PyTorch 模型直接编译成 TensorRT 引擎,省去手工改写模型的功夫,在 NVIDIA GPU 上跑得更快。把它挂到 torch.compile 后端,一行代码就能拿到大部分加速收益,推理延迟相比 eager 模式最高能降低 5 倍;走导出流程还可以把优化后的模块序列化,之后在 C++/libtorch 的生产环境里加载使用。无论是视觉模型、扩散流程还是大语言模型推理,数据中心或 Jetson 设备上都能用,Linux、Windows(仅 Dynamo)以及通过源码编译的 Jetson 都有支持。工具链本身涵盖 FP8 量化与预编译,PyTorch 和 NVIDIA 团队持续维护,版本跟进也及时,不会落后于主流框架。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。