#357 · 主分类: 计算机视觉

3D-ResNets-PyTorch

action-recognition computer-vision deep-learning python pytorch video-recognition

3D ResNets用于动作识别(CVPR 2018)

项目最后更新:01/20/21

GitHub Stars

4.0K

Forks数量

926

贡献者数量

7

许可证

MIT

收录理由

这个代码库专注解决一个具体的视觉问题:识别视频里人物正在进行的动作,而不只是分辨画面中有哪些物体。它提供了完整的PyTorch实现,涵盖三维残差网络的训练、微调和评估脚本,让使用者可以从原始视频直接训练出可用的动作识别模型,省去自己搭建网络结构和数据处理流程的麻烦。项目附带了在Kinetics、Moments in Time、UCF-101、HMDB-51和ActivityNet等主流基准上预训练好的权重,对于标注数据有限、想直接迁移现有模型而不是从头训练的场景非常实用。代码与作者发表的CVPR和ICCV论文严格对应,复现论文结果或在此基础上做扩展都很直接。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目