#357 · 主分类: 计算机视觉
3D-ResNets-PyTorch
action-recognition
computer-vision
deep-learning
python
pytorch
video-recognition
3D ResNets用于动作识别(CVPR 2018)
项目最后更新:01/20/21
GitHub Stars
4.0K
Forks数量
926
贡献者数量
7
许可证
MIT
收录理由
这个代码库专注解决一个具体的视觉问题:识别视频里人物正在进行的动作,而不只是分辨画面中有哪些物体。它提供了完整的PyTorch实现,涵盖三维残差网络的训练、微调和评估脚本,让使用者可以从原始视频直接训练出可用的动作识别模型,省去自己搭建网络结构和数据处理流程的麻烦。项目附带了在Kinetics、Moments in Time、UCF-101、HMDB-51和ActivityNet等主流基准上预训练好的权重,对于标注数据有限、想直接迁移现有模型而不是从头训练的场景非常实用。代码与作者发表的CVPR和ICCV论文严格对应,复现论文结果或在此基础上做扩展都很直接。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。