#112 · 主分类: 基础模型

pytorch-openai-transformer-lm

language-model neural-networks openai pytorch transformer

🐥一个PyTorch实现的OpenAI微调Transformer语言模型,包含导入OpenAI预训练权重的脚本。

项目最后更新:08/09/21

GitHub Stars

1.5K

Forks数量

285

贡献者数量

9

许可证

MIT

收录理由

想了解原始GPT模型的实际构造,这个仓库是很好的起点。它是OpenAI那篇GPT论文所附TensorFlow代码的PyTorch移植版,最有价值的部分是权重导入脚本——它能把官方预训练权重完整迁移到PyTorch模型里,使模型表现与论文公布的结果一致。仓库还复现了论文中改进的Adam优化器,带固定权重衰减和调度学习率,并提供了分类头与训练脚本,能够复现ROCStories完形填空的准确率。由于它诞生于Hugging Face transformers库出现之前,后者基本取代了它的功能,所以更适合作为教学参考,而非生产环境可用的软件。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目