#112 · 主分类: 基础模型
pytorch-openai-transformer-lm
language-model
neural-networks
openai
pytorch
transformer
🐥一个PyTorch实现的OpenAI微调Transformer语言模型,包含导入OpenAI预训练权重的脚本。
项目最后更新:08/09/21
GitHub Stars
1.5K
Forks数量
285
贡献者数量
9
许可证
MIT
收录理由
想了解原始GPT模型的实际构造,这个仓库是很好的起点。它是OpenAI那篇GPT论文所附TensorFlow代码的PyTorch移植版,最有价值的部分是权重导入脚本——它能把官方预训练权重完整迁移到PyTorch模型里,使模型表现与论文公布的结果一致。仓库还复现了论文中改进的Adam优化器,带固定权重衰减和调度学习率,并提供了分类头与训练脚本,能够复现ROCStories完形填空的准确率。由于它诞生于Hugging Face transformers库出现之前,后者基本取代了它的功能,所以更适合作为教学参考,而非生产环境可用的软件。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。