#109 · 主分类: 基础模型

gpt2-ml

bert chinese colab gpt-2 nlp pretrained-models tensorflow text-generation tpu

GPT2多语言版本,包含预训练模型,支持15亿参数的中文预训练模型。

项目最后更新:05/22/23

GitHub Stars

1.7K

Forks数量

325

贡献者数量

5

许可证

Apache-2.0

收录理由

中文文本生成领域里,真正开源的大规模预训练模型一直不多,gpt2-ml 是少数直接放出 1.5B 参数中文 GPT-2 权重的项目。它提供两套模型,分别基于 CLUE 词表和 BERT 风格的两万多个 token 词表,方便你根据下游任务已有的分词方式挑合适的来用。训练脚本源自 Grover 并支持 TPU,想在自己数据上继续预训练的话可以直接改。配套的 Colab 笔记本点几下就能让这个 1.5B 模型跑起来生成文本,动手试效果的成本很低。不过项目自 2023 年起就不再更新,技术栈停留在 TensorFlow 时代,更适合愿意自己改老代码的研究者,而不是需要长期维护依赖的团队。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目