#50 · 主分类: 基础模型

Chinese-XLNet

natural-language-processing nlp pytorch tensorflow xlnet

预训练中文XLNet

项目最后更新:04/19/26

GitHub Stars

1.6K

Forks数量

278

贡献者数量

2

许可证

Apache-2.0

收录理由

中文XLNet提供了基于排列机制的预训练模型,与多数中文自然语言处理项目采用的掩码式BERT编码器不同,它通过自回归方式捕捉双向上下文信息。项目包含12层基础版和24层中间版两种规格,后者参数量超过两亿,训练语料为54亿词的大规模通用数据,与哈工大讯飞联合实验室发布的中文BERT使用相同数据来源。模型权重可通过Hugging Face Transformers库快速加载,只需少量代码即可针对抽取式阅读理解、情感分类等任务进行微调。仓库文档详细说明了预训练过程、下游任务微调参数,并给出了与中文BERT的基线对比结果,既适合作为实际项目的起点,也是比较不同编码器方案时的参考材料。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目