#184 · 主分类: MLOps与评测

ChineseGLUE

albert bert chinese-corpus datasets glue language-understanding nlp pre-trained-model

中文语言理解评估基准:数据集、基线、预训练模型、语料库和排行榜

项目最后更新:02/18/23

GitHub Stars

1.8K

Forks数量

244

贡献者数量

18

许可证

Other

收录理由

ChineseGLUE把GLUE基准的思路搬到了中文上,把评估数据集、基线分数和预训练检查点打包在一起,给中文语言理解任务定了一个可参照的尺度。任务覆盖面比单一模型评测要广:新闻分类、句子对相似度、自然语言推理、情感分析、命名实体识别、抽取式阅读理解都有,简体繁体都照顾到了。排行榜上的表格把BERT、RoBERTa、ERNIE、XLNet、ALBERT这些变体在不同任务上的表现列得清清楚楚,挑预训练起点的时候不用自己从头跑一遍对比实验。做中文NLP系统的团队,直接拿它提供的数据集链接和格式说明就能省掉四处找语料、搭评测流程的功夫。这个项目后来主要搬到了CLUE基准上,但经典版仍然保留着最初那套任务集的完整样貌,作为快照看挺连贯。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目