#117 · 主分类: MLOps与评测

CLUE

albert benchmark bert chinese chineseglue corpus dataset glue language-model nlu pretrained-models pytorch roberta tensorflow transformers

中文语言理解测评基准:数据集、基线、预训练模型、语料库和排行榜

项目最后更新:02/06/26

GitHub Stars

4.3K

Forks数量

544

贡献者数量

24

许可证

Other

收录理由

做中文自然语言处理的人,多半绕不开CLUE。它把文本分类、句对相似度、自然语言推断等一批有代表性的中文理解任务打包在一起,并维护了一份公开排行榜,想评估某个模型表现如何,先来这里看看榜单和数据集,心里就有底了。仓库里还附带了基线实现和预训练模型的链接,不用从零开始训练,省下不少摸索时间。它不是拿来直接部署的产品,但在挑选或验证中文模型时,这些数据和历次榜单结果能实打实地帮你少走弯路。而且它覆盖了从早期到现在的任务类型,顺着看下来,也能大致摸清中文NLU这些年演进的脉络。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目