#184 · 主分类: MLOps与评测
ChineseGLUE
中文语言理解评估基准:数据集、基线、预训练模型、语料库和排行榜
项目最后更新:02/18/23
GitHub Stars
1.8K
Forks数量
244
贡献者数量
18
许可证
Other
收录理由
ChineseGLUE把GLUE基准的思路搬到了中文上,把评估数据集、基线分数和预训练检查点打包在一起,给中文语言理解任务定了一个可参照的尺度。任务覆盖面比单一模型评测要广:新闻分类、句子对相似度、自然语言推理、情感分析、命名实体识别、抽取式阅读理解都有,简体繁体都照顾到了。排行榜上的表格把BERT、RoBERTa、ERNIE、XLNet、ALBERT这些变体在不同任务上的表现列得清清楚楚,挑预训练起点的时候不用自己从头跑一遍对比实验。做中文NLP系统的团队,直接拿它提供的数据集链接和格式说明就能省掉四处找语料、搭评测流程的功夫。这个项目后来主要搬到了CLUE基准上,但经典版仍然保留着最初那套任务集的完整样貌,作为快照看挺连贯。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
unsloth
本地UI,用于运行和训练LLM及扩散模型。支持GGUF、MLX、Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、FLUX等。
LlamaFactory
统一高效微调100+大语言模型与视觉语言模型(ACL 2024)
airflow
Apache Airflow - 一个以编程方式编写、调度和监控工作流的平台
langfuse
🪢 开源AI工程平台:LLM评估、可观测性、指标、提示管理、游乐场、数据集。与OpenTelemetry、LangChain、OpenAI SDK、LiteLLM等集成。🍊YC W23
netron
神经网络、深度学习和机器学习模型的可视化工具