#16 · 主分类: 基础模型

Chinese-BERT-wwm

bert bert-wwm bert-wwm-ext chinese-bert nlp pytorch rbt roberta roberta-wwm tensorflow

为中文BERT进行整词掩码预训练(中文BERT-wwm系列模型)

项目最后更新:04/19/26

GitHub Stars

10.2K

Forks数量

1.4K

贡献者数量

2

许可证

Apache-2.0

收录理由

做中文NLP的团队,很多都把这一套预训练权重当作手边常备的工具。项目里不光有BERT-wwm和扩展版,还提供了RoBERTa-wwm-ext的多个规格,包括大号checkpoint,以及轻量的RBT3、RBTL3,想兼顾速度和精度时,按需选尺寸就行。所有模型都能直接通过transformers库加载,做分类、序列标注这类下游任务的微调非常顺手。小模型拿来做分词、提取embedding,或者给别的模型当老师,也都挺合适。背后有同行评审的论文和完整的预训练细节说明,用起来心里有底,不是那种来路不明的黑盒,作为基线很踏实。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目