#16 · 主分类: 基础模型
Chinese-BERT-wwm
bert
bert-wwm
bert-wwm-ext
chinese-bert
nlp
pytorch
rbt
roberta
roberta-wwm
tensorflow
为中文BERT进行整词掩码预训练(中文BERT-wwm系列模型)
项目最后更新:04/19/26
GitHub Stars
10.2K
Forks数量
1.4K
贡献者数量
2
许可证
Apache-2.0
收录理由
做中文NLP的团队,很多都把这一套预训练权重当作手边常备的工具。项目里不光有BERT-wwm和扩展版,还提供了RoBERTa-wwm-ext的多个规格,包括大号checkpoint,以及轻量的RBT3、RBTL3,想兼顾速度和精度时,按需选尺寸就行。所有模型都能直接通过transformers库加载,做分类、序列标注这类下游任务的微调非常顺手。小模型拿来做分词、提取embedding,或者给别的模型当老师,也都挺合适。背后有同行评审的论文和完整的预训练细节说明,用起来心里有底,不是那种来路不明的黑盒,作为基线很踏实。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。