#115 · 主分类: 基础模型

KoELECTRA

electra korean-nlp language-model nlp pytorch tensorflow tensorflow2 transformers

预训练的韩语ELECTRA模型

项目最后更新:02/19/24

GitHub Stars

638

Forks数量

135

贡献者数量

3

许可证

Apache-2.0

收录理由

KoELECTRA 是面向韩语的 ELECTRA 预训练模型,提供 base 和 small 两种规格,训练数据为 34GB 韩语文本。模型权重托管在 Hugging Face 上,通过 Transformers 库的 from_pretrained 方法即可在 PyTorch 或 TensorFlow 中直接加载,省去自行预训练的繁琐。仓库详细记录了预训练配置,包括 TPU 使用方式和超参数,复现或在此基础上扩展都比较顺手。同时附带了在标准韩语基准上的微调结果,对于在 v1 和 v2 版本之间做选择、用于情感分析或命名实体识别等任务时,是很有价值的参考。这是一个聚焦的模型发布,而非通用框架,实际使用时需要针对自己的下游任务进行微调。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目