#73 · 主分类: 自然语言处理与文本处理

spacy-transformers

bert google gpt-2 huggingface language-model machine-learning natural-language-processing natural-language-understanding nlp openai pytorch pytorch-model spacy spacy-extension spacy-pipeline transfer-learning xlnet

🛸 在 spaCy 中使用预训练的 transformers,如 BERT、XLNet 和 GPT-2

项目最后更新:03/27/26

GitHub Stars

1.4K

Forks数量

181

贡献者数量

24

许可证

MIT

收录理由

这是Explosion官方为spaCy和Hugging Face transformers库搭建的桥梁,让原本就在用spaCy管线的团队不必推翻重来,就能把BERT、RoBERTa、XLNet这类预训练模型接进现有流程。它真正解决的是对齐难题:transformer的分词器与spaCy自带的分词方式并不一致,这个包会自动完成映射,省去了手动拼接的麻烦。多个管线组件可以共享同一个transformer模型并联合回传梯度,当一个编码器要服务多个任务时特别实用。对已经习惯用spaCy v3配置文件训练的用户来说,它能无缝嵌入既有工作流,序列化与模型打包也都直接内置好了。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目