#135 · 主分类: 深度学习框架

bert4torch

belle bert bert4keras bert4torch chatglm large-language-models llama llm named-entity-recognition nlp pytorch relation-extraction seq2seq text-classification transformers

一个优雅的PyTorch实现transformers

项目最后更新:05/16/26

GitHub Stars

1.3K

Forks数量

166

贡献者数量

11

许可证

MIT

收录理由

bert4torch 把 bert4keras 的设计思路完整搬到了 PyTorch 生态里,作为一套独立的库,你可以在不引入整套 Hugging Face 训练流程的前提下,直接加载并微调各类 transformer 模型。它用同一套 API 统一处理 BERT、RoBERTa、ALBERT、XLNet、ELECTRA、BART、T5 这些经典预训练权重,覆盖文本分类、命名实体识别、关系抽取等常见任务;同一个接口也能读取 ChatGLM、Llama、BLOOM 等开源大模型的权重,用来做推理或轻量微调。如果手头项目既要跑小型编码器模型,又要过渡到更大的解码器大模型,一份代码就能兼顾。实现方式保持逐层展开、逻辑透明,比黑盒封装更容易读懂和修改,对想弄清模型内部究竟在做什么的研究者或小团队来说,是很实在的优点。简单讲,它让你在 PyTorch 底层之上,体验到接近 Keras 的简洁训练风格。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目