#135 · 主分类: 深度学习框架
bert4torch
一个优雅的PyTorch实现transformers
项目最后更新:05/16/26
GitHub Stars
1.3K
Forks数量
166
贡献者数量
11
许可证
MIT
收录理由
bert4torch 把 bert4keras 的设计思路完整搬到了 PyTorch 生态里,作为一套独立的库,你可以在不引入整套 Hugging Face 训练流程的前提下,直接加载并微调各类 transformer 模型。它用同一套 API 统一处理 BERT、RoBERTa、ALBERT、XLNet、ELECTRA、BART、T5 这些经典预训练权重,覆盖文本分类、命名实体识别、关系抽取等常见任务;同一个接口也能读取 ChatGLM、Llama、BLOOM 等开源大模型的权重,用来做推理或轻量微调。如果手头项目既要跑小型编码器模型,又要过渡到更大的解码器大模型,一份代码就能兼顾。实现方式保持逐层展开、逻辑透明,比黑盒封装更容易读懂和修改,对想弄清模型内部究竟在做什么的研究者或小团队来说,是很实在的优点。简单讲,它让你在 PyTorch 底层之上,体验到接近 Keras 的简洁训练风格。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。