#143 · 主分类: 深度学习框架

Transformers.jl

attention deep-learning flux machine-learning natural-language-processing nlp transformer

Julia 实现的 Transformer 模型

项目最后更新:07/31/26

GitHub Stars

571

Forks数量

83

贡献者数量

19

许可证

MIT

收录理由

在 Julia 生态里做 Transformer 相关的工作,过去往往得绕道 Python,Transformers.jl 把这个坎给填平了。它基于 Flux.jl 实现了 Transformer 架构,并带有一个 HuggingFace 模块,可以直接加载 bert-base-uncased 这类预训练权重,用简洁的接口跑推理。文本编码器把特殊 token、截断、填充和 one-hot 编码这些琐碎步骤都封装好了,不用自己手写分词器。对于需要在 Flux 流程里嵌入 BERT 风格编码器的 Julia 研究者和工程师来说,无论是做嵌入、分类还是特征提取,它都很实用。当然,它是个库而不是开箱即用的服务,需要自己写 Julia 代码、翻文档,但如果你已经扎根在 Julia 生态里,用它做 Transformer 工作就能省去和 Python 来回打交道的麻烦。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目