#155 · 主分类: 推理与本地部署

llama3.java

chatgpt genai gguf huggingface java llama llama3 llamacpp llm llm-inference llms openai simd transformers

纯Java实现的Llama 3+推理

项目最后更新:04/24/26

GitHub Stars

816

Forks数量

94

贡献者数量

6

许可证

MIT

收录理由

对Java团队来说,想在JVM里直接跑Llama 3、3.1或3.2模型,通常得绕道JNI去调C++运行时,链路长且调试麻烦。这个项目把整条推理链路收进了一个无依赖的Java文件里,直接解析GGUF权重,覆盖Q4_0到Q8_0的常见量化格式,省去了跨语言桥接的折腾。它自带一个轻量CLI,支持chat和instruct两种模式,下载好模型文件就能开聊。作者本身拿它来打磨JVM编译器优化,所以代码里能看到Vector API加速的矩阵运算,以及GraalVM Native Image支持带来的快速启动。项目源自Karpathy的llama2.c,顺着代码走一遍,等于把transformer推理的骨架读了一遍,全程不用离开Java生态。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目