#125 · 主分类: LLM应用框架
yzma
用你自己的智能去Go - 直接集成llama.cpp的Go应用程序,利用硬件加速进行本地推理。
项目最后更新:08/30/26
GitHub Stars
574
Forks数量
23
贡献者数量
6
许可证
MIT
收录理由
yzma 是一个 Go 库,它直接调用 llama.cpp,让你在自己的应用里加载 GGUF 模型、对提示词做分词、运行采样链并流式接收生成的 token,无需另起一个独立的服务器进程。它绕开 CGo,改用 purego 和 FFI,因此在 Linux、macOS 和 Windows 上构建起来很省事,同时紧跟 llama.cpp 的最新发布,及时获得新模型支持和性能修复。项目还附带一个命令行工具,能自动检测 CUDA 或 ROCm 并下载预编译的 llama.cpp 库,并提供视觉语言模型和交互式聊天的可运行示例;另外还有一条 WebAssembly 路线,借助 TinyGo 和 WebGPU 让模型直接在浏览器里跑。如果你正在写一个需要内嵌本地推理的 Go 服务或工具,从桌面 GPU 到树莓派或 Jetson 都能用,这个库是个扎实的选择。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
langchain
智能体工程平台。
dify
在一个协作工作区中构建Agentic工作流、RAG管道,支持丰富的AI模型和工具。可部署在云、VPC或自托管环境,团队无需重建技术栈即可从原型走向生产。
headroom
压缩工具输出、日志、文件和RAG块,再送入LLM。编码代理减少20% token,JSON减少60-95% token,答案不变。提供库、代理、MCP服务器。
litellm
最快的、最轻量的AI网关。Rust核心,Python SDK。以OpenAI(或原生)格式调用100多种LLM API,具备成本追踪、护栏、负载均衡和日志记录 [Bedrock, Azure, OpenAI, Anthropic, OpenAI, VertexAI, vLLM, Nvidia NIM]
llama_index
LlamaIndex 是领先的文档代理和 OCR 平台