#115 · 主分类: 推理与本地部署

distributed-llama

distributed-computing distributed-llm llama2 llama3 llm llm-inference llms neural-network open-llm

分布式LLM推理。将家用设备连接成强大的集群,加速LLM推理。设备越多,推理越快。

项目最后更新:07/05/26

GitHub Stars

3.0K

Forks数量

248

贡献者数量

15

许可证

MIT

收录理由

Distributed Llama 把家中闲置的机器(包括树莓派)串成一个推理集群。它用张量并行把模型权重拆到各节点,再通过以太网同步,所以加设备不只是扩容,而是真的让生成变快。这样一来,单台机器内存装不下的 70B 或 405B 级模型,也能在自己硬件上跑,不用租云 GPU。启动只需一条命令,自动下载模型和分词器;README 覆盖 Linux、macOS、Windows 和 GPU 运行方式,讨论区还贴了真实基准。无论是想用消费级硬件自托管大模型,还是想看看张量并行在多机之外的表现,这个项目都是值得研究的活例子。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目