#127 · 主分类: 推理与本地部署

DeepSeek-v4-Flash-DSpark-2x-DGX-Spark

DeepSeek-v4-Flash 0731 用于2x DGX Sparks的配方

项目最后更新:08/29/26

GitHub Stars

1.1K

Forks数量

150

贡献者数量

18

许可证

MIT

收录理由

在两台 DGX Spark 上跑 DeepSeek V4 Flash 0731,看起来简单,实际折腾起来往往要耗掉大半天。这个仓库把整套流程做成了可复用的配方:vLLM 跨节点张量并行、DSpark 投机解码、100 万 token 的上下文上限,镜像和检查点都固定好版本,省得被版本漂移坑。多节点服务里那些不讨喜的细节也没落下,比如 NCCL/RoCE 网络配置、两台机器上 Hugging Face 缓存的同步。KV 缓存的计算讲得很清楚,连为什么六个并发 100 万 token 请求装不下都解释了。启动、停止、状态检查、冒烟测试脚本齐全,还有带日期的基准表,照着跑就能复现,拿自己的数字对比。要是你手头就有 DGX Spark,想要一个验证过的 DeepSeek 部署,这个能省不少时间。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目