#126 · 主分类: MLOps与评测

Skills

一个旨在提升大型语言模型技能的项目

项目最后更新:08/28/26

GitHub Stars

1.0K

Forks数量

198

贡献者数量

90

许可证

Apache-2.0

收录理由

NeMo Skills 把大语言模型开发的完整链路收进同一套流水线:从合成数据生成,到借助 NeMo-RL 或 verl 完成训练,再到覆盖数学、代码、指令跟随、长上下文、工具调用和多语言任务等广泛基准的评测。团队若想从原始检查点一路走到经过基准验证、可投入生产的模型,这套工具能在一个地方搞定。它的扩展方式也很顺:先在单张本地 GPU 上跑通任务,之后只需改一行配置,就能把同样的工作负载搬到大型 Slurm 集群上,对先在本地做原型验证的小团队特别合适。评测层同样扎实,支持并行任务、自托管 LLM 裁判,并为 Nemotron、OpenReasoning 等模型提供了可复现的评测配方。如果你正在构建或微调偏重推理的模型,并且需要可复现的数据、训练和评测流程,而不是一个只解决单点问题的工具,这个项目会非常契合。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目