GitHub Stars
4.8K
Forks数量
394
贡献者数量
8
许可证
Other
收录理由
准备微调或对齐自己的模型时,这份清单值得一直开着。它按领域整理了SFT和RL/偏好数据集,每条都标注了样本规模、是否含推理过程以及许可证,方便快速筛选。仓库还汇总了后训练相关的工具和指南,从为聊天助手或推理模型挑选初始数据组合,到真正搭起训练流程,都能在这里找到线索。开篇关于数据质量的部分,从准确性、多样性和复杂性三个角度给了实用的自检思路,下手选数据前可以先过一遍。它不是可直接部署的软件,但自己构建训练数据时能省下不少时间。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
unsloth
本地UI,用于运行和训练LLM及扩散模型。支持GGUF、MLX、Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、FLUX等。
LlamaFactory
统一高效微调100+大语言模型与视觉语言模型(ACL 2024)
airflow
Apache Airflow - 一个以编程方式编写、调度和监控工作流的平台
langfuse
🪢 开源AI工程平台:LLM评估、可观测性、指标、提示管理、游乐场、数据集。与OpenTelemetry、LangChain、OpenAI SDK、LiteLLM等集成。🍊YC W23
netron
神经网络、深度学习和机器学习模型的可视化工具