#12 · 主分类: 合成数据生成

magpie

alignment dataset gemma llama2 llama3 llm nlp paper phi3 qwen2 supervised-finetuning synthetic-data synthetic-dataset-generation

[ICLR 2025] 从零开始合成对齐数据:用空提示提示对齐的LLM。高效、高质量的合成数据生成流水线!

项目最后更新:03/17/25

GitHub Stars

879

Forks数量

69

贡献者数量

7

许可证

MIT

收录理由

为自家模型构建指令微调数据,通常要手写种子问题,再让大模型扩写成对话。Magpie省掉这一步:它直接借用对齐模型自带的预查询模板,让模型自己生成用户提问和回答。这样一来,手动整理的工作量大幅减少,产出规模可达百万级,对微调聊天模型或做对齐特别有用。仓库里带可直接运行的生成脚本,覆盖Llama-3.3、Qwen2.5、Phi-3和Gemma-2,也发布了不少现成数据集,既能直接拿来用,也能当格式参考再跑自己的。需要监督微调或偏好优化数据,又不想要太重提示词工程的话,这个项目有论文和公开产物兜底,是个可靠且可复现的起点。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目