#12 · 主分类: 合成数据生成
magpie
alignment
dataset
gemma
llama2
llama3
llm
nlp
paper
phi3
qwen2
supervised-finetuning
synthetic-data
synthetic-dataset-generation
[ICLR 2025] 从零开始合成对齐数据:用空提示提示对齐的LLM。高效、高质量的合成数据生成流水线!
项目最后更新:03/17/25
GitHub Stars
879
Forks数量
69
贡献者数量
7
许可证
MIT
收录理由
为自家模型构建指令微调数据,通常要手写种子问题,再让大模型扩写成对话。Magpie省掉这一步:它直接借用对齐模型自带的预查询模板,让模型自己生成用户提问和回答。这样一来,手动整理的工作量大幅减少,产出规模可达百万级,对微调聊天模型或做对齐特别有用。仓库里带可直接运行的生成脚本,覆盖Llama-3.3、Qwen2.5、Phi-3和Gemma-2,也发布了不少现成数据集,既能直接拿来用,也能当格式参考再跑自己的。需要监督微调或偏好优化数据,又不想要太重提示词工程的话,这个项目有论文和公开产物兜底,是个可靠且可复现的起点。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。