#162 · 主分类: 深度学习框架

DataDreamer

alignment deep-learning fine-tuning gpt instruction-tuning llm llmops llms machine-learning natural-language-processing nlp nlp-library openai python pytorch synthetic-data synthetic-dataset-generation transformers

DataDreamer:提示。生成合成数据。训练和对齐模型。 🤖💤

项目最后更新:02/02/25

GitHub Stars

1.1K

Forks数量

58

贡献者数量

4

许可证

MIT

收录理由

多数大模型研究流程里,提示词脚本、数据清洗和模型训练常常各自为政,中间环节的衔接全凭手工拼凑,复现时很难说清每一步如何影响下一步。DataDreamer 是一个 Python 库,把这些阶段收拢成一条可复现的工作流,研究人员或小团队可以从一个粗略想法直接走到训练并对齐模型,省去零散组装的麻烦。它能调用开源模型或 API 模型来构建和扩充合成数据集,再基于这些数据训练或对齐模型。默认配置合理,缓存策略也很激进,实验中断后再次运行能低成本续跑,数据和模型卡片会记录来源与引用信息,为后续复现提供依据。该项目由 NLP 研究者基于 Hugging Face 和 LiteLLM 构建,更像一个面向可复现实验的实用脚手架,而非又一个浅封装。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目