#110 · 主分类: 基础模型
Phi2-mini-Chinese
language-model
phi-2
retrieval-augmented-generation
text-generation
Phi2-Chinese-0.2B 从0开始训练自己的Phi2中文小模型,支持接入langchain加载本地知识库做检索增强生成RAG。
项目最后更新:07/11/24
GitHub Stars
591
Forks数量
66
贡献者数量
2
许可证
Apache-2.0
收录理由
这个0.2B参数的中文模型沿用了Phi-2的架构,但项目真正的价值在于完整记录了从零训练的全过程,而不只是丢出一个训练好的权重。仓库按顺序展示了数据清洗、BPE分词器训练、因果语言模型预训练、指令微调以及DPO偏好优化,每一步都有具体说明。Hugging Face上的权重可以直接加载用于中文文本生成,还附带了一个示例,演示如何通过LangChain把模型接入本地知识库做检索增强问答。作者也坦承这是实验性项目,预训练数据有限,更适合当作动手训练自己小模型的起点,而非直接上生产的助手。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。