#54 · 主分类: 基础模型

xgen

language-model large-language-models llm nlp

Salesforce 开源 LLM,支持 8k 序列长度。

项目最后更新:06/02/26

GitHub Stars

726

Forks数量

40

贡献者数量

3

许可证

Apache-2.0

收录理由

XGen 是 Salesforce 开源的 7B 参数语言模型系列,官方研究版本直接放在 GitHub 上,许可证为 Apache,体积紧凑,适合想自己微调或本地部署、而不是调用云端 API 的团队。它的亮点在于长上下文处理:基础检查点支持 4K 和 8K 的输入序列长度,处理长文档摘要或跨段落推理时更有优势。仓库本身很精简,主要指向 Hugging Face 上的模型卡片,并附了一段 Transformers 的简短示例代码,能快速加载分词器和模型并生成文本,上手门槛不高。需要留意的是,指令微调版本仅限研究用途,作者也建议在投入生产前自行评估准确性、安全性和公平性。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目