#54 · 主分类: 基础模型
xgen
language-model
large-language-models
llm
nlp
Salesforce 开源 LLM,支持 8k 序列长度。
项目最后更新:06/02/26
GitHub Stars
726
Forks数量
40
贡献者数量
3
许可证
Apache-2.0
收录理由
XGen 是 Salesforce 开源的 7B 参数语言模型系列,官方研究版本直接放在 GitHub 上,许可证为 Apache,体积紧凑,适合想自己微调或本地部署、而不是调用云端 API 的团队。它的亮点在于长上下文处理:基础检查点支持 4K 和 8K 的输入序列长度,处理长文档摘要或跨段落推理时更有优势。仓库本身很精简,主要指向 Hugging Face 上的模型卡片,并附了一段 Transformers 的简短示例代码,能快速加载分词器和模型并生成文本,上手门槛不高。需要留意的是,指令微调版本仅限研究用途,作者也建议在投入生产前自行评估准确性、安全性和公平性。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。