#100 · 主分类: 基础模型
SEED
SEED-LLaMA(ICLR 2024)的官方实现。
项目最后更新:09/21/24
GitHub Stars
642
Forks数量
33
贡献者数量
5
许可证
Other
收录理由
SEED-LLaMA 把图像理解与图像生成放进同一个大语言模型里,这种设计思路对研究视觉和语言如何真正融合、而不是简单拼接的人很有参考价值。仓库给出了完整的训练流程:SEED tokenizer 把视觉信号转成离散 token,8B 和 14B 两个规模的预训练与指令微调代码也都开放,想复现方法或改成自己用的研究者可以直接上手。发布的权重还做了 8bit 量化和动态加载,单张 16GB 或 24GB 显存的卡就能跑起来,省去不少硬件门槛;在线 Gradio 演示也方便你先体验一下助手式的多模态对话,再决定要不要本地部署。作为 ICLR 2024 论文的官方实现,它更适合当作研究起点和参考代码库,而不是开箱即用的产品。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。