#31 · 主分类: 基础模型

Eagle

demo eagle gpt4 huggingface large-language-models llama llama3 llava llm lmm lvlm mllm nvdia

Eagle:前沿视觉-语言模型,采用以数据为中心的策略

项目最后更新:06/24/26

GitHub Stars

3.5K

Forks数量

335

贡献者数量

12

许可证

Apache-2.0

收录理由

对于想要自己训练多模态模型、而非依赖托管API的研究者来说,这个仓库给出了一条完整的路径。代码把多个各有所长的视觉编码器整合进同一个大语言模型里,在处理OCR、文档理解、图表识别这类对分辨率敏感的任务时表现更稳。除了训练代码,仓库还自带Eagle-SFT-1.8M指令数据集、评测工具和Gradio演示,从预训练到微调出可用的模型,不用自己东拼西凑。想深入实验融合策略和数据配比的话,它在LLaVA这一路模型里是个扎实的起点,也比较不同方案时也很有参考价值。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目