#31 · 主分类: 基础模型
Eagle
demo
eagle
gpt4
huggingface
large-language-models
llama
llama3
llava
llm
lmm
lvlm
mllm
nvdia
Eagle:前沿视觉-语言模型,采用以数据为中心的策略
项目最后更新:06/24/26
GitHub Stars
3.5K
Forks数量
335
贡献者数量
12
许可证
Apache-2.0
收录理由
对于想要自己训练多模态模型、而非依赖托管API的研究者来说,这个仓库给出了一条完整的路径。代码把多个各有所长的视觉编码器整合进同一个大语言模型里,在处理OCR、文档理解、图表识别这类对分辨率敏感的任务时表现更稳。除了训练代码,仓库还自带Eagle-SFT-1.8M指令数据集、评测工具和Gradio演示,从预训练到微调出可用的模型,不用自己东拼西凑。想深入实验融合策略和数据配比的话,它在LLaVA这一路模型里是个扎实的起点,也比较不同方案时也很有参考价值。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。