基础模型

开源大模型、微调工具链与基础模型相关生态。

共 113 个项目

排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。

第 61–80 项,共 113 个

排名 项目 Stars Forks
61 MiniMax-01

MiniMax-Text-01和MiniMax-VL-01的官方仓库,基于Linear Attention的大语言模型与视觉语言模型

3.5K 332
62 MiniMax-M1

MiniMax-M1,全球首个开放权重的大规模混合注意力推理模型。

3.2K 283
63 DeepSeek-VL2

DeepSeek-VL2:用于高级多模态理解的混合专家视觉-语言模型

5.4K 1.8K
64 LWM

大型世界模型——以百万上下文建模文本和视频

7.4K 563
65 Chinese-Vicuna

Chinese-Vicuna:一个基于LLaMA的中文指令跟随模型 —— 一个中文低资源的llama+lora方案,结构参考alpaca

4.1K 405
66 NExT-GPT

ICML 2024论文的代码和模型,NExT-GPT:Any-to-Any多模态大语言模型

3.6K 360
67 InternLM-XComposer

InternLM-XComposer2.5-OmniLive:面向长期流式视频和音频交互的综合多模态系统

2.9K 175
68 mPLUG-DocOwl

mPLUG-DocOwl:用于文档理解的模块化多模态大语言模型

2.4K 154
69 KoBERT

韩语BERT预训练cased (KoBERT)

1.4K 377
70 mPLUG-Owl

mPLUG-Owl:强大的多模态大语言模型家族

2.5K 189
71 openchat

OpenChat:利用不完美数据推进开源语言模型

5.5K 429
72 Taiwan-LLM

台湾繁体中文大语言模型

1.4K 119
73 DeepSeek-V2

DeepSeek-V2:一个强大、经济且高效的混合专家语言模型

5.0K 550
74 Baichuan2

由百川智能技术开发的一系列大型语言模型

4.1K 294
75 Lumina-T2X

Lumina-T2X 是一个用于文本到任意模态生成的统一框架。

2.2K 98
76 large_concept_model

Large Concept Models: 在句子表示空间中的语言建模

2.4K 213
77 chatglm_finetuning

chatglm 6b 微调和 alpaca 微调

1.5K 170
78 Baichuan-7B

由百川智能开发的大规模7B预训练语言模型。

5.6K 501
79 Skywork

Skywork系列模型在3.2TB高质量多语言(主要是中文和英文)和代码数据上预训练。我们已开源模型、训练数据、评估数据、评估方法等。

1.5K 148
80 TigerBot

TigerBot:一个多语言多任务的大语言模型

2.3K 188