基础模型
开源大模型、微调工具链与基础模型相关生态。
共 113 个项目
排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。
| 排名 | 项目 | Stars | Forks | 更新 | 许可证 |
|---|---|---|---|---|---|
| 101 |
xlnet
XLNet:用于语言理解的广义自回归预训练 |
6.2K | 1.1K | 05/28/23 | Apache-2.0 |
| 102 |
kogpt
KakaoBrain KoGPT(韩语生成式预训练Transformer) |
1.0K | 135 | 01/30/24 | Other |
| 103 |
MetaTransformer
Meta-Transformer:用于统一多模态学习 |
1.6K | 116 | 12/05/23 | Apache-2.0 |
| 104 |
unit-minions
《AI 研发提效:自己动手训练 LoRA》,包含 Llama (Alpaca LoRA)模型、ChatGLM (ChatGLM Tuning)相关 Lora 的训练。训练内容:用户故事生成、测试代码生成、代码辅助生成、文本转 SQL、文本生成代码…… |
1.1K | 124 | 01/03/24 | Other |
| 105 |
Chinese-Llama-2-7b
开源社区第一个能下载、能运行的中文 LLaMA2 模型! |
2.2K | 196 | 10/26/23 | Apache-2.0 |
| 106 |
Baichuan-13B
由百川智能技术开发的13B大语言模型 |
2.9K | 229 | 09/06/23 | Apache-2.0 |
| 107 |
CoCa-pytorch
CoCa的PyTorch实现,对比字幕器是图像-文本基础模型。 |
1.2K | 89 | 12/12/23 | MIT |
| 108 |
long_llama
LongLLaMA是一种能够处理长上下文的大型语言模型,基于OpenLLaMA并使用Focused Transformer (FoT)方法进行微调。 |
1.5K | 84 | 11/07/23 | Apache-2.0 |
| 109 |
gpt2-ml
GPT2多语言版本,包含预训练模型,支持15亿参数的中文预训练模型。 |
1.7K | 325 | 05/22/23 | Apache-2.0 |
| 110 |
ru-gpts
俄语 GPT3 模型 |
2.1K | 433 | 12/12/22 | Apache-2.0 |
| 111 |
scibert
一个用于科学文本的BERT模型。 |
1.7K | 232 | 02/22/22 | Apache-2.0 |
| 112 |
pytorch-openai-transformer-lm
🐥一个PyTorch实现的OpenAI微调Transformer语言模型,包含导入OpenAI预训练权重的脚本。 |
1.5K | 285 | 08/09/21 | MIT |
| 113 |
gpt-2-Pytorch
使用OpenAI gpt-2 Pytorch实现的简单文本生成器 |
1.0K | 230 | 07/08/19 | MIT |