基础模型

开源大模型、微调工具链与基础模型相关生态。

共 113 个项目

排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。

第 101–113 项,共 113 个

排名 项目 Stars Forks
101 xlnet

XLNet:用于语言理解的广义自回归预训练

6.2K 1.1K
102 kogpt

KakaoBrain KoGPT(韩语生成式预训练Transformer)

1.0K 135
103 MetaTransformer

Meta-Transformer:用于统一多模态学习

1.6K 116
104 unit-minions

《AI 研发提效:自己动手训练 LoRA》,包含 Llama (Alpaca LoRA)模型、ChatGLM (ChatGLM Tuning)相关 Lora 的训练。训练内容:用户故事生成、测试代码生成、代码辅助生成、文本转 SQL、文本生成代码……

1.1K 124
105 Chinese-Llama-2-7b

开源社区第一个能下载、能运行的中文 LLaMA2 模型!

2.2K 196
106 Baichuan-13B

由百川智能技术开发的13B大语言模型

2.9K 229
107 CoCa-pytorch

CoCa的PyTorch实现,对比字幕器是图像-文本基础模型。

1.2K 89
108 long_llama

LongLLaMA是一种能够处理长上下文的大型语言模型,基于OpenLLaMA并使用Focused Transformer (FoT)方法进行微调。

1.5K 84
109 gpt2-ml

GPT2多语言版本,包含预训练模型,支持15亿参数的中文预训练模型。

1.7K 325
110 ru-gpts

俄语 GPT3 模型

2.1K 433
111 scibert

一个用于科学文本的BERT模型。

1.7K 232
112 pytorch-openai-transformer-lm

🐥一个PyTorch实现的OpenAI微调Transformer语言模型,包含导入OpenAI预训练权重的脚本。

1.5K 285
113 gpt-2-Pytorch

使用OpenAI gpt-2 Pytorch实现的简单文本生成器

1.0K 230
< 上一页
/ 6
下一页 >