#72 · 主分类: 基础模型

Taiwan-LLM

langauge-model llm taiwan traditional-mandarin twllm

台湾繁体中文大语言模型

项目最后更新:04/20/25

GitHub Stars

1.4K

Forks数量

119

贡献者数量

12

许可证

Apache-2.0

收录理由

市面上多数中文大模型以简体中文和大陆语言习惯为默认设定,台湾地区使用繁体中文的族群往往得不到充分的模型支持。Taiwan-LLM 系列模型专门针对繁体中文与英语数据进行微调,并深入考虑台湾本地的用语习惯与文化脉络,其中 Llama-3-Taiwan-70B 以 700 亿参数规模在繁体中文自然语言处理基准上取得了领先成绩。这个仓库同时也是一套可操作的实用工具包:提供 Axolotl 微调配置、线上演示入口与模型权重下载链接,并公开了与医疗、制造、法律等不同领域机构的合作记录,让开发团队能基于自身业务场景继续调整模型,而非从零开始训练通用底座。需要留意的是,该项目属于研究级软件,若要在生产环境中依赖它,建议先用自有数据做充分验证。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目