#72 · 主分类: 基础模型
Taiwan-LLM
台湾繁体中文大语言模型
项目最后更新:04/20/25
GitHub Stars
1.4K
Forks数量
119
贡献者数量
12
许可证
Apache-2.0
收录理由
市面上多数中文大模型以简体中文和大陆语言习惯为默认设定,台湾地区使用繁体中文的族群往往得不到充分的模型支持。Taiwan-LLM 系列模型专门针对繁体中文与英语数据进行微调,并深入考虑台湾本地的用语习惯与文化脉络,其中 Llama-3-Taiwan-70B 以 700 亿参数规模在繁体中文自然语言处理基准上取得了领先成绩。这个仓库同时也是一套可操作的实用工具包:提供 Axolotl 微调配置、线上演示入口与模型权重下载链接,并公开了与医疗、制造、法律等不同领域机构的合作记录,让开发团队能基于自身业务场景继续调整模型,而非从零开始训练通用底座。需要留意的是,该项目属于研究级软件,若要在生产环境中依赖它,建议先用自有数据做充分验证。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。