#60 · 主分类: 自然语言处理与文本处理
cltk
ai
greek
historical-linguistics
latin
ling
nlp
nltk
python
spacy
stanza
古典语言工具包
项目最后更新:08/01/26
GitHub Stars
917
Forks数量
342
贡献者数量
124
许可证
MIT
收录理由
CLTK 是一个面向不再被日常使用的古代语言的 Python 自然语言处理库,重点覆盖拉丁语和古希腊语。它开箱即用地支持分词、词形还原、词性标注和依存句法分析,并通过统一的 NLP() 接口灵活切换后端:需要标准形态学分析时可用快速的 Stanza 后端,而 OpenAI 或本地 Ollama 管理的 LLM 后端则适合处理古典句法常让生成式标注变得棘手的问题。这种按需选择后端的架构能省去不少拼接代码的功夫——无论是搭建语料库检索工具、历史语法研究项目,还是课堂上的文本处理应用,每类任务都能选用最顺手的方法。对于想要达到学术级文本处理效果、又不愿从零手写包装层的开发者来说,这是一个实用且持续维护的选择。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。