#162 · 主分类: 自然语言处理与文本处理
meta
c-plus-plus
graph-algorithms
inverted-index
language-modeling
nlp
nlp-parsing
pos-tag
search-engine
text-analysis
text-analytics
text-classification
word-embeddings
现代C++数据科学工具包
项目最后更新:04/17/23
GitHub Stars
716
Forks数量
240
贡献者数量
12
许可证
MIT
收录理由
MeTA 把文本分析与检索流程中的各个环节收拢到一个 C++ 库中,省去在多个独立工具之间来回拼接的麻烦。它支持分词(含句法树等深层语义特征)、带压缩的倒排与正排索引及多种排序函数、主题模型、分类算法、语言模型,还实现了用于词性标注和浅层句法分析的 CRF。内置 liblinear 与 libsvm 的封装,并支持 UTF-8 多语言处理,便于直接嵌入已有的研究或生产代码。由于是以编译链接方式使用的库,它更适合习惯原生 C++ 开发的工程师,而非想要开箱即用服务的团队。项目附带 Doxygen 文档和教程,若在研究中采用,还有一篇 ACL 演示论文可供引用。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。