#162 · 主分类: 自然语言处理与文本处理

meta

c-plus-plus graph-algorithms inverted-index language-modeling nlp nlp-parsing pos-tag search-engine text-analysis text-analytics text-classification word-embeddings

现代C++数据科学工具包

项目最后更新:04/17/23

GitHub Stars

716

Forks数量

240

贡献者数量

12

许可证

MIT

收录理由

MeTA 把文本分析与检索流程中的各个环节收拢到一个 C++ 库中,省去在多个独立工具之间来回拼接的麻烦。它支持分词(含句法树等深层语义特征)、带压缩的倒排与正排索引及多种排序函数、主题模型、分类算法、语言模型,还实现了用于词性标注和浅层句法分析的 CRF。内置 liblinear 与 libsvm 的封装,并支持 UTF-8 多语言处理,便于直接嵌入已有的研究或生产代码。由于是以编译链接方式使用的库,它更适合习惯原生 C++ 开发的工程师,而非想要开箱即用服务的团队。项目附带 Doxygen 文档和教程,若在研究中采用,还有一篇 ACL 演示论文可供引用。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目