#107 · 主分类: 自然语言处理与文本处理

nlu

bert-embedding dependency-parsing entity-resolution language-detection lemmatizer named-entity-recognition natural-language-understanding nlu pandas sentence-embeddings sentiment-analysis sentiment-classifier seq2seq spell-checker streamlit t5 text-classification text-summarization text-translation transformers

一行代码调用数千个最先进的NLP模型,支持数百种语言,解决文本问题最快最准确的方法。

项目最后更新:01/28/25

GitHub Stars

967

Forks数量

139

贡献者数量

30

许可证

Other

收录理由

多数 NLP 库在动手之前,总得先拼管线、管模型对象,光是样板代码就劝退不少人。这个库换了个思路:调用 nlu.load() 传入模型名,就能直接应用到 DataFrame 的列上,文本处理被压缩成一行代码,省去大量繁琐的组装工作。它底层封装了 Spark NLP,让习惯用 pandas 的开发者也能接触到庞大的预训练组件库,覆盖实体识别、情感分析、翻译、向量表示、句法解析等任务,并且支持多种语言。其 Streamlit 集成也延续了这种极简理念,一条命令就能启动交互式演示,方便快速预览模型效果。如果团队原本就在 Spark NLP 生态内,这个库可能显得多余;但对以 pandas 为主、又想获得广泛 NLP 能力而不愿折腾底层细节的人来说,它确实是一个上手门槛很低的切入点。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目