#116 · 主分类: 自然语言处理与文本处理

textrank

keywords natural-language-processing nlp python summarization text-summarization textrank

TextRank 的 Python 3 实现。

项目最后更新:03/28/23

GitHub Stars

1.3K

Forks数量

246

贡献者数量

12

许可证

MIT

收录理由

TextRank 是经典的基于图的文本处理方法,用于从文档中提取最重要的句子和关键词。这个库用 Python 3 实现了该算法,代码简洁,API 也很精简:调用 summarizer.summarize() 可以生成摘要,用 keywords.keywords() 能抽出关键词,核心功能就这两个函数。它依托 NumPy 和 SciPy 在本地完成排序,不依赖语言模型,因此运行速度快、结果可复现,也不需要联网,很适合放在预处理流程、索引器或处理大批量文本的批处理任务中。另外还提供了命令行工具,可以直接处理文件。虽然它只专注做抽取式摘要,不是一个功能全面的平台,但对于想省去模型开销、快速集成到现有管线的团队来说,这个库用起来很顺手。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目