#116 · 主分类: 自然语言处理与文本处理
textrank
TextRank 的 Python 3 实现。
项目最后更新:03/28/23
GitHub Stars
1.3K
Forks数量
246
贡献者数量
12
许可证
MIT
收录理由
TextRank 是经典的基于图的文本处理方法,用于从文档中提取最重要的句子和关键词。这个库用 Python 3 实现了该算法,代码简洁,API 也很精简:调用 summarizer.summarize() 可以生成摘要,用 keywords.keywords() 能抽出关键词,核心功能就这两个函数。它依托 NumPy 和 SciPy 在本地完成排序,不依赖语言模型,因此运行速度快、结果可复现,也不需要联网,很适合放在预处理流程、索引器或处理大批量文本的批处理任务中。另外还提供了命令行工具,可以直接处理文件。虽然它只专注做抽取式摘要,不是一个功能全面的平台,但对于想省去模型开销、快速集成到现有管线的团队来说,这个库用起来很顺手。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。