#41 · 主分类: 自然语言处理与文本处理
prose
:book: 一个用于文本处理的 Golang 库,包括分词、词性标注和命名实体提取。
项目最后更新:07/29/26
GitHub Stars
3.1K
Forks数量
170
贡献者数量
12
许可证
Other
收录理由
prose 是一个用纯 Go 编写的文本处理库,专注于分词、句子切分、词性标注和命名实体识别等经典自然语言处理任务。它不依赖 cgo,也不调用外部服务,因此 Go 团队可以轻松地将 NLP 能力集成到自己的进程中,而无需把文本发送给 Python 服务或云端 API。在实际使用中,一个很实用的设计是:每个返回的词元、句子和实体都带有原始文本中的字节偏移量,即使输入包含多字节字符或格式不规则的空白,你也能准确追溯到每个结果的来源位置。此外,库支持按需导入,比如只做词性标注的程序不会加载实体识别模型,从而减小二进制体积;各个组件也能安全地用于并发场景。对于需要构建搜索索引、计算可读性分数或做文档预处理的 Go 开发者来说,这是一个干净、依赖少的基础工具。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。