#89 · 主分类: 自然语言处理与文本处理
jieba-rs
chinese-word-segmentation
jieba
jieba-chinese
nlp
wasm
用Rust实现的结巴中文分词
项目最后更新:08/10/26
GitHub Stars
976
Forks数量
65
贡献者数量
24
许可证
MIT
收录理由
做中文文本处理,分词往往是绕不开的第一步。jieba-rs 用 Rust 重新实现了社区里广为熟悉的 Jieba 分词器,默认内置词典即可直接切词,还提供可选的 TF-IDF 与 TextRank 关键词提取,适合标签生成、搜索联想和轻量级摘要这类任务。它的 API 精简,偏向确定性的规则分词,不依赖重型神经网络模型,那些从原版 Jieba 迁移过来的团队可以很自然地替换底层实现,不必推翻已有流程。此外,项目为 Node.js、Python、PHP 和 WebAssembly 提供了绑定,在混合技术栈中也能保持一致的分词行为。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。