#89 · 主分类: 自然语言处理与文本处理

jieba-rs

chinese-word-segmentation jieba jieba-chinese nlp wasm

用Rust实现的结巴中文分词

项目最后更新:08/10/26

GitHub Stars

976

Forks数量

65

贡献者数量

24

许可证

MIT

收录理由

做中文文本处理,分词往往是绕不开的第一步。jieba-rs 用 Rust 重新实现了社区里广为熟悉的 Jieba 分词器,默认内置词典即可直接切词,还提供可选的 TF-IDF 与 TextRank 关键词提取,适合标签生成、搜索联想和轻量级摘要这类任务。它的 API 精简,偏向确定性的规则分词,不依赖重型神经网络模型,那些从原版 Jieba 迁移过来的团队可以很自然地替换底层实现,不必推翻已有流程。此外,项目为 Node.js、Python、PHP 和 WebAssembly 提供了绑定,在混合技术栈中也能保持一致的分词行为。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目