#112 · 主分类: 自然语言处理与文本处理
NCRFpp
NCRF++,一个神经序列标注工具包。易于用于任何序列标注任务(如NER、POS、分词)。它包含字符LSTM/CNN、词LSTM/CNN和softmax/CRF组件。
项目最后更新:06/30/22
GitHub Stars
1.9K
Forks数量
436
贡献者数量
8
许可证
Apache-2.0
收录理由
NCRF++ 是一套基于 PyTorch 的序列标注工具包,专攻命名实体识别、词性标注与分词这类任务。它的特别之处在于,用户完全不用写训练循环——网络结构通过配置文件即可组装,字符级编码器(LSTM、GRU 或 CNN)与词级编码器自由搭配,推理层可选 softmax 或 CRF。若想引入人工特征,比如大小写信息或外部词性标签,也能直接混入模型;解码端支持 BIO 或 BIOES 标签体系,并输出带概率的 n-best 结果。这种设计让它在研究领域依然常被用作基线,背后有 ACL 2018 的演示论文和 COLING 2018 的最佳论文报告支撑。对想在自己标注数据上快速搭建标注模型的开发者来说,它仍然是一条省时省力的捷径。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。