#112 · 主分类: 自然语言处理与文本处理

NCRFpp

artificial-intelligence char-cnn char-rnn chunking cnn crf lstm lstm-crf named-entity-recognition natural-language-processing nbest ner neural-networks part-of-speech-tagger pytorch sequence-labeling

NCRF++,一个神经序列标注工具包。易于用于任何序列标注任务(如NER、POS、分词)。它包含字符LSTM/CNN、词LSTM/CNN和softmax/CRF组件。

项目最后更新:06/30/22

GitHub Stars

1.9K

Forks数量

436

贡献者数量

8

许可证

Apache-2.0

收录理由

NCRF++ 是一套基于 PyTorch 的序列标注工具包,专攻命名实体识别、词性标注与分词这类任务。它的特别之处在于,用户完全不用写训练循环——网络结构通过配置文件即可组装,字符级编码器(LSTM、GRU 或 CNN)与词级编码器自由搭配,推理层可选 softmax 或 CRF。若想引入人工特征,比如大小写信息或外部词性标签,也能直接混入模型;解码端支持 BIO 或 BIOES 标签体系,并输出带概率的 n-best 结果。这种设计让它在研究领域依然常被用作基线,背后有 ACL 2018 的演示论文和 COLING 2018 的最佳论文报告支撑。对想在自己标注数据上快速搭建标注模型的开发者来说,它仍然是一条省时省力的捷径。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目