#162 · 主分类: 自然语言处理与文本处理
uie_pytorch
PaddleNLP UIE模型的PyTorch版实现
项目最后更新:08/13/23
GitHub Stars
704
Forks数量
120
贡献者数量
1
许可证
Apache-2.0
收录理由
这个项目把PaddleNLP原生的通用信息抽取模型UIE迁移到了PyTorch生态,对处理中文文本、需要从杂乱文档中提取结构化信息的开发者来说非常实用。你只需用自然语言描述想要抽取的实体类型、关系、事件或观点目标,模型就能在零训练数据的情况下直接完成抽取,省去了大量标注成本。无论是医疗报告的结构化、法律判决书的信息整理、金融文件的条款提取,还是事故记录的分析,它都能派上用场。仓库里还提供了微调脚本,方便你用自己标注的数据适配特定场景,同时包含评估工具、doccano标注数据转换脚本,以及导出ONNX模型用于部署的完整流程。对于已经基于PyTorch和transformers构建技术栈的团队,这个项目让他们无需引入PaddlePaddle就能使用UIE的能力,而且提供了多个预训练检查点,覆盖通用、医疗和英文等不同变体,上手门槛低,落地路径清晰。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。