#106 · 主分类: 自然语言处理与文本处理

primeqa

ai bert dpr ibm ibm-research-ai language-model machine-learning natural-language-processing neural-information-retrieval neural-search nlp python pytorch question-answering semantic-search squad transfer-learning

最先进的多语言问答研究与开发的主要仓库。

项目最后更新:09/18/25

GitHub Stars

739

Forks数量

57

贡献者数量

64

许可证

Apache-2.0

收录理由

PrimeQA 把多语言问答的完整链路都收在了一个代码库里,而不是只给一个现成模型。它既支持 BM25 这类传统检索,也支持 ColBERT、DPR 等神经检索,检索结果再交给抽取式或生成式阅读理解模块,这样从检索到回答的整套流程都能在同一套代码里搭起来。项目基于 Hugging Face 的 Transformers 和 datasets 构建,预训练模型和评测数据可以直接下载,想在自己的文档上做微调,跑一次常规训练流程就行。研究者可以复现最新 NLP 论文里的实验,而其中的问题生成和表格问答功能,也让工具的应用范围超出了纯文本段落。一个代码库能覆盖这么多环节,确实少见。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目