#106 · 主分类: 自然语言处理与文本处理
primeqa
ai
bert
dpr
ibm
ibm-research-ai
language-model
machine-learning
natural-language-processing
neural-information-retrieval
neural-search
nlp
python
pytorch
question-answering
semantic-search
squad
transfer-learning
最先进的多语言问答研究与开发的主要仓库。
项目最后更新:09/18/25
GitHub Stars
739
Forks数量
57
贡献者数量
64
许可证
Apache-2.0
收录理由
PrimeQA 把多语言问答的完整链路都收在了一个代码库里,而不是只给一个现成模型。它既支持 BM25 这类传统检索,也支持 ColBERT、DPR 等神经检索,检索结果再交给抽取式或生成式阅读理解模块,这样从检索到回答的整套流程都能在同一套代码里搭起来。项目基于 Hugging Face 的 Transformers 和 datasets 构建,预训练模型和评测数据可以直接下载,想在自己的文档上做微调,跑一次常规训练流程就行。研究者可以复现最新 NLP 论文里的实验,而其中的问题生成和表格问答功能,也让工具的应用范围超出了纯文本段落。一个代码库能覆盖这么多环节,确实少见。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。