#17 · 主分类: 数据标注与标签工具
refinery
active-learning
annotations
artificial-intelligence
data-centric-ai
data-labeling
data-science
deep-learning
human-in-the-loop
labeling
labeling-tool
machine-learning
natural-language-processing
neural-search
nlp
python
spacy
supervised-learning
text-annotation
text-classification
transformers
数据科学家用于扩展、评估和维护自然语言数据的开源选择。将训练数据视为软件工件。
项目最后更新:12/09/24
GitHub Stars
1.5K
Forks数量
73
贡献者数量
11
许可证
Apache-2.0
收录理由
做 NLP 模型的数据科学家常常发现,真正的瓶颈不在算法,而在标注数据本身。Refinery 提供了一个基于 Web 的工作台,让你在浏览器里完成文本标注、复核并修正标签质量,同时保留每个数据集构建过程的完整记录。它把人工介入直接嵌入工作流:主动学习会挑出最需要标注的样本,自动检查则能标出不同标注者之间的分歧。当你要管理多位标注员,或者反复迭代数据集版本时,这套机制就把标注管理从导出 CSV 的临时操作,变成可重复、可审计的规范流程。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。