#17 · 主分类: 数据标注与标签工具

refinery

active-learning annotations artificial-intelligence data-centric-ai data-labeling data-science deep-learning human-in-the-loop labeling labeling-tool machine-learning natural-language-processing neural-search nlp python spacy supervised-learning text-annotation text-classification transformers

数据科学家用于扩展、评估和维护自然语言数据的开源选择。将训练数据视为软件工件。

项目最后更新:12/09/24

GitHub Stars

1.5K

Forks数量

73

贡献者数量

11

许可证

Apache-2.0

收录理由

做 NLP 模型的数据科学家常常发现,真正的瓶颈不在算法,而在标注数据本身。Refinery 提供了一个基于 Web 的工作台,让你在浏览器里完成文本标注、复核并修正标签质量,同时保留每个数据集构建过程的完整记录。它把人工介入直接嵌入工作流:主动学习会挑出最需要标注的样本,自动检查则能标出不同标注者之间的分歧。当你要管理多位标注员,或者反复迭代数据集版本时,这套机制就把标注管理从导出 CSV 的临时操作,变成可重复、可审计的规范流程。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目