#179 · 主分类: MLOps与评测

chatgpt-comparison-detection

ai chatbot chatgpt dataset deep-learning gpt-3 gpt2 gpt3 machine-learning ml nlp openai python text-classification

人类ChatGPT对比语料库(HC3)、检测器等等!🔥

项目最后更新:12/01/23

GitHub Stars

1.4K

Forks数量

128

贡献者数量

4

许可证

Other

收录理由

这个仓库的核心是HC3(Human ChatGPT Comparison Corpus),一个同时覆盖英文和中文的问答对比语料,把真人回答和ChatGPT生成的回答成对放在一起,来自论文《How Close is ChatGPT to Human Experts?》。作为早期专门用来衡量模型输出与人类写作差距的数据集,它从ELI5、维基百科以及医疗和金融问答等来源抽取样本,为检测机器生成文本提供了扎实的参照基础。仓库里还附带两个可用的检测器,一个是基于RoBERTa的分类器,另一个利用语言学特征,能对单段文本或问答对给出合理的判断基线。代码属于研究性质,不是拿来即用的生产接口,想用到具体场景时得自己微调模型,而语料本身更适合作为你搭建评测体系时的参考数据。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目