#179 · 主分类: MLOps与评测
chatgpt-comparison-detection
人类ChatGPT对比语料库(HC3)、检测器等等!🔥
项目最后更新:12/01/23
GitHub Stars
1.4K
Forks数量
128
贡献者数量
4
许可证
Other
收录理由
这个仓库的核心是HC3(Human ChatGPT Comparison Corpus),一个同时覆盖英文和中文的问答对比语料,把真人回答和ChatGPT生成的回答成对放在一起,来自论文《How Close is ChatGPT to Human Experts?》。作为早期专门用来衡量模型输出与人类写作差距的数据集,它从ELI5、维基百科以及医疗和金融问答等来源抽取样本,为检测机器生成文本提供了扎实的参照基础。仓库里还附带两个可用的检测器,一个是基于RoBERTa的分类器,另一个利用语言学特征,能对单段文本或问答对给出合理的判断基线。代码属于研究性质,不是拿来即用的生产接口,想用到具体场景时得自己微调模型,而语料本身更适合作为你搭建评测体系时的参考数据。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
unsloth
本地UI,用于运行和训练LLM及扩散模型。支持GGUF、MLX、Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、FLUX等。
LlamaFactory
统一高效微调100+大语言模型与视觉语言模型(ACL 2024)
airflow
Apache Airflow - 一个以编程方式编写、调度和监控工作流的平台
langfuse
🪢 开源AI工程平台:LLM评估、可观测性、指标、提示管理、游乐场、数据集。与OpenTelemetry、LangChain、OpenAI SDK、LiteLLM等集成。🍊YC W23
netron
神经网络、深度学习和机器学习模型的可视化工具