#205 · 主分类: MLOps与评测
factool
FacTool:生成式AI的事实性检测
项目最后更新:08/19/24
GitHub Stars
934
Forks数量
67
贡献者数量
5
许可证
Apache-2.0
收录理由
用过ChatGPT的人,多半见过它一本正经地给出完全错误的答案,FacTool正是冲着这个问题来的。它给生成文本加了一道核查工序,覆盖四类输出:知识问答、代码、数学推理和科学文献。一套库就能同时揪出幻觉事实、跑不通的代码、计算失误,以及根本不存在却像模像样的论文引用。安装走pip,在Python里调一下,它返回结构化报告,逐条列出论断、证据和事实性评分,放进评测或QA流程里很顺手,不只是一个演示。还配了ChatGPT插件,对话界面里也能直接做同样的校验;同仓库的Halu-J模型则负责基于批判的幻觉打分。想给对话或生成内容加护栏的话,这个工具值得常备。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
unsloth
本地UI,用于运行和训练LLM及扩散模型。支持GGUF、MLX、Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、FLUX等。
LlamaFactory
统一高效微调100+大语言模型与视觉语言模型(ACL 2024)
airflow
Apache Airflow - 一个以编程方式编写、调度和监控工作流的平台
langfuse
🪢 开源AI工程平台:LLM评估、可观测性、指标、提示管理、游乐场、数据集。与OpenTelemetry、LangChain、OpenAI SDK、LiteLLM等集成。🍊YC W23
netron
神经网络、深度学习和机器学习模型的可视化工具