#35 · 主分类: MLOps与评测

iFixAi

agent-evaluation ai ai-alignment ai-evaluation ai-governance ai-safety cli diagnostic-tool eu-ai-act hallucination-detection iso-42001 llm-evaluation llm-security nist-ai-rmf owasp-llm prompt-injection python responsible-ai risk-assessment risk-management

独立审计AI代理。由人类或代理本身运行,回答AI代理经济中最关键的问题:代理是否在按预期行事?使用iFixAi,你可以在120秒内获得答案。

项目最后更新:08/28/26

GitHub Stars

11.4K

Forks数量

1.2K

贡献者数量

12

许可证

Apache-2.0

收录理由

现有的评测工具大多盯着延迟、token 效率这类技术指标,能告诉你智能体跑得多快,却回答不了它到底有没有干好该干的活。iFixAi 补上的正是这一环:一次运行执行 32 项检查,覆盖五个支柱,两分钟内给出 A 到 F 的评分。检查逻辑不绑定特定行业,你只需在 fixture 文件里描述角色、工具和策略,同一套流程就能适配医疗、金融或客服场景,不必假设一套通用技术栈。对已有评测体系的团队来说,这算是很自然的补充;它提供命令行和 Python 库两种形态,接入现有 CI 流程几乎不需要额外折腾。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目