#35 · 主分类: 提示词工程工具

ChainForge

ai evaluation large-language-models llmops llms prompt-engineering

一个用于对LLM提示进行实战测试的开源可视化编程环境。

项目最后更新:06/10/26

GitHub Stars

3.0K

Forks数量

255

贡献者数量

11

许可证

MIT

收录理由

ChainForge 提供了一个可视化数据流画布,让你能同时针对多个模型测试提示词,而无需在单个聊天窗口里逐个粘贴变体。你可以搭建提示模板,将其发送给一批大语言模型,或发送给同一模型的不同参数配置,再挂上评分函数(无论是手写 Python 还是由模型生成的起始代码),随后在提示排列和参数设置的维度上查看结果图表。这使它成为在正式锁定方案前,筛选提示变体和模型配置的实用工具。它并非托管的评测平台,因此你需要自带 API 密钥,若用于严肃工作,建议本地运行。对于希望以低代码方式开展提示实验的研究人员和小团队而言,它是替代手工编写比较脚本的不错选择。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目