#198 · 主分类: MLOps与评测
MultiBench
[NeurIPS 2021] 多模态表示学习的多尺度基准
项目最后更新:01/27/24
GitHub Stars
636
Forks数量
100
贡献者数量
17
许可证
MIT
收录理由
多模态模型的对比常常因为各实验室的配置五花八门而难以进行,MultiBench 正是为了解决这一痛点而诞生的。它一口气整合了 15 个数据集,覆盖情感计算、医疗健康、机器人、金融、人机交互和多媒体等多个领域,并且评估时不止看准确率,还会记录训练和推理的开销,以及模型在模态噪声或缺失情况下的表现。配套的 MultiZoo 工具包以模块化形式提供了大约 20 种融合方法、目标函数和训练结构,研究者可以自由替换组件,不必每次从头实现所有基线。对于追求可复现对比的团队来说,这套组合非常实用,而且项目文档详细说明了如何添加新数据集和新算法,扩展起来也很顺手,能适配你自己的研究问题。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
unsloth
本地UI,用于运行和训练LLM及扩散模型。支持GGUF、MLX、Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、FLUX等。
LlamaFactory
统一高效微调100+大语言模型与视觉语言模型(ACL 2024)
airflow
Apache Airflow - 一个以编程方式编写、调度和监控工作流的平台
langfuse
🪢 开源AI工程平台:LLM评估、可观测性、指标、提示管理、游乐场、数据集。与OpenTelemetry、LangChain、OpenAI SDK、LiteLLM等集成。🍊YC W23
netron
神经网络、深度学习和机器学习模型的可视化工具