#366 · 主分类: 计算机视觉

fashion-clip

clip ecommerce fashion multi-modal nlp nlp-machine-learning transformer

FashionCLIP是一个针对时尚领域微调的类似CLIP的模型。

项目最后更新:01/30/25

GitHub Stars

535

Forks数量

56

贡献者数量

4

许可证

MIT

收录理由

FashionCLIP 是一个针对时尚领域微调的 CLIP 风格视觉-语言模型,能够将商品图片与自由文本描述进行匹配,并直接执行零样本分类,无需为每个类别单独训练。对于电商搜索、商品打标或推荐功能来说,它是一个很实用的起点。仓库在 Hugging Face 上提供了微调后的权重,附带的 Colab 笔记本覆盖了特征提取、分类以及基于 RecList 的评估流程,还有一个 Streamlit 演示应用可以交互式测试。README 里还记录了切换到基于 LAION 的检查点(FashionCLIP 2.0)的过程,并给出了基准测试数据,方便你判断这次升级是否值得。如果团队规模不大,想要一个现成的领域多模态骨干模型,而不是从头训练,这个项目提供了很低的入门门槛。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目