#75 · 主分类: MLOps与评测

mteb

benchmark bitext-mining clustering embeddings evaluation information-retrieval low-resource-nlp mteb multilingual-nlp multimodal neural-search reranking retrieval sbert semantic-search sentence-transformers sts text-classification text-embedding

MTEB:跨语言和模态的嵌入最先进评估

项目最后更新:08/29/26

GitHub Stars

3.4K

Forks数量

681

贡献者数量

331

许可证

Apache-2.0

收录理由

选嵌入模型做检索或搜索时,通常只能听厂商宣传,MTEB给了你一个验证的办法。它把几百个评测任务收拢到一个轻量接口里,覆盖文本、图像、音频以及多种语言,几行Python或一条CLI命令就能让同一个模型跑完检索、重排、语义相似度和聚类测试,不用自己搭评测框架。公开排行榜能看出新发布的模型处在什么水平,标准套件不够用时也能添加自己的任务或数据集。对发布或使用嵌入模型的团队来说价值很大,因为结果可复现、可横向比较。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目