返回模型库
模型情报档案开源

BGE Reranker v2 M3

BGE Reranker v2 M3 是一个基于 XLM-RoBERTa 的多语言重排序模型,旨在通过重新排序候选文档来提高搜索相关性。它支持 100 多种语言,并在跨语言检索任务上实现了最先进的性能。

内容深度
151

词级内容信号

覆盖分类
1

用于主题聚类和内链

索引状态
已发布

2026年6月29日

深度解读

模型概览与适用场景

概述

BGE Reranker v2 M3 是由 BAAI 开发的交叉编码器重排序模型,基于 XLM-RoBERTa 架构。它是 BGE(BAAI 通用嵌入)系列的一部分,专门设计用于信息检索中的重排序任务。该模型以查询和文档对作为输入,输出相关性分数,从而实现更准确的搜索结果排序。拥有超过 1600 万次下载,被广泛应用于多语言和跨语言检索场景。

能力

  • 多语言支持:支持 100 多种语言,包括低资源语言,适用于全球应用。
  • 交叉编码器架构:通过联合编码查询和文档,提供比双编码器模型更高的准确性。
  • 最先进性能:在 BEIR、MIRACL 和多语言检索任务等基准测试中取得顶级结果。
  • 高效推理:针对文本嵌入推理进行了优化,并与 Hugging Face 管道兼容。
  • 许可证:Apache 2.0,允许商业使用。

使用场景

  • 企业搜索:提高多语言知识库和内部网的搜索相关性。
  • 电子商务:对不同语言的产品搜索结果进行重排序。
  • 法律与合规:从多语言法律数据库中检索相关文档。
  • 学术研究:增强科学论文的跨语言信息检索。
  • 聊天机器人与 RAG:在检索增强生成管道中对检索到的段落进行重排序。

许可证与部署

替代方案

  • Cohere Rerank:专有重排序 API,支持多语言。
  • Cross-Encoder/ms-marco-MiniLM-L-6-v2:轻量级仅英语重排序器。
  • BGE Reranker v2.0:更大变体,准确性更高但资源消耗更大。
  • Jina Reranker:开源多语言重排序器,性能有竞争力。

常见问题

问:BGE Reranker v2 M3 与其他 BGE 模型有何区别? 答:BGE Reranker v2 M3 是用于重排序的交叉编码器,而其他 BGE 模型(如 BGE Embedding)是用于生成嵌入的双编码器。M3 变体针对多语言和跨语言任务进行了优化。

问:我可以使用此模型生成嵌入吗? 答:不可以,该模型专门用于重排序。如需嵌入,请使用 BGE Embedding 模型,如 BAAI/bge-large-en-v1.5。

问:支持哪些语言? 答:该模型支持 100 多种语言,包括英语、中文、阿拉伯语、西班牙语、法语、德语等。它基于 XLM-RoBERTa。

问:如何使用该模型进行推理? 答:您可以使用 Hugging Face 管道:classifier = pipeline('text-classification', model='BAAI/bge-reranker-v2-m3')。输入格式:{"text": "query [SEP] document"}

问:该模型适合生产环境吗? 答:是的,它被广泛用于生产环境,下载量超过 1600 万次。可以使用 ONNX 或 TensorRT 进行部署以加快推理速度。

继续发现

相关 AI 模型

模型库

lpiccinelli

lpiccinelli/unidepth-v2-vitl14 · Hugging Face

UniDepth v2 (ViT-L/14) 是一个拥有 0.4B 参数的 PyTorch 模型,用于单目度量深度估计,利用视觉 Transformer 骨干网络从单个 RGB 图像中预测具有尺度感知的深度图。

开源UniDepth

Qwen

Qwen/Qwen3-8B · Hugging Face

Qwen/Qwen3-8B 是由阿里云通义千问团队开发的拥有 80 亿参数的大型语言模型,在 Hugging Face 上以 Apache 2.0 许可证发布。该模型专为高级文本生成、对话式 AI 和复杂推理任务设计,支持工具使用和长上下文理解。

开源transformers

google-t5

google-t5/t5-small · Hugging Face

T5-small 是由 Google 开发并托管在 Hugging Face 上的紧凑型多语言编码器-解码器 Transformer 模型。该模型采用 Apache 2.0 许可证,支持翻译、摘要和问答等多种语言的文本到文本生成任务,包括英语、法语、德语和罗马尼亚语。它针对低延迟推理以及在各种硬件后端上的高效部署进行了优化。

开源transformers

Qwen

Qwen3 0.6B

Qwen3 0.6B 是阿里云 Qwen3 系列中的紧凑型文本生成模型,专为高效对话式 AI 和语言任务设计。拥有 6 亿参数,平衡了性能与资源使用,支持多语言和长上下文长度。

开源transformers

Ollama

llava

LLaVA(大型语言与视觉助手)是一种多模态AI模型,它将视觉编码器与大型语言模型(LLM)相结合,以执行涉及图像和文本的任务。它可以理解图像、回答关于图像的问题、生成描述,并进行视觉对话。该模型可通过Ollama进行本地部署。

开源

BAAI

bge small en v1.5

BGE Small EN v1.5 是 BAAI 开发的一款紧凑型句子嵌入模型,针对英文文本进行了优化。拥有 3300 万参数,兼顾效率与性能,支持语义搜索、聚类和分类等任务。已被广泛采用,下载量超过 6100 万。

开源sentence-transformers

站内探索

继续探索 ToolSeekAI

从模型档案跳转到工具、新闻和排行榜,形成更完整的 AI 决策路径。