模型雷达

AI 模型库:从模型能力到产品选择

聚焦可自托管、可研究、可二次开发的开源模型。

模型索引

6

当前筛选为开源模型

模型分类入口

从主题切入,更快找到适合当前任务的模型

模型档案

开源模型

6 个模型

不确定该看哪个模型?可以先按开源状态、模型类型和关键词筛选,再进入详情页查看能力、许可证、适用场景和相关工具。

google-t5

google-t5/t5-small · Hugging Face

T5-small 是由 Google 开发并托管在 Hugging Face 上的紧凑型多语言编码器-解码器 Transformer 模型。该模型采用 Apache 2.0 许可证,支持翻译、摘要和问答等多种语言的文本到文本生成任务,包括英语、法语、德语和罗马尼亚语。它针对低延迟推理以及在各种硬件后端上的高效部署进行了优化。

开源transformers

BAAI

BGE Reranker v2 M3

BGE Reranker v2 M3 是一个基于 XLM-RoBERTa 的多语言重排序模型,旨在通过重新排序候选文档来提高搜索相关性。它支持 100 多种语言,并在跨语言检索任务上实现了最先进的性能。

开源sentence-transformers

Ollama

qwen2.5

Qwen2.5 是阿里巴巴集团旗下通义实验室开发的一系列大型语言模型,可通过 Ollama 进行本地部署。该系列包含从 0.5B 到 72B 的不同参数量级,支持长达 128K token 的上下文窗口,并具备涵盖 29 多种语言的_multilingual_ 能力。与前任模型 Qwen2 相比,Qwen2.5 在编程、数学、指令遵循以及结构化输出生成方面均有显著提升。

开源

Ollama

qwen2.5

Qwen2.5 是阿里巴巴开发的一系列大型语言模型,基于高达18万亿个token进行预训练,支持多语言和高达128K token的上下文窗口。提供从0.5B到72B参数的多种规模,通过Ollama优化了本地部署。

开源

FacebookAI

xlm roberta base

XLM-RoBERTa 是一个多语言 Transformer 模型,在 100 种语言的 2.5TB 过滤 CommonCrawl 数据上预训练。它是 RoBERTa 的跨语言变体,旨在同时处理多种语言的文本。拥有 2.78 亿参数,在 XNLI 和 MLQA 等跨语言基准测试中达到最先进水平。该模型在 Hugging Face 上可用,下载量超过 2070 万,支持填充掩码任务。

开源transformers

sentence-transformers

paraphrase multilingual MiniLM L12 v2

paraphrase-multilingual-MiniLM-L12-v2 是一个句子转换模型,针对多语言句子相似度和释义检测进行了微调。它将句子映射到384维的密集向量空间,可用于聚类、语义搜索和释义挖掘等任务。该模型支持50多种语言,基于微软的MiniLM架构。

开源sentence-transformers