模型雷达

AI 模型库:从模型能力到产品选择

跟踪主流 AI 模型的开发者、参数规模、许可证与使用场景。

模型索引

30

覆盖模型详情页和相关内链

模型分类入口

从主题切入,更快找到适合当前任务的模型

模型档案

最新模型

30 个模型

不确定该看哪个模型?可以先按开源状态、模型类型和关键词筛选,再进入详情页查看能力、许可证、适用场景和相关工具。

Qwen

Qwen/Qwen3-8B · Hugging Face

Qwen/Qwen3-8B 是由阿里云通义千问团队开发的拥有 80 亿参数的大型语言模型,在 Hugging Face 上以 Apache 2.0 许可证发布。该模型专为高级文本生成、对话式 AI 和复杂推理任务设计,支持工具使用和长上下文理解。

开源transformers

Qwen

Qwen3 0.6B

Qwen3 0.6B 是阿里云 Qwen3 系列中的紧凑型文本生成模型,专为高效对话式 AI 和语言任务设计。拥有 6 亿参数,平衡了性能与资源使用,支持多语言和长上下文长度。

开源transformers

Ollama

llava

LLaVA(大型语言与视觉助手)是一种多模态AI模型,它将视觉编码器与大型语言模型(LLM)相结合,以执行涉及图像和文本的任务。它可以理解图像、回答关于图像的问题、生成描述,并进行视觉对话。该模型可通过Ollama进行本地部署。

开源

BAAI

bge small en v1.5

BGE Small EN v1.5 是 BAAI 开发的一款紧凑型句子嵌入模型,针对英文文本进行了优化。拥有 3300 万参数,兼顾效率与性能,支持语义搜索、聚类和分类等任务。已被广泛采用,下载量超过 6100 万。

开源sentence-transformers

Ollama

nomic嵌入文本

nomic-embed-text 是 Nomic AI 开发的文本嵌入模型,可通过 Ollama 本地部署。它生成高质量的文本向量表示,针对语义搜索、聚类和分类任务进行了优化。该模型支持最多8192个令牌,专为高效本地推理设计。

开源

Ollama

Mistral

Mistral 是由 Mistral AI 开发的 73 亿参数语言模型,旨在通过 Ollama 实现高效的本地部署。它在推理、编程和多语言任务上表现出色,采用宽松的 Apache 2.0 许可证。

开源

BAAI

bge m3

BGE-M3 是 BAAI 开发的多语言嵌入模型,支持密集、稀疏和多向量检索,上下文长度达 8192 个 token。

开源sentence-transformers

google-bert

BERT base uncased

BERT base uncased 是一个基于Transformer的模型,通过掩码语言建模和下一句预测在大型英文语料库上进行预训练。它拥有1.1亿参数,旨在针对各种NLP任务进行微调。

开源transformers

Qwen

Qwen3 4B

Qwen3 4B 是阿里云 Qwen 团队推出的 40 亿参数文本生成模型,属于 Qwen3 系列。它专为高效推理和微调而设计,支持多种语言和任务。下载量超过 1600 万次,广泛应用于聊天机器人、内容生成和代码辅助。采用 Apache 2.0 许可,可在 Azure 上部署,并兼容 Hugging Face 端点。

开源transformers

Ollama

phi3

Phi-3 是微软开发的一系列小型语言模型(SLM),针对本地部署进行了优化,在推理、编程和数学任务上表现出色。提供 3.8B 和 14B 参数版本,可通过 Ollama 在消费级硬件上高效运行。

开源

Ollama

llama3.3

Llama 3.3 是由 Meta 开发的拥有 700 亿参数的多语言大型语言模型。它是更大的 Llama 3.1 405B 模型的高效替代方案,在提供相当性能的同时显著降低了计算需求。该模型针对指令微调和对齐进行了优化,支持八种语言,并具备 128K 的上下文窗口,适用于复杂推理、代码生成和多语言应用。

开源

Microsoft

Phi-4

Phi-4 是微软推出的紧凑型开源推理模型,强调效率和可部署性。

开源14BMIT发布 2024-12-12

Ollama

Llama 3.3

Llama 3.3 是 Meta 推出的 70B 参数多语言大语言模型,专为指令调优对话优化。其性能与 Llama 3.1 405B 模型相当,但体积显著更小,适合通过 Ollama 进行本地部署,支持 128K 上下文窗口。

开源

Stability AI

SDXL 1.0

SDXL 1.0 是被广泛使用的开源图像生成模型,适合自托管创意和商业实验。

开源3.5BOpen weights发布 2023-07-26

DeepSeek

DeepSeek R1

DeepSeek R1 是深度求索推出的推理向大模型系列,在数学与代码任务上表现突出。

开源671B MoE (distilled variants available)Open weights (see model card)发布 2025-01-20

Alibaba

Qwen2.5-VL 72B

Qwen2.5-VL 72B 是适合视觉理解、文档解析和图像密集场景的开源多模态模型。

开源72BApache 2.0发布 2025-01-27

Black Forest Labs

FLUX.1 Dev

FLUX.1 Dev 是热门的开放权重图像模型,适合探索自托管创意流程的团队。

开源12BNon-commercial open weights发布 2024-08-01

Meta

Llama 3.3 70B

Llama 3.3 70B 是高能力开源权重模型,常见于自托管和合作云部署场景。

开源70BLlama 3.3 Community License发布 2024-12-06

Mistral AI

Mixtral 8x22B Instruct

Mixtral 8x22B Instruct 是适合自托管对话和编程场景的大型开源 MoE 模型。

开源8x22B MoEApache 2.0发布 2024-04-10

Alibaba

Qwen2.5 72B Instruct

Qwen2.5 72B Instruct 是大参数开源模型,兼顾中英双语、编程能力和企业部署灵活性。

开源72BApache 2.0发布 2024-09-19