模型分类入口
从主题切入,更快找到适合当前任务的模型
模型档案
最新模型
不确定该看哪个模型?可以先按开源状态、模型类型和关键词筛选,再进入详情页查看能力、许可证、适用场景和相关工具。
Qwen
Qwen/Qwen3-8B · Hugging Face
Qwen/Qwen3-8B 是由阿里云通义千问团队开发的拥有 80 亿参数的大型语言模型,在 Hugging Face 上以 Apache 2.0 许可证发布。该模型专为高级文本生成、对话式 AI 和复杂推理任务设计,支持工具使用和长上下文理解。
Qwen
Qwen3 0.6B
Qwen3 0.6B 是阿里云 Qwen3 系列中的紧凑型文本生成模型,专为高效对话式 AI 和语言任务设计。拥有 6 亿参数,平衡了性能与资源使用,支持多语言和长上下文长度。
Ollama
llava
LLaVA(大型语言与视觉助手)是一种多模态AI模型,它将视觉编码器与大型语言模型(LLM)相结合,以执行涉及图像和文本的任务。它可以理解图像、回答关于图像的问题、生成描述,并进行视觉对话。该模型可通过Ollama进行本地部署。
BAAI
bge small en v1.5
BGE Small EN v1.5 是 BAAI 开发的一款紧凑型句子嵌入模型,针对英文文本进行了优化。拥有 3300 万参数,兼顾效率与性能,支持语义搜索、聚类和分类等任务。已被广泛采用,下载量超过 6100 万。
Ollama
nomic嵌入文本
nomic-embed-text 是 Nomic AI 开发的文本嵌入模型,可通过 Ollama 本地部署。它生成高质量的文本向量表示,针对语义搜索、聚类和分类任务进行了优化。该模型支持最多8192个令牌,专为高效本地推理设计。
Ollama
Mistral
Mistral 是由 Mistral AI 开发的 73 亿参数语言模型,旨在通过 Ollama 实现高效的本地部署。它在推理、编程和多语言任务上表现出色,采用宽松的 Apache 2.0 许可证。
BAAI
bge m3
BGE-M3 是 BAAI 开发的多语言嵌入模型,支持密集、稀疏和多向量检索,上下文长度达 8192 个 token。
google-bert
BERT base uncased
BERT base uncased 是一个基于Transformer的模型,通过掩码语言建模和下一句预测在大型英文语料库上进行预训练。它拥有1.1亿参数,旨在针对各种NLP任务进行微调。
Qwen
Qwen3 4B
Qwen3 4B 是阿里云 Qwen 团队推出的 40 亿参数文本生成模型,属于 Qwen3 系列。它专为高效推理和微调而设计,支持多种语言和任务。下载量超过 1600 万次,广泛应用于聊天机器人、内容生成和代码辅助。采用 Apache 2.0 许可,可在 Azure 上部署,并兼容 Hugging Face 端点。
Ollama
phi3
Phi-3 是微软开发的一系列小型语言模型(SLM),针对本地部署进行了优化,在推理、编程和数学任务上表现出色。提供 3.8B 和 14B 参数版本,可通过 Ollama 在消费级硬件上高效运行。
Ollama
llama3.3
Llama 3.3 是由 Meta 开发的拥有 700 亿参数的多语言大型语言模型。它是更大的 Llama 3.1 405B 模型的高效替代方案,在提供相当性能的同时显著降低了计算需求。该模型针对指令微调和对齐进行了优化,支持八种语言,并具备 128K 的上下文窗口,适用于复杂推理、代码生成和多语言应用。
Microsoft
Phi-4
Phi-4 是微软推出的紧凑型开源推理模型,强调效率和可部署性。
Ollama
Llama 3.3
Llama 3.3 是 Meta 推出的 70B 参数多语言大语言模型,专为指令调优对话优化。其性能与 Llama 3.1 405B 模型相当,但体积显著更小,适合通过 Ollama 进行本地部署,支持 128K 上下文窗口。
Stability AI
SDXL 1.0
SDXL 1.0 是被广泛使用的开源图像生成模型,适合自托管创意和商业实验。
DeepSeek
DeepSeek R1
DeepSeek R1 是深度求索推出的推理向大模型系列,在数学与代码任务上表现突出。
Alibaba
Qwen2.5-VL 72B
Qwen2.5-VL 72B 是适合视觉理解、文档解析和图像密集场景的开源多模态模型。
Black Forest Labs
FLUX.1 Dev
FLUX.1 Dev 是热门的开放权重图像模型,适合探索自托管创意流程的团队。
Meta
Llama 3.3 70B
Llama 3.3 70B 是高能力开源权重模型,常见于自托管和合作云部署场景。
Mistral AI
Mixtral 8x22B Instruct
Mixtral 8x22B Instruct 是适合自托管对话和编程场景的大型开源 MoE 模型。
Alibaba
Qwen2.5 72B Instruct
Qwen2.5 72B Instruct 是大参数开源模型,兼顾中英双语、编程能力和企业部署灵活性。