返回模型库
模型情报档案开源

Mixtral

Mixtral 是 Mistral AI 发布的高质量稀疏混合专家(SMoE)模型,可通过 Ollama 本地部署。它在各种基准测试中表现出色,可与 GPT-3.5 等更大模型相媲美,同时由于其 MoE 架构而高效。

内容深度
205

词级内容信号

覆盖分类
1

用于主题聚类和内链

索引状态
已发布

2026年6月26日

深度解读

模型概览与适用场景

概述

Mixtral 是由 Mistral AI 开发的大型语言模型,旨在以计算效率提供高性能。它采用稀疏混合专家(SMoE)架构,每个 token 仅激活模型参数的一个子集,从而比同等规模的密集模型实现更快的推理和更低的资源消耗。该模型提供两种尺寸:Mixtral 8x7B(总参数 46.7B,但每个 token 仅激活 12.9B)和 Mixtral 8x22B(总参数 141B,激活 39B)。它支持 32,768 个 token 的上下文长度,并且是多语言的,在英语、法语、意大利语、德语和西班牙语方面表现出色。

Mixtral 根据 Apache 2.0 许可证发布,可免费用于研究和商业用途。可以使用 Ollama 通过命令 ollama run mixtral 在本地运行。该模型还提供指令调优版本(例如 Mixtral 8x7B Instruct),以更好地与用户提示对齐。

能力

  • 多语言支持:处理五种主要欧洲语言。
  • 长上下文:32k token 上下文窗口,用于处理大型文档。
  • 高效推理:MoE 架构降低了计算成本,同时保持高精度。
  • 强基准测试:在 MMLU、HellaSwag 和 GSM8K 等许多任务上优于 Llama 2 70B 和 GPT-3.5。
  • 指令遵循:微调版本(Instruct)擅长遵循复杂指令。
  • 代码生成:能够用多种编程语言生成代码。
  • 推理:展示出强大的逻辑推理和问题解决能力。

用例

  • 聊天机器人和虚拟助手:为具有自然语言理解的对话代理提供支持。
  • 内容生成:撰写文章、故事、电子邮件和营销文案。
  • 代码辅助:帮助开发人员进行代码补全、调试和解释。
  • 翻译:在支持的语言之间翻译文本。
  • 摘要:将长文档压缩为简洁摘要。
  • 教育:辅导、回答问题并解释概念。
  • 研究:分析数据、生成假设并协助文献综述。

许可证与部署

  • 许可证:Apache 2.0 – 允许免费使用、修改和分发,用于商业和非商业目的。
  • 部署:通过 Ollama 本地运行(ollama run mixtral)。也可在 Hugging Face 和通过 Mistral AI 的 API 获取。
  • 硬件要求:对于 Mixtral 8x7B,建议至少 32GB RAM;对于 8x22B,建议 64GB+ RAM。GPU 加速(例如支持 CUDA 的 NVIDIA)是可选的,但可加快推理速度。

替代方案

  • Llama 2/3:Meta 的开源模型(7B、13B、70B),具有类似能力但采用密集架构。
  • Mistral 7B:来自同一开发者的更小、更快的模型,适用于资源受限的环境。
  • Qwen 2:阿里巴巴的开源模型,具有强大的多语言支持。
  • Gemma:Google 的轻量级开源模型(2B、7B),用于高效部署。
  • GPT-3.5:OpenAI 的专有模型,可通过 API 访问,具有更广泛的语言支持。

常见问题

问:Mixtral 和 Mixtral Instruct 有什么区别? 答:Mixtral 是基础模型,而 Mixtral Instruct 针对指令遵循和聊天进行了微调,更适合对话应用。

问:我可以在 CPU 上运行 Mixtral 吗? 答:可以,但速度会较慢。为了获得合理的性能,建议 8x7B 模型使用至少 8GB VRAM 的 GPU。

问:Mixtral 是真正的开源吗? 答:是的,它根据 Apache 2.0 发布,允许免费使用、修改和商业部署。

问:Mixtral 与 GPT-4 相比如何? 答:Mixtral 比 GPT-4 更小且能力较弱,但就其尺寸而言提供了有竞争力的性能,并且可免费用于本地使用。

问:Mixtral 支持哪些语言? 答:英语、法语、意大利语、德语和西班牙语,对其他语言也有一定能力。

问:如何通过 Ollama 安装 Mixtral? 答:从 ollama.com 安装 Ollama,然后在终端中运行 ollama run mixtral

继续发现

相关 AI 模型

模型库

lpiccinelli

lpiccinelli/unidepth-v2-vitl14 · Hugging Face

UniDepth v2 (ViT-L/14) 是一个拥有 0.4B 参数的 PyTorch 模型,用于单目度量深度估计,利用视觉 Transformer 骨干网络从单个 RGB 图像中预测具有尺度感知的深度图。

开源UniDepth

Qwen

Qwen/Qwen3-8B · Hugging Face

Qwen/Qwen3-8B 是由阿里云通义千问团队开发的拥有 80 亿参数的大型语言模型,在 Hugging Face 上以 Apache 2.0 许可证发布。该模型专为高级文本生成、对话式 AI 和复杂推理任务设计,支持工具使用和长上下文理解。

开源transformers

google-t5

google-t5/t5-small · Hugging Face

T5-small 是由 Google 开发并托管在 Hugging Face 上的紧凑型多语言编码器-解码器 Transformer 模型。该模型采用 Apache 2.0 许可证,支持翻译、摘要和问答等多种语言的文本到文本生成任务,包括英语、法语、德语和罗马尼亚语。它针对低延迟推理以及在各种硬件后端上的高效部署进行了优化。

开源transformers

Qwen

Qwen3 0.6B

Qwen3 0.6B 是阿里云 Qwen3 系列中的紧凑型文本生成模型,专为高效对话式 AI 和语言任务设计。拥有 6 亿参数,平衡了性能与资源使用,支持多语言和长上下文长度。

开源transformers

Ollama

llava

LLaVA(大型语言与视觉助手)是一种多模态AI模型,它将视觉编码器与大型语言模型(LLM)相结合,以执行涉及图像和文本的任务。它可以理解图像、回答关于图像的问题、生成描述,并进行视觉对话。该模型可通过Ollama进行本地部署。

开源

BAAI

bge small en v1.5

BGE Small EN v1.5 是 BAAI 开发的一款紧凑型句子嵌入模型,针对英文文本进行了优化。拥有 3300 万参数,兼顾效率与性能,支持语义搜索、聚类和分类等任务。已被广泛采用,下载量超过 6100 万。

开源sentence-transformers

站内探索

继续探索 ToolSeekAI

从模型档案跳转到工具、新闻和排行榜,形成更完整的 AI 决策路径。