返回模型库
模型情报档案开源

codellama

Code Llama 是一款基于 Llama 2 构建的最先进的大型语言模型,用于代码生成和理解。它提供三种规模(7B、13B、34B)和三种变体(基础版、Python版、指令版)。该模型可以生成代码、补全代码以及回答关于代码的自然语言问题。它设计为通过 Ollama 在本地运行。

内容深度
186

词级内容信号

覆盖分类
1

用于主题聚类和内链

索引状态
已发布

2026年6月26日

深度解读

模型概览与适用场景

概述

Code Llama 是 Meta AI 发布的一系列用于代码的大型语言模型。它基于 Llama 2,并在代码特定数据集上进行了微调。该模型有三种规模:7B、13B 和 34B 参数。每种规模有三种变体:基础模型(Code Llama)、Python 专用版本(Code Llama - Python)和指令跟随版本(Code Llama - Instruct)。7B 和 13B 模型还支持中间填充(FIM)功能,允许它们在提示中间插入代码。

Code Llama 设计为在消费级硬件上本地运行。7B 模型可以在单个 GPU 上运行,而 34B 模型需要更强大的硬件。该模型支持多种编程语言,包括 Python、C++、Java、PHP、TypeScript、C#、Bash 等。

能力

  • 代码生成:根据自然语言描述生成代码。
  • 代码补全:补全部分代码片段。
  • 代码填充:在文件中间填充缺失的代码(FIM 模式)。
  • 代码解释:用自然语言解释代码。
  • 调试:帮助识别和修复错误。
  • 文档生成:为代码生成文档。
  • 多语言支持:支持多种流行编程语言。
  • 指令跟随:指令变体可以遵循与代码相关的任务的指令。

用例

  • 辅助编码:在 IDE 或终端中用作编码助手。
  • 学习:帮助初学者理解代码和学习编程。
  • 代码审查:分析代码中的潜在问题。
  • 自动化:生成样板代码或脚本。
  • 教育:创建编程练习和解释。
  • 研究:实验代码生成和理解。

许可与部署

Code Llama 根据自定义商业许可发布,允许用于研究和商业目的。该许可要求任何使用该模型的行为必须遵守可接受的使用政策。该模型可以使用 Ollama 本地部署,Ollama 简化了在个人机器上运行 LLM 的过程。要使用 Ollama 运行 Code Llama,请使用命令 ollama run codellama。该模型也可以在 Hugging Face 上获取,并可与 Transformers 等其他框架一起使用。

替代品

  • StarCoder:一个 15B 参数的代码训练模型,具有宽松的许可。
  • CodeGen:Salesforce 的一系列代码生成模型。
  • GPT-4:具有强大代码能力的专有模型。
  • Claude:Anthropic 的具有代码理解能力的模型。
  • CodeBERT:用于代码理解任务的模型。

常见问题

问:Code Llama 变体之间有什么区别? 答:Code Llama 基础版用于通用代码任务,Code Llama - Python 专用于 Python,Code Llama - Instruct 针对指令跟随进行了微调。

问:我可以在我的笔记本电脑上运行 Code Llama 吗? 答:可以,7B 模型可以在具有足够 RAM 和 GPU 的笔记本电脑上运行。34B 模型需要更多资源。

问:Code Llama 可以免费使用吗? 答:可以,根据自定义许可,它可免费用于研究和商业用途。

问:如何使用 Ollama 运行 Code Llama? 答:安装 Ollama 后,在终端中运行 ollama run codellama 即可。

问:Code Llama 支持哪些编程语言? 答:它支持 Python、C++、Java、PHP、TypeScript、C#、Bash 等。

问:Code Llama 支持中间填充吗? 答:是的,7B 和 13B 模型支持 FIM。

问:官方仓库在哪里? 答:官方模型权重可在 Hugging Face 上获取:https://huggingface.co/codellama

继续发现

相关 AI 模型

模型库

lpiccinelli

lpiccinelli/unidepth-v2-vitl14 · Hugging Face

UniDepth v2 (ViT-L/14) 是一个拥有 0.4B 参数的 PyTorch 模型,用于单目度量深度估计,利用视觉 Transformer 骨干网络从单个 RGB 图像中预测具有尺度感知的深度图。

开源UniDepth

Qwen

Qwen/Qwen3-8B · Hugging Face

Qwen/Qwen3-8B 是由阿里云通义千问团队开发的拥有 80 亿参数的大型语言模型,在 Hugging Face 上以 Apache 2.0 许可证发布。该模型专为高级文本生成、对话式 AI 和复杂推理任务设计,支持工具使用和长上下文理解。

开源transformers

google-t5

google-t5/t5-small · Hugging Face

T5-small 是由 Google 开发并托管在 Hugging Face 上的紧凑型多语言编码器-解码器 Transformer 模型。该模型采用 Apache 2.0 许可证,支持翻译、摘要和问答等多种语言的文本到文本生成任务,包括英语、法语、德语和罗马尼亚语。它针对低延迟推理以及在各种硬件后端上的高效部署进行了优化。

开源transformers

Qwen

Qwen3 0.6B

Qwen3 0.6B 是阿里云 Qwen3 系列中的紧凑型文本生成模型,专为高效对话式 AI 和语言任务设计。拥有 6 亿参数,平衡了性能与资源使用,支持多语言和长上下文长度。

开源transformers

Ollama

llava

LLaVA(大型语言与视觉助手)是一种多模态AI模型,它将视觉编码器与大型语言模型(LLM)相结合,以执行涉及图像和文本的任务。它可以理解图像、回答关于图像的问题、生成描述,并进行视觉对话。该模型可通过Ollama进行本地部署。

开源

BAAI

bge small en v1.5

BGE Small EN v1.5 是 BAAI 开发的一款紧凑型句子嵌入模型,针对英文文本进行了优化。拥有 3300 万参数,兼顾效率与性能,支持语义搜索、聚类和分类等任务。已被广泛采用,下载量超过 6100 万。

开源sentence-transformers

站内探索

继续探索 ToolSeekAI

从模型档案跳转到工具、新闻和排行榜,形成更完整的 AI 决策路径。