返回模型库
模型情报档案开源

BERT base uncased

BERT base uncased 是一个基于Transformer的模型,通过掩码语言建模和下一句预测在大型英文语料库上进行预训练。它拥有1.1亿参数,旨在针对各种NLP任务进行微调。

内容深度
79

词级内容信号

覆盖分类
1

用于主题聚类和内链

索引状态
已发布

2026年6月29日

深度解读

模型概览与适用场景

概述

BERT(来自Transformer的双向编码器表示)base uncased 是由Google开发的预训练自然语言处理模型。它是“基础”版本(1.1亿参数),采用不区分大小写的文本(小写并去除重音标记)。该模型在BooksCorpus(8亿词)和英文维基百科(25亿词)上使用两个目标进行训练:掩码语言建模(15%的标记被掩码)和下一句预测。它采用Transformer架构,包含12层、768个隐藏维度和12个注意力头。

能力

  • 填充掩码:预测句子中被掩码的标记。
  • 特征提取:生成单词/句子的上下文嵌入。
  • 微调:可适应分类、问答、命名实体识别等任务。
  • 多语言:主要针对英语,但微调后也可用于其他语言。
  • 模型大小:1.1亿参数,适合中等计算资源。

使用场景

  • 文本分类(情感分析、主题标注)
  • 命名实体识别(NER)
  • 问答系统
  • 文本摘要
  • 句子相似度/释义检测
  • 为下游模型提取特征

许可与部署

  • 许可:Apache 2.0
  • 部署:可通过Hugging Face Transformers、PyTorch、TensorFlow、JAX、ONNX、CoreML和Rust使用。可部署在CPU/GPU、云端或边缘设备。
  • 官方仓库https://github.com/google-research/bert

替代模型

  • BERT large uncased:更大版本(3.4亿参数),精度更高。
  • RoBERTa:优化BERT训练(更多数据、动态掩码)。
  • DistilBERT:更小、更快的蒸馏版本。
  • ALBERT:参数高效变体。
  • ELECTRA:使用判别器的高效预训练。

常见问题

问:“uncased”是什么意思? 答:模型将所有文本转换为小写并去除重音标记,因此“Apple”和“apple”被视为相同。

问:我可以将此模型用于英语以外的语言吗? 答:该模型在英语上训练,但微调后可能在一定程度上适用于其他语言。

问:如何微调此模型? 答:使用Hugging Face Trainer或自定义PyTorch/TF代码,并添加任务特定的输出层。

问:最大序列长度是多少? 答:512个标记。

问:有TensorFlow版本吗? 答:是的,该模型在TensorFlow、PyTorch和JAX中均可使用。

继续发现

相关 AI 模型

模型库

lpiccinelli

lpiccinelli/unidepth-v2-vitl14 · Hugging Face

UniDepth v2 (ViT-L/14) 是一个拥有 0.4B 参数的 PyTorch 模型,用于单目度量深度估计,利用视觉 Transformer 骨干网络从单个 RGB 图像中预测具有尺度感知的深度图。

开源UniDepth

Qwen

Qwen/Qwen3-8B · Hugging Face

Qwen/Qwen3-8B 是由阿里云通义千问团队开发的拥有 80 亿参数的大型语言模型,在 Hugging Face 上以 Apache 2.0 许可证发布。该模型专为高级文本生成、对话式 AI 和复杂推理任务设计,支持工具使用和长上下文理解。

开源transformers

google-t5

google-t5/t5-small · Hugging Face

T5-small 是由 Google 开发并托管在 Hugging Face 上的紧凑型多语言编码器-解码器 Transformer 模型。该模型采用 Apache 2.0 许可证,支持翻译、摘要和问答等多种语言的文本到文本生成任务,包括英语、法语、德语和罗马尼亚语。它针对低延迟推理以及在各种硬件后端上的高效部署进行了优化。

开源transformers

Qwen

Qwen3 0.6B

Qwen3 0.6B 是阿里云 Qwen3 系列中的紧凑型文本生成模型,专为高效对话式 AI 和语言任务设计。拥有 6 亿参数,平衡了性能与资源使用,支持多语言和长上下文长度。

开源transformers

Ollama

llava

LLaVA(大型语言与视觉助手)是一种多模态AI模型,它将视觉编码器与大型语言模型(LLM)相结合,以执行涉及图像和文本的任务。它可以理解图像、回答关于图像的问题、生成描述,并进行视觉对话。该模型可通过Ollama进行本地部署。

开源

BAAI

bge small en v1.5

BGE Small EN v1.5 是 BAAI 开发的一款紧凑型句子嵌入模型,针对英文文本进行了优化。拥有 3300 万参数,兼顾效率与性能,支持语义搜索、聚类和分类等任务。已被广泛采用,下载量超过 6100 万。

开源sentence-transformers

站内探索

继续探索 ToolSeekAI

从模型档案跳转到工具、新闻和排行榜,形成更完整的 AI 决策路径。