模型分类入口
从主题切入,更快找到适合当前任务的模型
模型档案
开源模型
不确定该看哪个模型?可以先按开源状态、模型类型和关键词筛选,再进入详情页查看能力、许可证、适用场景和相关工具。
openai
clip vit base patch32
CLIP(对比语言-图像预训练)由OpenAI开发,是一个在4亿图像-文本对上训练的神经网络。ViT-B/32变体使用补丁大小为32的视觉变换器。它通过计算图像和文本嵌入之间的相似度实现零样本图像分类。
开源transformers
timm
mobilenetv3_small_100.lamb_in1k
MobileNetV3 Small(100%宽度)是一种轻量级、高效的卷积神经网络,用于图像分类,在ImageNet-1k上使用LAMB优化器预训练。它在准确率和计算量之间取得了良好的平衡,非常适合移动和边缘设备。
开源timm
Stability AI
SDXL 1.0
SDXL 1.0 是被广泛使用的开源图像生成模型,适合自托管创意和商业实验。
开源3.5BOpen weights发布 2023-07-26
Alibaba
Qwen2.5-VL 72B
Qwen2.5-VL 72B 是适合视觉理解、文档解析和图像密集场景的开源多模态模型。
开源72BApache 2.0发布 2025-01-27
Black Forest Labs
FLUX.1 Dev
FLUX.1 Dev 是热门的开放权重图像模型,适合探索自托管创意流程的团队。
开源12BNon-commercial open weights发布 2024-08-01