返回新闻库
AI 市场快讯AWS ML Blog

NVIDIA Nemotron 3.5 Lightning 现已在 Amazon SageMaker JumpStart 上线

NVIDIA Nemotron 3.5 Lightning 是一款 30B MoE 模型(3B 激活参数),现已在 Amazon SageMaker JumpStart 上线,面向高并发智能体工作负载,可提供高达 4 倍的吞吐量,任务完成速度提升 30%。

111 词内容信号
AI 快讯

AWS ML Blog

NVIDIA Nemotron 3.5 Lightning 现已在 Amazon SageMaker JumpStart 上线

情报摘要

6
相关新闻
0
FAQ
1
来源

新闻解读

事件要点与影响

摘要

专为高并发智能体工作负载设计的开源模型 NVIDIA Nemotron 3.5 Lightning 现已在 Amazon SageMaker JumpStart 上线。该模型采用 30B Mixture-of-Experts 架构,激活参数仅 3B,可为常驻智能体带来高达 4 倍的吞吐量提升和 30% 的任务完成速度优化。

为何重要

智能体 AI 系统——持续运行并处理大量任务的自主智能体——需要能够高效扩展且不会产生高昂计算成本的模型。Nemotron 3.5 Lightning 的 Mixture-of-Experts 设计在每次推理中仅激活部分参数,从而实现大幅提升的吞吐量。其在 SageMaker JumpStart 上的可用性降低了 AWS 客户的部署门槛,无需从零开始管理基础设施即可部署生产级智能体工作负载。

相关工具

对 AI 工具/模型的影响

此次发布表明一个日益明显的趋势:专为智能体和自主工作负载优化的开源模型正进入主流云平台。NVIDIA 通过提供仅 3B 激活参数的 30B MoE 模型,证明了稀疏架构的效率优势可以惠及更广泛的开发者群体。这将加速此前因资源密集型而难以大规模部署的企业采用智能体 AI。

值得关注

  • SageMaker JumpStart 如何将 Nemotron 3.5 Lightning 集成到现有部署工作流
  • 其他云提供商是否会跟进推出类似的智能体优化模型
  • 社区基准测试对比 Nemotron 3.5 Lightning 与同类开源模型在实际智能体场景中的表现

探索更多 AI 工具 并持续关注最新 AI 新闻,获取模型发布和平台集成的持续报道。查看 排行榜 了解 Nemotron 3.5 Lightning 在生态中的表现。

常见问题

NVIDIA Nemotron 3.5 Lightning 是什么? 它是一款开源 30B Mixture-of-Experts 模型,激活参数 3B,专为高并发智能体工作负载设计。

在哪里可以使用? 现已可通过 Amazon SageMaker JumpStart 部署。

性能提升如何? 可为常驻智能体带来高达 4 倍的吞吐量提升和 30% 的任务完成速度优化。

继续追踪

相关新闻

新闻库
AWS ML Blog

AWS 向量解决方案:在您的数据所在地构建智能体 AI

AWS ML Blog

AWS 向量解决方案:在您的数据所在地构建智能体 AI

AWS 将向量搜索内置于现有数据库和存储服务中,无需独立向量数据库或数据迁移。涵盖六项服务、决策框架及客户案例。

AWS ML Blog

智能体数据操作平台(ADOP):数据工程缩短至数小时

AWS ML Blog

智能体数据操作平台(ADOP):数据工程缩短至数小时

AWS 推出 ADOP,这是基于 Amazon Bedrock 的智能体参考架构,可自动化青铜级到白银级到黄金级的数据流水线,通过内联治理将新数据源接入时间从数周缩短至数小时。

AWS ML Blog

使用Snowflake、Amazon SageMaker Canvas和Amazon Quick——第2部分:使用Amazon SageMaker Canvas进行数据准备和模型构建

AWS ML Blog

使用Snowflake、Amazon SageMaker Canvas和Amazon Quick——第2部分:使用Amazon SageMaker Canvas进行数据准备和模型构建

AWS发布了其无代码ML系列的第2部分,展示了如何将SageMaker Canvas连接到Snowflake,使用Data Wrangler准备交易数据,并无需编写代码即可训练XGBoost欺诈检测模型。

AWS ML Blog

使用查询感知压缩降低 Amazon Bedrock 上的 RAG 成本

AWS ML Blog

使用查询感知压缩降低 Amazon Bedrock 上的 RAG 成本

AWS 在 Amazon Bedrock 上推出了一种查询感知的上下文压缩模式,该模式使用较小的模型根据查询过滤检索到的文本块,在保持回答质量的同时减少输入 token 和 RAG 成本。

AWS ML Blog

我们如何构建 MCP 桥接,为 AgentCore 托管的 AI 代理提供本地 MCP 工具访问能力

AWS ML Blog

我们如何构建 MCP 桥接,为 AgentCore 托管的 AI 代理提供本地 MCP 工具访问能力

AWS 发布了一篇博客文章,详细介绍了他们如何构建 MCP 桥接,使 Amazon Bedrock AgentCore 云托管 AI 代理能够通过浏览器扩展和 Chrome 原生消息传递,经由 WebSocket 隧道安全调用用户笔记本电脑上的本地 MCP 服务器。

AWS ML Blog

在 Amazon Bedrock AgentCore 中通过自然语言编写 Dogwood 策略

AWS ML Blog

在 Amazon Bedrock AgentCore 中通过自然语言编写 Dogwood 策略

AWS 在 Amazon Bedrock AgentCore 中推出策略编写功能,将自然语言策略文档转换为具有时间约束的 Dogwood 策略,以在 AI 代理中强制执行组织控制。

站内探索

继续探索 AI 生态

看完这条新闻后,可以继续查看相关工具、模型和榜单,快速判断这件事对你的选择有没有影响。