AI 圈大事记

NVIDIA发布Nemotron 3.5 Lightning模型,专攻Agen…

模型AI 评分 82/100OpenRouter:Announcements(RSS)待复核
AI 聚合

本条为 AI 依据下方公开信源自动整理生成的摘要,不构成转载,可能存在偏差,请以原文为准。整理者:贝果科技 AI 资讯助手

本条选题由第三方线索发现;线索方提供的摘要未被采用,本页内容依据下方信源整理。线索来源:AIHOT

NVIDIA发布专攻Agent高频执行步骤的Nemotron 3.5 Lightning模型。该模型采用混合Mamba-2、注意力与混合专家架构,总参数量300亿,每token激活30亿(30B-A3B)。其支持工具调用、编码与指令遵循,上下文最高达100万token。OpenRouter标准版提供26.2万token上下文,免费版支持100万token上下文及最高6.5万token输出。该模型与负责复杂规划的Nemotron 3 Ultra分工不同,影响整体运行成本与延迟。模型采用OpenMDW-1.1协议,已于2026年8月11日发布。

为什么值得看

专为Agent高频执行设计的30B-A3B架构,以极低激活参数量实现高容量,大幅降低多步调用成本与延迟。

信源1

  1. [1]OpenRouter:Announcements(RSS)线索来自 AIHOTOpenRouter 解读 NVIDIA Nemotron 3.5 Lightning 如何承担 Agent 高频执行调用

关键事实

  • Nemotron 3.5 Lightning总参数300亿,每token激活约30亿参数(30B-A3B)。[1]

  • 该模型采用混合Mamba-2、注意力机制与混合专家架构。[1]

  • OpenRouter免费版提供100万token上下文及最高6.5万token输出,标准版提供26.2万token上下文。[1]

  • 模型于2026年8月11日发布,采用OpenMDW-1.1许可协议。[1]

相关 · 模型

本页内容由 AI 自动聚合公开信源生成,仅供了解行业动态参考,不构成任何投资或决策建议。如需引用请以原文出处为准。