← 模型库

nvidia/nvidia/nemotron-3-super-120b-a12b

100B 以上持续维护
发布日期 未标注·最后更新 08-09·数据来源 社区补充·待核实
这是你发布的模型吗?认领后可标注官方身份并长期维护主页信息。
入选场景榜📄 长文本 52.5
任务类型基座模型
参数规模120B (MoE, 激活 12B)激活 12B
上下文长度1000000
开源协议暂无可靠数据
商用情况暂无可靠数据
推荐显存暂无可靠数据
主要语言暂无可靠数据
本地部署未标注

模型介绍

中文速览

发布方 nvidia
上下文长度 262144

资料来源:DeepInfra 模型库,以下正文为官方原始说明。

本条目的官方说明为英文,以下内容保留原文,关键章节标题已中文标注。

nvidia/NVIDIA-Nemotron-3-Super-120B-A12B

NVIDIA Nemotron 3 Super is a hybrid Mixture-of-Experts (MoE) model engineered for highest compute efficiency and accuracy in multi-agent applications and specialized agentic systems. It is optimized to run many collaborating agents per application on a single GPU, delivering high accuracy for reasoning, tool use, and instruction following.

  • 上下文长度:262,144 tokens
  • 最大输出:262,144 tokens
  • 标签:chat、reasoning
  • 定价(每百万 token,USD):输入 $0.0850 / 输出 $0.4000
  • 提供方:nvidia
  • 来源:DeepInfra

适合场景

暂无可靠数据。

已知限制

  • MoE 架构:显存需按 总参数 准备,激活参数只影响推理速度,不减少常驻显存。
  • 本站未登记确切发布日期,版本时间线可能不完整。
  • 本页评测与硬件数据为区间估算,未做统一环境实测,不能替代官方评测报告。

评测

暂无可靠数据。本站只收录标注了「评测来源、模型版本、是否官方数据、测试日期」的成绩, 不混合不同设置下的分数,也不把单一 Benchmark 解释为整体能力。