← 模型库

Qwen/qwen/qwen3-next-80b-a3b-instruct

40B-100B持续维护
官方来源 ↗
发布日期 未标注·最后更新 08-09·数据来源 官方仓库 / 官网·已核对官方链接
这是你发布的模型吗?认领后可标注官方身份并长期维护主页信息。
任务类型对话模型
参数规模80B (MoE, 激活 3B)激活 3B
上下文长度262144
开源协议暂无可靠数据
商用情况暂无可靠数据
推荐显存暂无可靠数据
主要语言暂无可靠数据
本地部署未标注

模型介绍

中文速览

发布方 Qwen
上下文长度 262144

资料来源:DeepInfra 模型库,以下正文为官方原始说明。

本条目的官方说明为英文,以下内容保留原文,关键章节标题已中文标注。

Qwen/Qwen3-Next-80B-A3B-Instruct

Over the past few months, we have observed increasingly clear trends toward scaling both total parameters and context lengths in the pursuit of more powerful and agentic artificial intelligence (AI). We are excited to share our latest advancements in addressing these demands, centered on improving scaling efficiency through innovative model architecture. We call this next-generation foundation models Qwen3-Next.

  • 上下文长度:262,144 tokens
  • 最大输出:262,144 tokens
  • 标签:chat、reasoning_effort
  • 定价(每百万 token,USD):输入 $0.0900 / 输出 $1.1000
  • 提供方:Qwen
  • 来源:DeepInfra

适合场景

暂无可靠数据。

已知限制

  • MoE 架构:显存需按 总参数 准备,激活参数只影响推理速度,不减少常驻显存。
  • 本站未登记确切发布日期,版本时间线可能不完整。
  • 本页评测与硬件数据为区间估算,未做统一环境实测,不能替代官方评测报告。

评测

暂无可靠数据。本站只收录标注了「评测来源、模型版本、是否官方数据、测试日期」的成绩, 不混合不同设置下的分数,也不把单一 Benchmark 解释为整体能力。