Qwen/qwen/qwen3.5-35b-a3b
20B-40B持续维护
任务类型多模态
参数规模35B (MoE, 激活 3B)激活 3B
上下文长度262144
开源协议暂无可靠数据
商用情况暂无可靠数据
推荐显存暂无可靠数据
主要语言暂无可靠数据
本地部署未标注
模型介绍
本条目的官方说明为英文,以下内容保留原文,关键章节标题已中文标注。
Qwen/Qwen3.5-35B-A3B
Qwen3.5-35B-A3B is an efficient Mixture-of-Experts model from Alibaba’s Qwen3.5 series with 35B total parameters and only 3B activated per token. It features a 262K token context window (extensible to 1M with YaRN), thinking/reasoning mode, tool calling, and support for 201 languages. Delivers strong performance on reasoning, coding, and vision-language tasks at a fraction of the compute cost.
- 上下文长度:262,144 tokens
- 最大输出:262,144 tokens
- 标签:chat、vlm、vision、prompt_cache、reasoning_effort、reasoning
- 定价(每百万 token,USD):输入 $0.1400 / 输出 $1.0000
- 提供方:Qwen
- 来源:DeepInfra
适合场景
暂无可靠数据。
已知限制
- MoE 架构:显存需按 总参数 准备,激活参数只影响推理速度,不减少常驻显存。
- 本站未登记确切发布日期,版本时间线可能不完整。
- 本页评测与硬件数据为区间估算,未做统一环境实测,不能替代官方评测报告。
评测
暂无可靠数据。本站只收录标注了「评测来源、模型版本、是否官方数据、测试日期」的成绩, 不混合不同设置下的分数,也不把单一 Benchmark 解释为整体能力。