Alibaba
Qwen3.8 Omni Flash
最大上下文
1M
最大輸出
131.1K
發布日期
暫無
qwen3.5-35b-a3bQwen3.5 35B A3B 是一个原生視覺语言 MoE 模型,目标是在较小啟用參數下接近更大模型的效果。模型卡強調混合线性注意力、稀疏专家,以及与更大 Qwen3.5 dense 版本相近的表现。它最適合被描述為兼顾效率、多模态推理和程式碼能力的輕量高效模型。
上下文視窗
262.1K Token
最大輸出
65.5K Token
發布日期
2026年2月23日
模態
| Token 階梯 | 輸入價格 | 輸出價格 |
|---|---|---|
| <=128K | $0.0571/M | $0.4571/M |
| >128K | $0.2286/M | $1.8286/M |
推理
工具呼叫
Temperature 參數
附件
知識庫
Endpoint 協議
Qwen3.5-35B-A3B 結合高效率稀疏 MoE、原生多模態理解與開放權重部署,適合建置可彈性調整的應用。
模型共有 350 億參數、每次啟用 30 億參數,並結合 Gated DeltaNet 注意力與稀疏專家以提升推論效率。
統一的視覺語言基礎可處理文字、影像與影片,用於推論、文件理解與視覺工作。
採用 Apache 2.0 授權的官方權重,可搭配 Transformers、vLLM 與 SGLang 等框架自行管理推論部署。
Qwen3.5-35B-A3B 適合自行託管的多模態助理、視覺文件處理與可調整的程式開發工作流程。
在受控基礎設施中部署開放權重,針對內部文字、影像與影片回答問題。
讀取文件影像中的文字、表格與圖示,擷取相關欄位並產生結構化摘要。
產生與修改程式碼、排查缺陷,並將模型整合至自行管理的開發工具或 Agent。
執行前請替換這些路徑參數: {model}
curl 'https://us-api.tokenhub.com/v1beta/models/{model}:generateContent' \
-X 'POST' \
-H "Authorization: Bearer $TOKENHUB_API_KEY"| 指數分數 | ||
|---|---|---|
| Artificial Analysis 綜合能力指數 | Artificial Analysis 綜合能力評分 | 23.4 |
| Artificial Analysis 程式碼能力指數 | Artificial Analysis 軟體任務評分 | 16.8 |
| 知識與推理 | ||
| GPQA | 高階科學問題求解 | 81.9% |
| HLE | 廣泛專家級考試集合 | 12.8% |
| 程式碼與工程 | ||
| SciCode | 科學計算程式碼挑戰 | 29.3% |
| Terminal-Bench Hard | 高難度終端任務執行 | 10.6% |
| 指令遵循與 Agent 任務 | ||
| IFBench | 指令約束遵循 | 44.5% |
| AA-LCR | 長上下文推理 | 55.3% |
| τ²-Bench | Agent 工作流程任務 | 86.3% |
指標來源 Artificial Analysis
Qwen 3.5 35B A3B 的能力、適用情境、限制與 TokenHub 使用指南。
Qwen 3.5 35B A3B 是 Alibaba Qwen 針對開放模型的多模態推理與高效率部署推出的模型。
適合自行託管部署、視覺推理、日常程式開發協助,尤其適合重視部署控制權的情境。
核心優勢是開放的 MoE 變體與較小的啟用參數規模,並具備可在深度思考與直接回應間切換的混合思考。
它屬於較早世代,可能缺少後續模型的新能力。 更重視需要最新能力時,可考慮 Qwen 3.6 35B A3B。
使用 TokenHub 的精確識別碼;託管行為可能與自行託管不同。
透過一個 API Key 接入 Qwen3.5 35B-A3B 與更多 AI 模型。
媒體與討論
精選與此模型相關的公開影片和貼文。
X (Twitter)
Reddit
YouTube