Qwen3.5 35B-A3B

qwen3.5-35b-a3b

Qwen3.5 35B A3B được các nguồn nhấn mạnh ở các điểm: 35B A3B MoE, hybrid linear attention, sparse experts. Giá trị chính của mô hình nằm ở efficient đa phương thức suy luận and lập trình without dense-model cost. Vì vậy phần mô tả nên tập trung vào điểm khác biệt riêng của mô hình thay vì viết như một chatbot phổ thông.

Context Window

262.1K tokens

Maximum Output

65.5K tokens

Release Date

23 thg 2, 2026

Modalities

Giá Qwen3.5 35B-A3B

Bậc tokenGiá đầu vàoGiá đầu ra
<=128K$0.0571/M$0.4571/M
>128K$0.2286/M$1.8286/M

Khả năng API của Qwen3.5 35B-A3B

Reasoning

Supported

Tool calling

Supported

Temperature parameter

Supported

Attachments

Supported

Knowledge Base

—

Endpoint Protocols

geminiCompletions APIMessages API

Điểm nổi bật của Qwen3.5-35B-A3B

Qwen3.5-35B-A3B kết hợp thiết kế MoE thưa hiệu quả, hiểu đa phương thức nguyên bản và triển khai trọng số mở cho các ứng dụng linh hoạt.

Hiệu quả MoE thưa

Mô hình có tổng cộng 35 tỷ tham số, kích hoạt 3 tỷ tham số và kết hợp chú ý Gated DeltaNet với các chuyên gia thưa để suy luận hiệu quả.

Đa phương thức nguyên bản

Nền tảng thị giác-ngôn ngữ thống nhất xử lý văn bản, hình ảnh và video cho suy luận, hiểu tài liệu và các tác vụ thị giác.

Triển khai trọng số mở

Trọng số chính thức theo giấy phép Apache 2.0 hỗ trợ suy luận tự quản lý bằng các framework như Transformers, vLLM và SGLang.

Trường hợp sử dụng Qwen3.5-35B-A3B

Qwen3.5-35B-A3B phù hợp với trợ lý đa phương thức tự lưu trữ, xử lý tài liệu trực quan và quy trình lập trình linh hoạt.

Trợ lý đa phương thức riêng tư

Triển khai trọng số mở trong hạ tầng được kiểm soát để trả lời câu hỏi về văn bản, hình ảnh và video nội bộ.

Xử lý tài liệu trực quan

Đọc văn bản, bảng và sơ đồ trong hình ảnh tài liệu, trích xuất trường liên quan và tạo bản tóm tắt có cấu trúc.

Quy trình lập trình

Tạo và chỉnh sửa mã, điều tra lỗi và tích hợp mô hình vào công cụ phát triển hoặc tác tử tự quản lý.

Cách sử dụng Qwen3.5 35B-A3B qua API TokenHub

Create API key

Replace these path values before running: {model}

curl 'https://us-api.tokenhub.com/v1beta/models/{model}:generateContent' \
  -X 'POST' \
  -H "Authorization: Bearer $TOKENHUB_API_KEY"

Benchmark của Qwen3.5 35B-A3B

Điểm chỉ số
Artificial Analysis Intelligence IndexĐánh giá tổng hợp năng lực chung23.4
Artificial Analysis Coding IndexĐánh giá tổng hợp năng lực lập trình16.8
Kiến thức và suy luận
GPQAGiải quyết vấn đề khoa học nâng cao81.9%
HLEBộ đề chuyên gia đa lĩnh vực12.8%
Lập trình và kỹ thuật phần mềm
SciCodeThử thách lập trình khoa học29.3%
Terminal-Bench HardThực thi tác vụ terminal nâng cao10.6%
Tuân thủ hướng dẫn và tác vụ tác nhân
IFBenchTuân thủ ràng buộc trong câu lệnh44.5%
AA-LCRSuy luận trên ngữ cảnh dài55.3%
τ²-BenchTác vụ quy trình của tác nhân86.3%

Nguồn chỉ số Artificial Analysis

Truyen Thong Va Thao Luan

Tuyen chon video va bai dang cong khai lien quan den mo hinh nay.

X (Twitter)

View post on X
View post on X
View post on X

Reddit

YouTube

Watch on YouTube
Watch on YouTube
Watch on YouTube

Câu hỏi thường gặp về Qwen 3.5 35B A3B

Năng lực, trường hợp dùng, giới hạn và hướng dẫn TokenHub cho Qwen 3.5 35B A3B.

Đội ngũ nên hiểu Qwen 3.5 35B A3B ra sao?+

Qwen 3.5 35B A3B là mô hình của Alibaba Qwen cho suy luận đa phương thức mở và triển khai hiệu quả.

Qwen 3.5 35B A3B phù hợp nhất với việc gì?+

Phù hợp với triển khai tự lưu trữ, suy luận thị giác và hỗ trợ lập trình thường ngày, nhất là khi ưu tiên quyền kiểm soát triển khai.

Thế mạnh chính của Qwen 3.5 35B A3B là gì?+

Thế mạnh chính: biến thể MoE mở với số tham số hoạt động nhỏ cùng chế độ suy nghĩ lai chuyển giữa cân nhắc sâu và trả lời trực tiếp.

Qwen 3.5 35B A3B luôn là lựa chọn tốt nhất?+

Đây là thế hệ cũ hơn và có thể thiếu các khả năng mới. Nếu ưu tiên cần khả năng mới nhất, hãy cân nhắc Qwen 3.6 35B A3B.

Thiết lập an toàn nhất là gì?+

Dùng đúng ID của TokenHub; bản lưu trữ có thể khác tự triển khai.

Sẵn sàng sử dụng Qwen3.5 35B-A3B?

Truy cập Qwen3.5 35B-A3B và nhiều mô hình AI khác bằng một khóa API TokenHub.

Tạo khóa API