Alibaba
Qwen3.8 Omni Flash
最大コンテキスト
1M
最大出力
131.1K
リリース日
N/A
qwen3.5-flashQwen3.5 flash は、参照元で強調されている特徴として 高速 native vision-language Qwen3.5 variant を持ちます。主な価値は 単純な マルチモーダル tasks, 抽出, ルーティング and 高頻度呼び出し にあります。そのため、汎用チャットモデルとしてではなく、このモデル固有の強みを中心に説明するのが自然です。
Context Window
262.1K tokens
Maximum Output
65.5K tokens
Release Date
2026年2月23日
Modalities
| トークン階層 | 入力価格 | 出力価格 | キャッシュ作成 5m | キャッシュ読み取り 5m |
|---|---|---|---|---|
| <=128K | $0.0286/M | $0.2857/M | $0.0357/M | $0.0029/M |
| 128K-256K | $0.1143/M | $1.1429/M | $0.1429/M | $0.0114/M |
| >256K | $0.1714/M | $1.7143/M | $0.2143/M | $0.0171/M |
Reasoning
Tool calling
Temperature parameter
Attachments
Knowledge Base
Endpoint Protocols
Qwen3.5 Flashは、高速な推論、ネイティブなマルチモーダル理解、長文脈処理を組み合わせ、応答性が重要な本番ワークロードに対応します。
線形アテンションと疎なMoEを組み合わせた構成により、一般的なテキストおよびマルチモーダル性能を保ちながら高速に応答します。
テキスト、画像、動画を入力として受け取りテキストを生成するため、単一モデルで複数メディアを理解できます。
100万トークンのコンテキストにより、大規模文書、長い会話、多数の混合入力を分析できます。
Qwen3.5 Flashは、応答性の高いマルチモーダルアシスタント、迅速なコンテンツ処理、長文脈の情報確認に適しています。
顧客が提供したスクリーンショット、製品画像、短い動画を基に質問へ回答し、簡潔な案内文を生成します。
大量のテキストや視覚コンテンツを分類・要約し、重要情報を抽出して後続の確認工程へ渡します。
大規模な文書群や長い会話履歴を確認し、関連情報を見つけて要点をまとめます。
curl 'https://us-api.tokenhub.com/v1/messages' \
-X 'POST' \
-H "Authorization: Bearer $TOKENHUB_API_KEY"Qwen 3.5 Flash の能力、用途、制約、TokenHub利用ガイド。
Qwen 3.5 Flash は Alibaba Qwen の高速なマルチモーダル理解と大量処理向けモデルです。
大量リクエスト、画像・動画理解、一般対話に向き、特に速度と費用対効果重視の場面に適します。
主な強みは高速なマルチモーダル処理とPlus級に近い性能、および熟考と直接応答を切り替えられるハイブリッド思考です。
旧世代のため、後継モデルの新機能がありません。 最新機能が必要重視なら Qwen 3.6 Flash を検討してください。
TokenHub表示の正確なIDを使い、アカウント文書で現行機能を確認してください。
1つの API キーで Qwen3.5 Flash とその他の AI モデルにアクセスできます。
メディアと議論
このモデルに関連する公開動画と投稿を選んでいます。
X (Twitter)
Reddit
YouTube