/v1/chat/completionsQwen3.8 Max
qwen3.8-maxQwen3.8-Maxは、2.4TパラメータのMoEフラッグシップモデルで、高度な推論、コーディング、エンタープライズ生産性向けに設計されています。ソフトウェア開発から専門的なワークフローまで、複雑で長期にわたるタスクを自律的に実行し、法務、金融、デザインなどの分野で本番レベルの成果を提供します。ネイティブなマルチモーダルインテリジェンスにより、Qwen3.8-Maxは長いコンテキスト内のテキスト、画像、動画を理解し、広範なドキュメントや長文コンテンツの深い分析をサポートします。エージェント機能により、複雑なワークフロー全体で自律的な計画、実行、検証、継続的な反復を可能にします。
最大コンテキスト
1Mトークン
最大出力
128Kトークン
リリース日
2026年8月3日
モダリティ
Qwen3.8 Max の料金
| 入力価格 | 出力価格 | キャッシュ読み取り | キャッシュ作成 5m | キャッシュ読み取り 5m |
|---|---|---|---|---|
| $2/M | $6/M | $0.25/M | $2.5/M | $0.17/M |
Qwen3.8 Max を API 経由で使用するには?
/v1/responses/v1/messagesQwen3.8-Max よくある質問
Qwen3.8-Maxの機能、用途、料金、TokenHubでの利用方法に関する実用的な回答です。
Qwen3.8-Maxとは何ですか?+
Qwen3.8-Maxは、AlibabaのQwenチームによるフラッグシップのMixture-of-Expertsモデルです。テキスト、画像、動画を入力してテキストを出力し、総パラメータ数は2.4兆、活性化パラメータ数は950億と公表されています。
Qwen3.8-Maxはどのような用途に適していますか?+
高度なコーディング、長時間にわたるエージェント型ワークフロー、複雑な専門業務、長文書や動画のマルチモーダル分析に特に適しています。
Qwen3.8-Maxの主な強みは何ですか?+
100万トークンのコンテキスト、切り替え可能な思考モード、関数呼び出し、構造化出力、ウェブ検索やコード実行などの内蔵ツール、ネイティブな視覚理解が強みです。
Qwen3.8-Maxではどのようなトレードオフを考慮すべきですか?+
フラッグシップ性能は軽量なQwenモデルよりコストや処理時間が増える場合があります。長時間のエージェント実行では誤りと費用が積み重なる可能性があるため、予算とチェックポイントを設定し、重要な出力を確認してください。
TokenHubでQwen3.8-Maxを使うにはどうすればよいですか?+
TokenHubのモデル欄でqwen3.8-maxを選び、アカウントの認証情報を使ってTokenHubのエンドポイントへリクエストを送信します。本番利用前に、アカウント画面に表示される対応パラメータ、入力形式、制限を確認してください。
Qwen3.8-Maxの料金と提供状況はどうなっていますか?+
2026年8月時点で、QwenCloudのqwen3.8-max API料金は入力100万トークン当たり2米ドル、出力100万トークン当たり6米ドル、暗黙キャッシュ入力100万トークン当たり0.25米ドルです。TokenHubの提供状況と料金は異なる場合があるため、最新のモデルページを確認してください。
他のモデルではなくQwen3.8-Maxを選ぶべきなのはいつですか?+
複雑なコーディング、マルチモーダル推論、長時間のエージェント業務でQwenの最高性能が必要な場合に選びます。コスト重視ならqwen3.7-plusやqwen3.7-flashと比較し、代表的なタスクで品質、遅延、費用を評価してください。
Qwen3.8-Maxのメディアとデモ
Qwen3.8-Maxに関する公開発表、デモ、コミュニティ議論のセレクションです。
X (Twitter)
Reddit
YouTube