DeepSeek
DeepSeek V4.1 Flash
最大コンテキスト
1M
最大出力
384K
リリース日
N/A
deepseek-v4-flash-vision-expDeepSeek V4 Flash Vision Exp は、DeepSeek V4 Flash 0731 の実験的なビジョン対応版であり、画像理解機能を導入しつつ、ベースモデルのテキスト性能(エージェント機能、推論、世界知識を含む)を維持しています。スパース混合専門家(MoE)アーキテクチャに基づき、総パラメータ数は284B、アクティブパラメータ数は13Bです。
Context Window
1M tokens
Maximum Output
384K tokens
Release Date
2026年8月21日
Modalities
| 入力価格 | 出力価格 | キャッシュ読み取り |
|---|---|---|
| $0.2857/M | $1.1429/M | $0.0057/M |
Reasoning
Tool calling
Temperature parameter
Attachments
Knowledge Base
Endpoint Protocols
DeepSeek V4 Flash Vision Expは、画像理解とDeepSeek V4 Flashの推論、Agent、知識能力を組み合わせた実験的なマルチモーダルモデルです。
画像とテキストを同時に入力し、文章による依頼に沿って視覚情報を解釈できます。
テキスト能力はDeepSeek V4 Flashに準じ、推論、世界知識、Agent指向の問題解決を扱います。
視覚理解をAgentワークフローに組み込み、画像から得た情報を後続の判断に反映できます。
DeepSeek V4 Flash Vision Expは、スクリーンショットの理解、図表や文書の分析、視覚入力に基づいて判断するAgentに適しています。
アプリ画面を確認して表示状態を説明し、デバッグやユーザー支援に関係する要素を特定します。
文書画像から文字、表、グラフを読み取り、必要な内容を整理されたテキストに変換します。
画像から検出した情報を基に後続ツールを選び、問題を調査してテキスト形式の結論を作成します。
import OpenAI from "openai"
const client = new OpenAI({
apiKey: process.env.TOKENHUB_API_KEY,
baseURL: "https://us-api.tokenhub.com/v1",
})
const result = await client.responses.create({})
console.log(result.output_text)DeepSeek V4 Flash 0731 (Reasoning, Max Effort)
| 指数スコア | ||
|---|---|---|
| Artificial Analysis Intelligence Index | 総合能力の集約評価 | 51.8 |
| Artificial Analysis Coding Index | コーディング能力の集約評価 | 69.1 |
指標の出典 Artificial Analysis
TokenHubでDeepSeek V4 Flash Vision Expを評価・利用するための実用的な案内です。
DeepSeekの実験的なマルチモーダルモデルで、テキストと画像を入力し、テキストを出力します。V4 Flashファミリーの視覚対応モデルとして位置づけられています。
画像の説明、スクリーンショット内の文字の読み取り、グラフの分析、視覚情報と言語推論の両方を必要とするエージェント処理に適しています。
V4 Flashのテキスト能力とネイティブな画像理解を組み合わせている点が主な強みです。一般的なAPI形式でテキストと画像を混在させ、エージェント処理でツールと連携できます。
明確に実験版とされているため、本番利用前に信頼性を検証してください。画像は縮小されトークン化されるため細部の忠実度が下がる場合があり、重要な視覚的判断は人が確認すべきです。
TokenHubアカウントで利用可能な場合は、正確なモデルID deepseek-v4-flash-vision-exp とTokenHubのエンドポイントおよび認証情報を使用します。テキストと画像は、選択したTokenHub APIルートが対応する形式で送信してください。
DeepSeekはこの実験モデルをAPIプラットフォームで提供し、画像は縮小後に1枚あたり最大384トークンとしてV4 Flash料金で課金すると案内しています。TokenHubでの提供状況と料金は異なる場合があるため、導入前に最新のモデル一覧を確認してください。
画像が不可欠で、同じリクエスト内でV4 Flash系のテキスト能力とエージェント能力も使いたい場合に適しています。テキストのみ、細かな視覚認識、本番の重要処理では、実際の用途に近いテストで精度、遅延、安定性、コストを代替モデルと比較してください。
1つの API キーで DeepSeek V4 Flash Vision Exp とその他の AI モデルにアクセスできます。
DeepSeek V4 Flash Vision Expのメディアとデモ
DeepSeek V4 Flash Vision Expに関する確認済みの公開発表、API案内、デモ、コミュニティ議論です。
X (Twitter)
Reddit
YouTube