モデルハブ

1つの本番カタログで、AIモデルの価格、機能、エンドポイント、ベンダーカバレッジを確認できます。

OpenAI

GPT-6.1 Sol

gpt-6.1-sol

GPT-6.1 Sol は、複雑な問題解決、コーディング、エージェントベースのアプリケーション向けに構築された高度な推論モデルです。知能、速度、コストの実用的なバランスを保ちながら、強力な推論性能を提供するように設計されています。 主に応答生成に重点を置く従来のチャットモデルとは異なり、GPT-6.1 Sol は、マルチステップ推論、コード生成、デバッグ、データ分析、複雑な指示への追従など、より深い思考を必要とするタスクに最適化されています。 GPT-6.1 Sol は、信頼性の高い推論ワークフロー、構造化出力、ツールベースのアプリケーションをサポートし、AI アシスタント、コーディングエージェント、自動化システム、本番 AI アプリケーションを構築する開発者に適しています。

最大コンテキスト

1.1M

最大出力

128K

リリース日

2026年9月29日

入力$2 / 百万トークン
出力$10 / 百万トークン
キャッシュ読み取り$0.1 / 百万トークン

OpenAI

GPT-6.1 Sol Pro

gpt-6.1-sol-pro

GPT-6.1 Sol Pro は GPT-6.1 Sol の強化推論バージョンです。GPT-6.1 Sol と同じ基盤モデルを使用しますが、reasoning.mode=pro を有効にすることで、リクエストごとにはるかに多くの計算を費やせます。 追加の推論予算により、GPT-6.1 Sol Pro はより深い分析、長い計画、高い精度を必要とする難しい問題に対応できます。応答速度やコスト効率よりも、可能な限り最良の回答を得ることが重要なタスク向けに設計されています。 GPT-6.1 Sol と比較して、GPT-6.1 Sol Pro はリクエストごとにはるかに多くの推論トークンを消費するため、利用コストが高くなり、応答時間も長くなります。

最大コンテキスト

1.1M

最大出力

128K

リリース日

2026年9月29日

入力$2 / 百万トークン
出力$10 / 百万トークン
キャッシュ読み取り$0.1 / 百万トークン

Anthropic

Claude Sonnet 5.5

claude-sonnet-5.5

Claude Sonnet 5.5 は、高度な推論、コーディング、分析、複雑なエージェント型ワークフロー向けに設計された次世代 AI モデルです。ソフトウェア開発、長文コンテキストの理解、マルチモーダルタスク、専門的な知識業務で高い性能を発揮し、知能・速度・効率のバランスを兼ね備えています。推論能力の強化と指示追従性の向上により、コードの作成とデバッグ、複雑な文書の分析、多段階の問題解決、信頼性の高い意思決定とツール利用を要する AI エージェントの稼働に優れた力を発揮します。

最大コンテキスト

1M

最大出力

128K

リリース日

2026年9月28日

入力$2 / 百万トークン
出力$10 / 百万トークン
キャッシュ読み取り$0.2 / 百万トークン

xAI

Grok 4.7

grok-4.7

Grok 4.7 は、高度なコーディングタスク、複雑な推論、知識集約型アプリケーション向けに設計された xAI の最新世代モデルです。長期的な問題解決、自己検証、ワークフロー実行を強化し、インテリジェントアシスタントや AI 製品を開発するデベロッパーに適しています。 Grok 4.7 はプログラミング、分析、汎用 AI タスクで高い性能を発揮しながら、本番環境への導入に適した効率性も備えています。

最大コンテキスト

500K

最大出力

500K

リリース日

2026年9月21日

入力$1.6 / 百万トークン
出力$4.8 / 百万トークン
キャッシュ読み取り$0.4 / 百万トークン

Anthropic

Claude Opus 5.5

claude-opus-5.5

Claude Opus 5.5 は Anthropic のフラッグシップ知能モデルであり、深い推論、信頼性、長時間にわたるタスク実行を必要とする高負荷なワークロード向けに設計されています。ソフトウェアエンジニアリング、エージェント型ワークフロー、専門的な分析、知識集約型タスクにおいて高い性能を発揮します。 効率性の向上とセーフガードの強化により、Claude Opus 5.5 は、複雑なタスクで一貫した性能を必要とする高度な AI アプリケーションを開発するデベロッパー向けに最適化されています。

最大コンテキスト

1M

最大出力

128K

リリース日

2026年9月22日

入力$4 / 百万トークン
出力$20 / 百万トークン
キャッシュ読み取り$0.2 / 百万トークン

OpenAI

GPT-6 Sol

gpt-6-sol

GPT-6 Sol は、OpenAI の GPT-6 シリーズに属する高性能モデルで、複雑な推論タスク、ソフトウェア開発、プロフェッショナルな AI ワークフロー向けに設計されています。多段階の問題解決、高度なコーディング、データ分析、エージェントベースのアプリケーションにおいて、より高い知能を提供します。 GPT-6 Sol は強力な推論能力と効率的な推論処理を両立しており、本番環境の AI システムに最先端レベルの性能を求める開発者に適しています。

最大コンテキスト

1.1M

最大出力

128K

リリース日

2026年9月22日

入力$2 / 百万トークン
出力$10 / 百万トークン
キャッシュ読み取り$0.2 / 百万トークン

OpenAI

GPT-6 Sol Pro

gpt-6-sol-pro

GPT-6 Sol Pro は、GPT-6 Sol の推論強化版であり、より深い分析、高い精度、信頼性の高いマルチステップ実行を必要とするタスク向けに設計されています。 推論能力の向上により、GPT-6 Sol Pro はソフトウェアエンジニアリング、複雑なワークフロー、データ分析、AI エージェントアプリケーションでより優れた性能を発揮します。困難なタスクで一貫した結果を必要とする高度な AI システムを構築する開発者向けに最適化されています。 GPT-6 Sol Pro は長いコンテキスト処理、ツール呼び出し、構造化出力をサポートし、強力な推論と自動化が求められる本番グレードのアプリケーションに適しています。

最大コンテキスト

1.1M

最大出力

128K

リリース日

2026年9月22日

入力$2 / 百万トークン
出力$10 / 百万トークン
キャッシュ読み取り$0.2 / 百万トークン

OpenAI

GPT-6 Luna

gpt-6-luna

GPT-6 Luna は、OpenAI の GPT-6 ファミリーに属するコンパクトで効率的なモデルであり、大幅に改善されたコスト効率で強力な言語知能を提供するよう設計されています。会話型 AI、コンテンツ生成、コーディング支援、自動化ワークフローなど、日常的な AI アプリケーションで信頼性の高い性能を発揮します。大規模なコンテキストウィンドウと最適化された推論効率により、GPT-6 Luna は、高スループット、低レイテンシ、予測可能な運用コストを必要とするスケーラブルな AI 製品を開発する開発者に最適です。

最大コンテキスト

1.1M

最大出力

128K

リリース日

2026年9月22日

入力$0.1 / 百万トークン
出力$0.5 / 百万トークン
キャッシュ読み取り$0.01 / 百万トークン

OpenAI

GPT-6 Luna Pro

gpt-6-luna-pro

GPT-6 Luna Pro は GPT-6 Luna の推論最適化バージョンで、Luna ファミリーの効率と手頃な価格を維持しながら、より強力な問題解決能力を提供するよう設計されています。 標準の高速推論モデルと比べ、複雑な指示、コーディング作業、分析ワークフロー、軽量エージェントアプリケーションでの性能が向上しています。GPT-6 Luna Pro は、本番ワークロードの拡張性を保ちつつ、より高品質な応答を必要とする開発者に最適です。 長コンテキスト処理、関数呼び出し、構造化出力をサポートし、知性、速度、コスト効率のバランスを提供します。

最大コンテキスト

1.1M

最大出力

128K

リリース日

2026年9月22日

入力$0.1 / 百万トークン
出力$0.5 / 百万トークン
キャッシュ読み取り$0.01 / 百万トークン

Alibaba

Qwen3.8 Omni Flash

qwen3.8-omni-flash

Qwen3.8 Omni Flash は、Alibaba の Qwen ファミリーによる次世代オムニモーダルモデルで、テキスト、画像、音声、動画を統合 AI システム内で理解・処理できるよう設計されています。強力な言語知能と高度なマルチモーダル理解能力を組み合わせ、実世界の AI アプリケーションに対応します。 最大 100 万トークンのコンテキストウィンドウをサポートし、Qwen3.8 Omni Flash は長文書分析、マルチメディア理解、エージェント型ワークフローに最適化されています。複雑な音声・動画コンテンツを分析し、複数のモダリティをまたいで推論し、インテリジェントな AI アプリケーション構築のためのツール呼び出しをサポートします。 高効率なデプロイ向けに設計され、Qwen3.8 Omni Flash はマルチモーダル知能、拡張性、コスト効率の間で優れたバランスを提供し、次世代 AI アシスタント、コンテンツ分析システム、自動化エージェントを構築する開発者に適しています。

最大コンテキスト

1M

最大出力

131.1K

リリース日

2026年9月17日

入力$0.1143 / 百万トークン
出力$0.3857 / 百万トークン
キャッシュ読み取り$0.0143 / 百万トークン

TypeSafe

Jev 1.13

jev-1.13

Jev 1.13 は TypeSafe AI 初の System One 意思決定モデルで、テキスト生成ではなく構造化された AI 判断のために設計されています。提供されたコンテキストを分析し、構造化された選択肢、スコア、信頼度に基づく意思決定を返します。分類、ルーティング、評価、自動化ワークフロー向けに設計されており、Jev は低遅延と効率的なトークン使用で、高速で予測可能な AI 意思決定を実現します。

最大コンテキスト

32K

最大出力

N/A

リリース日

2026年9月18日

入力$0.042 / 百万トークン
出力$0 / 百万トークン

Z.ai

GLM-5.3-FlashX

glm-5.3-flashx

GLM-5.3-FlashX は Z.ai による高速マルチモーダルモデルで、GLM-5.3-Flash の中核能力を維持しつつ、高速で応答性の高い推論を実現するように設計されています。テキスト、画像、動画、ファイル入力に対応し、コンテキストウィンドウは最大 100 万トークンです。 コーディング、エージェントワークフロー、視覚理解、長コンテキストタスク、複雑な推論に優れ、速度と知性の両方が求められるリアルタイム AI アプリケーションに適しています。

最大コンテキスト

1M

最大出力

131.1K

リリース日

2026年9月18日

入力$0.2857 / 百万トークン
出力$1 / 百万トークン
キャッシュ読み取り$0.0814 / 百万トークン

DeepSeek

DeepSeek V4.1 Flash

deepseek-v4.1-flash

DeepSeek-V4.1-Flash は、高度な推論、コーディング、エージェント機能を備えた高速で効率的なマルチモーダル AI モデルです。最大 100 万トークンのコンテキストとネイティブな視覚理解をサポートし、より低い推論コストでフロンティア級の知能を提供します。AI エージェント、自動化、コーディングアシスタント、スケーラブルなアプリケーションに最適です。

最大コンテキスト

1M

最大出力

384K

リリース日

2026年9月10日

入力$0.2857 / 百万トークン
出力$1.1429 / 百万トークン
キャッシュ読み取り$0.0057 / 百万トークン

OpenAI

GPT-6 Astra

gpt-6-astra

GPT-6 Astra は、OpenAI の次世代フラッグシップモデルです。複雑な推論、ソフトウェアエンジニアリング、AIエージェント、研究、そして要求の厳しいエンドツーエンドの専門業務ワークフロー向けに設計されています。コード、ブラウザ、専門ソフトウェアを横断するマルチステップタスクに優れ、問題解決、ツール使用、コンピューター操作、長文コンテキストの理解において優れたパフォーマンスを発揮します。 GPT-6 Astra は、最大1.05Mトークンのコンテキストウィンドウと最大128Kトークンの出力をサポートします。推論努力レベルは Low、Medium、High、XHigh、Max から選択でき、開発者はタスクの複雑さに応じて推論能力、効率、コストのバランスを調整できます。 高度なAIエージェント、複雑なソフトウェア開発、自動化ワークフロー、深層リサーチ、長文書処理、データ分析、エンタープライズAIアプリケーションに最適です。

最大コンテキスト

1.1M

最大出力

128K

リリース日

2026年9月4日

入力$10 / 百万トークン
出力$50 / 百万トークン
キャッシュ読み取り$1 / 百万トークン

Anthropic

Claude Fable 5.1

claude-fable-5.1

Claude Fable 5は、AnthropicのMythosクラスに属するモデルで、高度な推論、ソフトウェアエンジニアリング、知識業務、視覚分析、科学研究向けに設計されています。長期的なエージェント型タスク向けに構築されており、複雑なワークフローにわたって計画と実行を維持し、大規模なコードベースや文書を分析し、複数ステップで作業を洗練できます。Claude Fable 5は、高度なコーディング、リサーチ、専門的分析、そして信頼性の高い自律的タスク完了を必要とする本番アプリケーションに最適です。

最大コンテキスト

1M

最大出力

128K

リリース日

2026年9月1日

入力$10 / 百万トークン
出力$50 / 百万トークン
キャッシュ読み取り$0.25 / 百万トークン

Z.ai

GLM-5.3-Flash

glm-5.3-flash

GLM-5.3-Flashは、Z.aiがGLM-5シリーズで初めて提供するネイティブなマルチモーダルモデルで、高速コーディング、視覚理解、エージェントワークフロー向けに構築されています。320BパラメータのMoEアーキテクチャは、トークンごとに18Bパラメータを活性化し、スパースアテンションとリニアアテンションを組み合わせて長いコンテキストのタスクを効率化します。本番環境でのコーディングやマルチモーダルエージェントタスクに導入する前に、TokenHub経由でGLM APIを使用し、現在のGLM-5.3-Flashの価格、モデルID、サポートされる入力、ツール呼び出し、コンテキスト制限、エンドポイントを評価してください。

最大コンテキスト

1M

最大出力

131.1K

リリース日

2026年8月26日

入力$0.1143 / 百万トークン
出力$0.4 / 百万トークン
キャッシュ読み取り$0.0329 / 百万トークン

Z.ai

GLM-5.3

glm-5.3

GLM-5.3は、Z.aiの最新フラッグシップモデルであり、高度なコーディング、ソフトウェアエンジニアリング、長期的なエージェントタスク向けに構築されています。1Mトークンのコンテキストウィンドウ、最大128Kトークンの出力、強力な推論、ツール使用機能を備え、コーディングエージェント、複雑な開発ワークフロー、多段階の自動化に最適です。

最大コンテキスト

1M

最大出力

128K

リリース日

2026年8月19日

入力$1.1429 / 百万トークン
出力$4 / 百万トークン
キャッシュ読み取り$0.2857 / 百万トークン

Tencent

Hy4 preview

hy4-preview

Hy4 preview は、Tencent Hunyuan の次世代オープンソース MoE フラッグシップモデルです。コーディング、オフィス作業、科学研究、長文コンテキスト推論、複雑なエージェントワークフローなど、実用的な生産性タスク向けに設計されています。Tencent Hy4 preview または Hunyuan 4 preview とも呼ばれ、総パラメータ数は770B、トークンごとに49Bをアクティブ化し、100万トークン超のコンテキストウィンドウをサポートします。大規模なコードベースや文書の理解、多段階の計画、ツール使用、デバッグ、検証、継続的なタスク実行に優れています。

最大コンテキスト

1M

最大出力

64K

リリース日

2026年8月28日

入力$0.8571 / 百万トークン
出力$2.5714 / 百万トークン
キャッシュ読み取り$0.0429 / 百万トークン

Alibaba

Qwen3.8 Max

qwen3.8-max

Qwen3.8-Maxは、2.4TパラメータのMoEフラッグシップモデルで、高度な推論、コーディング、エンタープライズ生産性向けに設計されています。ソフトウェア開発から専門的なワークフローまで、複雑で長期にわたるタスクを自律的に実行し、法務、金融、デザインなどの分野で本番レベルの成果を提供します。ネイティブなマルチモーダルインテリジェンスにより、Qwen3.8-Maxは長いコンテキスト内のテキスト、画像、動画を理解し、広範なドキュメントや長文コンテンツの深い分析をサポートします。エージェント機能により、複雑なワークフロー全体で自律的な計画、実行、検証、継続的な反復を可能にします。

最大コンテキスト

1M

最大出力

128K

リリース日

2026年8月3日

入力$2 / 百万トークン
出力$6 / 百万トークン
キャッシュ読み取り$0.25 / 百万トークン

Moonshot

Kimi K3

kimi-k3

Kimi K3は、高度な推論、コーディング、複雑なタスク実行のために設計された高性能AIモデルです。大規模なプログラミングプロジェクト、多段階の問題解決、知識集約型のアプリケーションで強力なパフォーマンスを発揮します。広範なコンテキスト処理能力とマルチモーダル機能を備え、K3はパワフルなAIエージェント、開発者ツール、エンタープライズレベルのアプリケーション構築に適しています。

最大コンテキスト

1M

最大出力

131.1K

リリース日

2026年7月16日

入力$2.8571 / 百万トークン
出力$14.2857 / 百万トークン
キャッシュ読み取り$0.2857 / 百万トークン

DeepSeek

DeepSeek V4 Flash Vision Exp

deepseek-v4-flash-vision-exp

DeepSeek V4 Flash Vision Exp は、DeepSeek V4 Flash 0731 の実験的なビジョン対応版であり、画像理解機能を導入しつつ、ベースモデルのテキスト性能(エージェント機能、推論、世界知識を含む)を維持しています。スパース混合専門家(MoE)アーキテクチャに基づき、総パラメータ数は284B、アクティブパラメータ数は13Bです。

最大コンテキスト

1M

最大出力

384K

リリース日

2026年8月21日

入力$0.2857 / 百万トークン
出力$1.1429 / 百万トークン
キャッシュ読み取り$0.0057 / 百万トークン

人気モデルのおすすめ

ライブカタログ内で注目度の高いモデルから始め、詳細ページでコンテキスト、エンドポイント、実効価格を比較できます。

OpenAI

GPT-6.1 Sol

GPT-6.1 Sol は、複雑な問題解決、コーディング、エージェントベースのアプリケーション向けに構築された高度な推論モデルです。知能、速度、コストの実用的なバランスを保ちながら、強力な推論性能を提供するように設計されています。 主に応答生成に重点を置く従来のチャットモデルとは異なり、GPT-6.1 Sol は、マルチステップ推論、コード生成、デバッグ、データ分析、複雑な指示への追従など、より深い思考を必要とするタスクに最適化されています。 GPT-6.1 Sol は、信頼性の高い推論ワークフロー、構造化出力、ツールベースのアプリケーションをサポートし、AI アシスタント、コーディングエージェント、自動化システム、本番 AI アプリケーションを構築する開発者に適しています。

最大コンテキスト

1.1M

入力価格

$2 / 百万トークン

モデルを見る

OpenAI

GPT-6.1 Sol Pro

GPT-6.1 Sol Pro は GPT-6.1 Sol の強化推論バージョンです。GPT-6.1 Sol と同じ基盤モデルを使用しますが、reasoning.mode=pro を有効にすることで、リクエストごとにはるかに多くの計算を費やせます。 追加の推論予算により、GPT-6.1 Sol Pro はより深い分析、長い計画、高い精度を必要とする難しい問題に対応できます。応答速度やコスト効率よりも、可能な限り最良の回答を得ることが重要なタスク向けに設計されています。 GPT-6.1 Sol と比較して、GPT-6.1 Sol Pro はリクエストごとにはるかに多くの推論トークンを消費するため、利用コストが高くなり、応答時間も長くなります。

最大コンテキスト

1.1M

入力価格

$2 / 百万トークン

モデルを見る

Anthropic

Claude Sonnet 5.5

Claude Sonnet 5.5 は、高度な推論、コーディング、分析、複雑なエージェント型ワークフロー向けに設計された次世代 AI モデルです。ソフトウェア開発、長文コンテキストの理解、マルチモーダルタスク、専門的な知識業務で高い性能を発揮し、知能・速度・効率のバランスを兼ね備えています。推論能力の強化と指示追従性の向上により、コードの作成とデバッグ、複雑な文書の分析、多段階の問題解決、信頼性の高い意思決定とツール利用を要する AI エージェントの稼働に優れた力を発揮します。

最大コンテキスト

1M

入力価格

$2 / 百万トークン

モデルを見る

xAI

Grok 4.7

Grok 4.7 は、高度なコーディングタスク、複雑な推論、知識集約型アプリケーション向けに設計された xAI の最新世代モデルです。長期的な問題解決、自己検証、ワークフロー実行を強化し、インテリジェントアシスタントや AI 製品を開発するデベロッパーに適しています。 Grok 4.7 はプログラミング、分析、汎用 AI タスクで高い性能を発揮しながら、本番環境への導入に適した効率性も備えています。

最大コンテキスト

500K

入力価格

$1.6 / 百万トークン

モデルを見る

Anthropic

Claude Opus 5.5

Claude Opus 5.5 は Anthropic のフラッグシップ知能モデルであり、深い推論、信頼性、長時間にわたるタスク実行を必要とする高負荷なワークロード向けに設計されています。ソフトウェアエンジニアリング、エージェント型ワークフロー、専門的な分析、知識集約型タスクにおいて高い性能を発揮します。 効率性の向上とセーフガードの強化により、Claude Opus 5.5 は、複雑なタスクで一貫した性能を必要とする高度な AI アプリケーションを開発するデベロッパー向けに最適化されています。

最大コンテキスト

1M

入力価格

$4 / 百万トークン

モデルを見る

OpenAI

GPT-6 Sol

GPT-6 Sol は、OpenAI の GPT-6 シリーズに属する高性能モデルで、複雑な推論タスク、ソフトウェア開発、プロフェッショナルな AI ワークフロー向けに設計されています。多段階の問題解決、高度なコーディング、データ分析、エージェントベースのアプリケーションにおいて、より高い知能を提供します。 GPT-6 Sol は強力な推論能力と効率的な推論処理を両立しており、本番環境の AI システムに最先端レベルの性能を求める開発者に適しています。

最大コンテキスト

1.1M

入力価格

$2 / 百万トークン

モデルを見る

モデル比較

選択された近隣カタログモデルとの簡易比較です。

モデルカタログ FAQ

TokenHub カタログでモデルを選び、比較し、利用するためのクイックガイドです。

この一覧からモデルを選ぶには?

+

まず用途を決めます。プロバイダー、タグ、エンドポイントタイプ、課金グループで絞り込み、コンテキスト長、最大出力、モダリティ、入出力価格を比較してください。

実効価格とは何ですか?

+

実効価格は、現在の課金グループ倍率をモデル価格に反映したものです。利用中のグループでの入力、出力、またはリクエスト単位の実コストを見積もれます。

これらのモデルは API エンドポイントで使えますか?

+

はい。モデル詳細ページで対応エンドポイントタイプとドキュメントリンクを確認できます。利用可否はモデル、プロバイダー、現在のルーティング設定によって異なります。

コンテキストウィンドウと最大出力が重要なのはなぜですか?

+

コンテキストウィンドウはモデルが読めるプロンプトや会話履歴の量を決めます。最大出力は1回の応答で生成できる量を決め、長文、コーディング、文書作業で重要です。