コンテンツへスキップ

media AI活用の最前線

主要AIモデル コンテキスト長 横断比較【2026年9月】

主要AIモデル コンテキスト長 横断比較【2026年9月】

「どのAIが、一度にどれだけの文章を読めるのか」を1枚で。コンテキストウィンドウ(入力できるトークン量)は、長い資料・コードベース・大量データを丸ごと渡せるかを決める重要スペックです。本記事は、Claude・GPT-5系・Gemini 3・Grokの入力コンテキスト上限を各社公式に基づいて横断比較する定番リファレンスです(2026年9月1日時点・モデル更新が速いため定期的に最新化します)。

主要AIモデル コンテキスト長 横断比較表(2026年9月1日)

「入力コンテキスト」は一度のリクエストでモデルに渡せる最大トークン量です。1トークンは日本語で概ね1文字前後が目安です。

トークンと文字数の換算の考え方はAIのトークンとは(文字数換算と料金への影響)で詳しく解説しています。

モデル提供元入力コンテキスト備考
Claude Fable 5Anthropic100万トークン最上位
Claude Opus 5Anthropic100万トークンコーディング・エンタープライズ向け
Claude Sonnet 5Anthropic100万トークン標準主力
Claude Haiku 4.5Anthropic20万トークン軽量・高速
GPT-5.6 SolOpenAI105万トークン最上位
GPT-5.6 TerraOpenAI105万トークンバランス型
GPT-5.6 LunaOpenAI105万トークン低コスト
GPT-5.5OpenAI105万トークン
GPT-5.4OpenAI105万トークン
GPT-5.4 miniOpenAI40万トークン軽量・最大入力は27.2万
Gemini 3.1 Pro PreviewGoogle100万トークン出力最大6.4万
Gemini 3.7 FlashGoogle100万トークン最新Flash・出力最大6.4万
Gemini 3.6 FlashGoogle100万トークン出力最大6.4万
Gemini 3.5 FlashGoogle100万トークン高速
Gemini 3.1 Flash-LiteGoogle100万トークン最安帯
Grok 4.6xAI50万トークン最新・xAI推奨
Grok 4.5xAI50万トークン
Grok 4.3xAI100万トークン
Grok Build 0.1xAI25.6万トークンコーディング特化

2026年9月1日時点では、主要各社のフラッグシップ〜標準モデルは100万〜105万トークン級に到達しています。差がつくのは軽量・低コストモデルの上限(20万〜100万)と、後述する「実際に使いこなせるか」です。

コンテキストが長いと何ができるのか

入力コンテキストが大きいほど、分割せずに「丸ごと」渡せる範囲が広がります。100万トークンはおおよそ次の規模感です。

渡せるもの100万トークンの目安
長文ドキュメント分厚い仕様書・契約書・論文を複数まとめて
コードベース中規模リポジトリのソースを一括で読ませる
大量データ過去ログ・議事録・FAQをまとめて参照
長い会話長時間のやり取りの文脈を保持

分割(チャンク化)して渡す手間が減り、文書全体を踏まえた回答が得やすくなるのが最大の利点です。RAGのような外部参照と組み合わせる設計はコンテキストエンジニアリングも参考にしてください。

【注意】「大きければ良い」わけではない

コンテキストが長い=常に高性能、ではありません。実運用では次の3つに注意が必要です。

落とし穴内容
精度の劣化(context rot)大量に詰め込むほど、中盤の情報を取りこぼしやすくなる傾向がある。本当に必要な情報に絞る方が精度が出る場合も多い
コスト増入力トークンが増えるほど課金も増える。100万トークンを毎回渡すと費用がかさむ
速度低下入力が長いほど処理に時間がかかる。即時応答が要る用途では不利

つまり「最大100万トークン使える」ことと「毎回100万トークン詰め込むべき」は別問題です。必要な分だけ渡すのが、精度・コスト・速度のすべてで有利になります。各モデルの料金は主要AIモデルAPI料金 横断比較で確認できます。

用途別・必要なコンテキスト長の目安

  • 短い質問・チャット:数千〜数万トークンで十分。軽量モデル(Haiku 4.5・Flash系)で足りる。
  • 長文の要約・分析:数万〜十数万トークン。標準モデルで対応。
  • コードベース全体・大量資料:数十万〜105万トークン。100万級対応モデル(Claude・GPT-5系・Gemini 3・Grok 4.3)が有利。

多くの業務は数万トークンで足ります。100万トークンが本当に効くのは「大規模コードや大量文書を分割せず扱いたい」特定の場面です。

ウィンドウの大きさだけでは決まらない設計論は「モデル層とコンテキスト層の違い」で整理しています。

まとめ|数字より「必要量に足りるか」で選ぶ

2026年9月1日時点で、主要各社のフラッグシップ〜標準モデルは入力100万〜105万トークン級です。軽量モデルは20万〜40万が中心ですが、Gemini 3.1 Flash-Liteのように100万対応の低コストモデルもあります。

選定のポイントは、最大値の大きさを競うことではなく、自社の用途に必要なコンテキスト量を見極め、精度・コスト・速度のバランスで選ぶこと。大量の文書やコードを丸ごと扱うなら100万対応を、それ以外は軽量モデルで十分というのが、実務的な結論です。仕様は更新が速いため、導入時は各社公式の最新値で再確認してください(本記事も定期更新します)。

この記事の内容、自社の業務でも回したい?

AI顧問(月次伴走)が、貴社の業務に合わせて導入から定着まで並走します。研修4,000名以上・支援100社以上の実績。まずは30分の壁打ちから。

AI顧問の無料相談(30分)

よくある質問

Q. コンテキストが大きいほど高性能ですか?

そうとは限りません。大量に詰め込むほど中盤の情報を取りこぼす精度劣化(context rot)が起きやすく、入力が増えれば課金も処理時間も増えます。必要な分だけ渡すほうが精度・コスト・速度のすべてで有利です。

Q. 100万トークンは日本語で何文字くらいですか?

1トークンは日本語で概ね1文字前後が目安なので、100万トークンはおよそ100万文字規模と考えられます。分厚い仕様書や契約書、中規模リポジトリのソース、過去ログや議事録をまとめて渡せる範囲です。

Q. Claudeで入力上限が小さいモデルはどれですか?

Claude Haiku 4.5です。入力コンテキストは20万トークンで、Fable 5・Opus 5・Sonnet 5の100万トークンより小さくなっています。軽量・高速な位置づけのモデルです。

Q. GrokとGeminiでは入力できる量に違いはありますか?

違いがあります。Grokは4.6と4.5が50万トークン、4.3が100万トークン、コーディング特化のGrok Build 0.1が25.6万トークンです。Gemini 3系はProもFlash系も100万トークンで揃っています。

Q. 短いチャットでも100万トークン対応は要りますか?

要りません。短い質問やチャットは数千〜数万トークンで足り、Haiku 4.5やFlash系の軽量モデルで対応できます。100万トークン級が効くのは、大規模コードや大量文書を分割せず扱いたい場面です。

参考・出典(各社公式)

この記事の内容を社内展開する方へ: AI研修導入40項目チェックリスト(無料・PDF 35ページ) をダウンロードできます。

無料・初回相談

AI研修・AI顧問、まず30分の壁打ちから

研修4,000名以上・支援100社以上。研修は助成金の対象可否まで、顧問は月次伴走の中身まで、貴社の場合で具体的にお答えします。

  • 100社以上・研修4,000名以上の実績
  • 初回30分無料・即日返信

お問い合わせフォームから24時間以内にUravation担当者がご返信します。

佐藤傑
この記事を書いた人 佐藤傑

株式会社Uravation 代表取締役CEO/生成AIエバンジェリスト。法人向けAI研修・コンサルティングを手がけ、日経・SBクリエイティブ・GMO等のメディアで生成AIについて執筆。

この記事をシェア

生成AI活用の実務資料を無料でダウンロード

研修で使っているワークシートや導入ガイドをまとめた資料を公開しています。
社内共有にそのまま使えます。

✓ 登録1分ですぐ利用 ✓ 社内共有OK ✓ 100社以上の研修実績から作成
資料一覧を見る まずは無料相談

Contact お問い合わせ

30分の無料相談では、いま時間を取られている業務を伺い、稼働中のAI社員62体の事例の画面と一緒に近い進め方をお見せします。
売り込みはしません。

Claude Code 個別指導(1対1・12セッション)をご希望の方はこちら、Codex 個別指導はこちらから別途お申し込みください

Claude Code 個別指導 無料相談