search
  1. コンテキストウィンドウ|一度に扱える長さ

コンテキストウィンドウ|一度に扱える長さ

編集部 読了 約6分

  • AIのコンテキストウィンドウって何?
  • 長い会話になると、AIが前に決めたことを守らなくなるのはなぜ?
  • 長い資料や長い会話をAIに渡すときの気をつけ方を知りたい

AIとの会話は、どれだけ続けても前の話を全部覚えていると思うかもしれません。しかし、AIが一度に扱える長さには上限があり、長い会話では前の内容が参照されなくなることもあるのです。

この記事では、コンテキストウィンドウに入るものと上限、長い会話で前の内容が扱われにくくなる理由を解説します。長い作業で、AIに渡す内容をどう絞ればよいかも分かります。

コンテキストウィンドウは、AIが答えを作るときに参照できる文章の全部を指す言葉です。

コンテキストウィンドウとは

AIが答えを作るときに、手元に広げた会話と資料を見渡している場面
コンテキストウィンドウは、AIが答えを作るときに参照できる文章の全部で、上限がある

コンテキストウィンドウとは、大規模言語モデルが答えを作るときに参照できる文章の全部で、モデルの「作業用の記憶」にたとえられます。

大規模言語モデルは、膨大な文章で学習し、次に来る語を予測して文章を作るモデルです。ChatGPT・Claude・Gemini などは、中でこれを使って答えを作っています。

中身は、それまでの会話と、読ませた資料と、AIの答えです。モデルが学習に使った大量の文章とは、別のものです。

その長さは、トークンという単位で数えます。トークンは大規模言語モデルが文章を扱う最小の単位で、文字数とは一致せず、日本語では1文字が複数のトークンになることもあります。

コンテキストウィンドウに入るもの

会話が続くたびに、前のやり取りと資料が積み重なって枠を埋めていく図
会話が続くと、前のやり取りも次の質問と一緒にAIへ渡す文章に含まれ、使うトークンが積み上がる

1回の答えを作るとき、コンテキストウィンドウに入るものは、次の3つです。

  • これまでの会話
  • 読ませた資料
  • AIがいま作る答え

これまでの会話

これまでの会話は、コンテキストウィンドウに入ります。会話が続くと、前のやり取りも、次の質問と一緒にAIへ渡す文章に含まれます。

そのため、使うトークンは回を追うごとに積み上がるのです。

読ませた資料

読ませた資料も、コンテキストウィンドウに入ります。貼り付けた文章のほか、添付した文書や画像も、トークンに数える対象です。

長い資料は、その長さの分だけトークンを使います。

AIがいま作る答え

AIがいま作る答えも、コンテキストウィンドウに入るものの1つです。答える前に考える過程を持つモデル(推論モデル)では、考えた分のトークンも数に入ります。

コンテキストウィンドウの大きさと上限

積み重なった会話と資料が、枠からあふれかけている図
上限を超えると、送った質問がエラーになるか、答えが途中で止まる

コンテキストウィンドウの大きさは、モデルによってさまざまです。たとえば Claude の API には、100万トークンのモデルと20万トークンのモデルがあります(2026年10月時点)。

API は、ほかのサービスから AI の機能を呼び出して使う仕組みです。

上限を超えると、送った質問がエラーになるか、答えが途中で止まります。

超えた会話や資料を続けて扱うには、短くするか、要約する必要があるのです。

長い会話で前の内容が扱われにくくなる理由

長い会話の最初のほうがかすんでいく図
上限を超えたやり取りは参照されない

長い会話で前の内容が扱われにくくなる理由は、次の2つです。

  • 上限を超えたやり取りは参照されない
  • Claude ではトークンが増えると正確さが落ちる

上限を超えたやり取りは参照されない

コンテキストウィンドウの上限を超えたやり取りは、AIが答えを作るときに参照されません。前のやり取りを参照できるのは、上限の長さの分までだからです。

Claude のチャットの画面(claude.ai)のように、古いやり取りから順に外していくことがあるチャットの画面もあります(2026年10月時点)。

Claude ではトークンが増えると正確さが落ちる

Claude では、コンテキストウィンドウのトークンが増えるほど、答えの正確さと、必要な内容を拾い出す力が落ちます(2026年10月時点)。

つまり、上限に届く前から、長さが答えの正確さに響くのです。

長い作業でAIに渡す内容の絞り方

長い資料から要るページだけを抜き出して、AIに渡している場面
長い作業では、渡す内容を要る所に絞る

長い作業では、AIに渡す内容を工夫して、コンテキストウィンドウを答えに要る文章に使います。工夫は、次の2つです。

  • 渡す内容を要る所に絞る
  • 長くなったら要約して続ける

渡す内容を要る所に絞る

渡す内容は、答えに要る所に絞ります。コンテキストウィンドウにたくさん入れても、よい答えになるとは限らないからです。

長い資料なら、答えに要るページや節だけを自分で取り出して渡します。

話題が変わったら、新しい会話を始めます。新しい会話は、メモリー機能(会話をまたいで覚えておく機能)を使っていなければ、前の会話のやり取りを持たずに始まるためです。

長くなったら要約して続ける

上限に近づいたら、それまでの要点を短くまとめ、そのまとめを新しい会話に渡して続けます。まとめは、AIに頼んで作らせることもできます。

渡す前に見ておきたいのは、寸法や条件のように外せない内容がまとめに入っているかどうかです。

渡す内容を絞ってコンテキストウィンドウに収めよう

要点を短くまとめたメモを、AIに渡し直している場面
長くなった会話は、要点をまとめて新しい会話に渡して続ける

コンテキストウィンドウは、大規模言語モデルが答えを作るときに参照できる文章の全部で、上限があります。長い会話で前の内容が扱われにくくなるのは、次の2つのためです。

  • 上限を超えたやり取りは参照されない
  • Claude ではトークンが増えると正確さが落ちる

長い作業では、渡す内容を要る所に絞り、長くなったら要点をまとめて続けてみてください。

あわせて読みたい

会員登録(無料)

記事やテーマのお気に入り・学習履歴・フォローが使えます。

この記事について

PERSC編集部が、建築の制作に関わる知識を実務目線で整理しています。内容は公開・更新日時点の情報にもとづきます。誤りや古い情報にお気づきの場合はお問い合わせよりご連絡ください。

PERSC では、記事の次の段としてオンライン講座とプラグインを用意しています。