コンテキストウィンドウ|一度に扱える長さ
- AIのコンテキストウィンドウって何?
- 長い会話になると、AIが前に決めたことを守らなくなるのはなぜ?
- 長い資料や長い会話をAIに渡すときの気をつけ方を知りたい
AIとの会話は、どれだけ続けても前の話を全部覚えていると思うかもしれません。しかし、AIが一度に扱える長さには上限があり、長い会話では前の内容が参照されなくなることもあるのです。
この記事では、コンテキストウィンドウに入るものと上限、長い会話で前の内容が扱われにくくなる理由を解説します。長い作業で、AIに渡す内容をどう絞ればよいかも分かります。
コンテキストウィンドウは、AIが答えを作るときに参照できる文章の全部を指す言葉です。
コンテキストウィンドウとは

コンテキストウィンドウとは、大規模言語モデルが答えを作るときに参照できる文章の全部で、モデルの「作業用の記憶」にたとえられます。
大規模言語モデルは、膨大な文章で学習し、次に来る語を予測して文章を作るモデルです。ChatGPT・Claude・Gemini などは、中でこれを使って答えを作っています。
中身は、それまでの会話と、読ませた資料と、AIの答えです。モデルが学習に使った大量の文章とは、別のものです。
その長さは、トークンという単位で数えます。トークンは大規模言語モデルが文章を扱う最小の単位で、文字数とは一致せず、日本語では1文字が複数のトークンになることもあります。
コンテキストウィンドウに入るもの

1回の答えを作るとき、コンテキストウィンドウに入るものは、次の3つです。
- これまでの会話
- 読ませた資料
- AIがいま作る答え
これまでの会話
これまでの会話は、コンテキストウィンドウに入ります。会話が続くと、前のやり取りも、次の質問と一緒にAIへ渡す文章に含まれます。
そのため、使うトークンは回を追うごとに積み上がるのです。
読ませた資料
読ませた資料も、コンテキストウィンドウに入ります。貼り付けた文章のほか、添付した文書や画像も、トークンに数える対象です。
長い資料は、その長さの分だけトークンを使います。
AIがいま作る答え
AIがいま作る答えも、コンテキストウィンドウに入るものの1つです。答える前に考える過程を持つモデル(推論モデル)では、考えた分のトークンも数に入ります。
コンテキストウィンドウの大きさと上限

コンテキストウィンドウの大きさは、モデルによってさまざまです。たとえば Claude の API には、100万トークンのモデルと20万トークンのモデルがあります(2026年10月時点)。
API は、ほかのサービスから AI の機能を呼び出して使う仕組みです。
上限を超えると、送った質問がエラーになるか、答えが途中で止まります。
超えた会話や資料を続けて扱うには、短くするか、要約する必要があるのです。
長い会話で前の内容が扱われにくくなる理由

長い会話で前の内容が扱われにくくなる理由は、次の2つです。
- 上限を超えたやり取りは参照されない
- Claude ではトークンが増えると正確さが落ちる
上限を超えたやり取りは参照されない
コンテキストウィンドウの上限を超えたやり取りは、AIが答えを作るときに参照されません。前のやり取りを参照できるのは、上限の長さの分までだからです。
Claude のチャットの画面(claude.ai)のように、古いやり取りから順に外していくことがあるチャットの画面もあります(2026年10月時点)。
Claude ではトークンが増えると正確さが落ちる
Claude では、コンテキストウィンドウのトークンが増えるほど、答えの正確さと、必要な内容を拾い出す力が落ちます(2026年10月時点)。
つまり、上限に届く前から、長さが答えの正確さに響くのです。
長い作業でAIに渡す内容の絞り方

長い作業では、AIに渡す内容を工夫して、コンテキストウィンドウを答えに要る文章に使います。工夫は、次の2つです。
- 渡す内容を要る所に絞る
- 長くなったら要約して続ける
渡す内容を要る所に絞る
渡す内容は、答えに要る所に絞ります。コンテキストウィンドウにたくさん入れても、よい答えになるとは限らないからです。
長い資料なら、答えに要るページや節だけを自分で取り出して渡します。
話題が変わったら、新しい会話を始めます。新しい会話は、メモリー機能(会話をまたいで覚えておく機能)を使っていなければ、前の会話のやり取りを持たずに始まるためです。
長くなったら要約して続ける
上限に近づいたら、それまでの要点を短くまとめ、そのまとめを新しい会話に渡して続けます。まとめは、AIに頼んで作らせることもできます。
渡す前に見ておきたいのは、寸法や条件のように外せない内容がまとめに入っているかどうかです。
渡す内容を絞ってコンテキストウィンドウに収めよう

コンテキストウィンドウは、大規模言語モデルが答えを作るときに参照できる文章の全部で、上限があります。長い会話で前の内容が扱われにくくなるのは、次の2つのためです。
- 上限を超えたやり取りは参照されない
- Claude ではトークンが増えると正確さが落ちる
長い作業では、渡す内容を要る所に絞り、長くなったら要点をまとめて続けてみてください。
あわせて読みたい
- トークン|文章を数える単位 — コンテキストウィンドウを数える単位のトークンと、日本語で多くなることを知りたいとき
- 「学習した知識と会話の記憶|モデルの中・会話の中・メモリー機能」(準備中) — 会話の中の情報と、学習した知識やメモリー機能との違いを知りたいとき
- 言語モデルと大規模言語モデル|次の語を予測して文章を作る仕組み — 大規模言語モデルが答えを作る仕組みを知りたいとき
会員登録(無料)
記事やテーマのお気に入り・学習履歴・フォローが使えます。
この記事について
PERSC編集部が、建築の制作に関わる知識を実務目線で整理しています。内容は公開・更新日時点の情報にもとづきます。誤りや古い情報にお気づきの場合はお問い合わせよりご連絡ください。
PERSC では、記事の次の段としてオンライン講座とプラグインを用意しています。