最大出力トークン (Max Tokens)
読み: さいだいしゅつりょくとーくん
最終更新: 2026-07-26・AI PICKS編集部
定義
最大出力トークン(Max Tokens)とは、LLMが1回の応答で生成できるトークン数の上限を指定するパラメータのこと。
最大出力トークン (Max Tokens)とは — 詳しく解説
OpenAIのmax_tokens、Anthropic ClaudeのMax Tokens、GeminiのmaxOutputTokensなど、多くのLLM APIに共通して用意されているパラメータで、モデルが1回の応答で生成できるトークン数の上限を指定する。入力側のcontext windowとは別軸の設定で、上限に達すると文章が途中で切れて出力が終了する点に注意が必要になる。2026年時点の実運用では、値を低く設定しすぎて長文回答が途中で打ち切られる、逆に高く設定しすぎて冗長な出力やコスト増につながる、という2種類の落とし穴がよく指摘される。従量課金のAPIでは出力トークン数がそのままコストに直結するため、相場感としては用途に応じた上限設計(要約なら数百、コード生成やレポート作成なら数千程度)が現場で広く採用されているとされる。実運用では用途ごとの想定出力量をあらかじめ見積もり、余裕を持たせつつ無駄な上限を避けるバランスが重要になる。
最大出力トークン (Max Tokens)の使用例
- APIリクエストでmax_tokensを500に指定し、要約結果が長文化しすぎないよう出力量を制限する使い方。
- 長いコード生成タスクで上限値を低く設定すると、生成コードが途中で切れて構文エラーになるケース。
最大出力トークン (Max Tokens)に関連するAIツール
関連用語
「プロンプト技法」の他の用語
AI への指示文。 役割 + タスク + 制約 + 文脈 の 4 要素を明示するのが基本。
AI への指示文を 設計する技術。 役割・タスク・制約・文脈 の 4 要素 + Few-shot などのテクニック。
AI に「お手本の例」を 3-5 件見せてから タスクを依頼する手法。 出力フォーマットが安定する。
AI に「ステップごとに考えてください」と促し、 複雑な推論精度を上げる手法。
例示なしで AI にタスクを依頼する方法。 最新モデルは Zero-shot 精度が大幅に向上した。
システムプロンプトとは、AIアシスタントの応答スタイル・役割・制約をあらかじめ設定する隠し命令文のこと。ユーザーの入力より先に処理され、会話全体のトーンと動作範囲を規定する。
AI用語辞典をすべて見てみませんか
12カテゴリ・1013語以上を体系的に整理しています
辞典トップへ