> For the complete documentation index, see [llms.txt](https://docs.maiagent.ai/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://docs.maiagent.ai/maiagent-user-guide/maiagent-user-guide-ja/build/custom-max-tokens.md).

# 最大出力 Tokens のカスタマイズ

### 機能概要 <a href="#feature-introduction" id="feature-introduction"></a>

出力 Token 上限のカスタマイズ機能では、AI アシスタントが 1 回の回答で生成する最大の長さを正確に制御できます。この設定を調整することで、さまざまな利用シーンに応じて、AI アシスタントに簡潔な要約や詳細な説明を生成させることができ、同時に Token 消費コストを効果的に抑えられます。

{% hint style="info" %}
**Token について**

Token は AI モデルがテキストを処理する基本単位です。一般的には次のとおりです。

* 日本語：1 文字あたり約 1.5〜2 Token
* 英語：1 単語あたり約 1〜1.5 Token
* 句読点も Token 数にカウントされます
  {% endhint %}

***

### 出力 Token 上限を設定する <a href="#configure-token-output-limit" id="configure-token-output-limit"></a>

#### 設定画面に入る <a href="#navigate-to-settings" id="navigate-to-settings"></a>

1. 左側メニューの「<mark style="color:blue;">AI アシスタント</mark>」をクリックします
2. 設定したい AI アシスタントを選択します
3. 「<mark style="color:blue;">設定</mark>」ボタンをクリックします
4. 「<mark style="color:blue;">詳細設定</mark>」タブに切り替えます

#### Token 上限を調整する <a href="#adjust-token-limit" id="adjust-token-limit"></a>

1. **Token 上限モードを選択する**
   * 「<mark style="color:blue;">モデルの最大値を使用</mark>」：選択したモデルがサポートする最大出力 Token 数をそのまま適用します（デフォルト）
   * 「<mark style="color:blue;">カスタム数量</mark>」：上限を自分で指定します
2. **カスタム数値を入力する（「カスタム数量」を選択した場合）**
   * 数値入力欄に目標の数値を入力します
   * 入力できる範囲は選択したモデルによって異なり、そのモデルで許可されている範囲が画面にリアルタイムで表示されます（下図の「範囲：512 - 64000 tokens」のように表示されます）
3. **設定を保存する**
   * 「<mark style="color:blue;">保存</mark>」ボタンをクリックします
   * 設定はただちに反映され、AI アシスタントを再起動する必要はありません

<figure><img src="/files/UCz5WH0X50T81bUYjJRZ" alt="詳細設定：最大出力 Token 数"><figcaption><p>AI アシスタントの詳細設定画面：「モデルの最大値を使用」または「カスタム数量」を選択して出力 Token 上限を制御できます</p></figcaption></figure>

{% hint style="warning" %}
**注意事項**

* 低く設定しすぎると回答が途中で切れ、完全性が損なわれる場合があります
* 高く設定しすぎると Token 消費コストが増加します
* 実際のニーズに応じて調整し、テストを通じて最適なバランスを見つけることをおすすめします
  {% endhint %}

***

### 推奨設定値 <a href="#recommended-settings" id="recommended-settings"></a>

さまざまな利用シーンに応じた、Token 上限の推奨設定は以下のとおりです。

<table><thead><tr><th width="200">利用シーン</th><th width="150">推奨 Token 数</th><th>説明</th></tr></thead><tbody><tr><td><strong>簡潔な問い合わせ対応</strong></td><td>256 - 512</td><td>FAQ ボットなど、すばやい回答に適しています<br>日本語で約 100〜200 文字</td></tr><tr><td><strong>一般的なカスタマーサポート</strong></td><td>512 - 1024</td><td>詳細さとコストのバランスをとります<br>日本語で約 200〜400 文字</td></tr><tr><td><strong>専門的なコンサルティング</strong></td><td>1024 - 2048</td><td>詳細な説明と解決策を提供します<br>日本語で約 400〜800 文字</td></tr><tr><td><strong>コンテンツ生成</strong></td><td>2048 - 4096</td><td>長文の記事やレポートを生成します<br>日本語で約 800〜1600 文字</td></tr><tr><td><strong>コード生成</strong></td><td>1024 - 2048</td><td>完全なコードスニペットを生成します<br>コメントと説明を含みます</td></tr></tbody></table>

***

### 利用シーンの例 <a href="#use-case-examples" id="use-case-examples"></a>

#### シーン 1：FAQ クイック回答ボット <a href="#scenario-1-faq-quick-response-bot" id="scenario-1-faq-quick-response-bot"></a>

**ニーズ**：顧客からよくある質問には、長々とした説明を避け、簡潔で明確な回答が必要

**設定方法**：

* 出力 Token 上限：256〜512
* 役割指示：「質問には簡潔かつ明確に、3 文以内で答えてください」
* 期待される効果：すばやい応答と Token 消費の削減

**会話例**：

```
ユーザー：営業時間は何時から何時までですか？
AI：当社の営業時間は、月曜から金曜が午前 9:00 から午後 6:00、
土曜が午前 10:00 から午後 5:00 で、日曜は定休日です。
```

#### シーン 2：テクニカルサポートの詳細な説明 <a href="#scenario-2-technical-support-detailed-explanation" id="scenario-2-technical-support-detailed-explanation"></a>

**ニーズ**：ユーザーが技術的な問題に直面しており、詳細な手順説明が必要

**設定方法**：

* 出力 Token 上限：1024〜2048
* 役割指示：「ユーザーが手順どおりに操作できるよう、詳細な手順説明を提供してください」
* 期待される効果：完全な問題解決のガイダンス

**会話例**：

```
ユーザー：ソフトウェアが起動しないのですが、どうすればいいですか？
AI：以下の手順に従って問題を切り分けてください：

1. システム要件を確認する
   - OS: Windows 10 以上
   - メモリ: 4GB 以上
   - ディスク空き容量: 2GB 以上

2. ソフトウェアを再インストールする
   - 既存のバージョンを削除する（コントロールパネル > プログラム）
   - 最新バージョンをダウンロードする [リンク]
   - 管理者として実行してインストールする

3. ファイアウォール設定を確認する
   - ソフトウェアを例外リストに追加する
   - ソフトウェアのネットワークアクセスを許可する

以上の手順で解決しない場合は、エラーメッセージのスクリーンショットをお送りください。さらにサポートいたします。
```

#### シーン 3：コンテンツの要約生成 <a href="#scenario-3-content-summary-generation" id="scenario-3-content-summary-generation"></a>

**ニーズ**：長文の記事から要点を抽出して要約する

**設定方法**：

* 出力 Token 上限：512〜768
* 役割指示：「要点を 3〜5 個のポイントにまとめ、各ポイントは 2 文以内にしてください」
* 期待される効果：簡潔で、すばやく理解しやすい要約

***

### 他の設定との関係 <a href="#relationship-with-other-settings" id="relationship-with-other-settings"></a>

#### 役割指示 (System Prompt) <a href="#system-prompt-settings" id="system-prompt-settings"></a>

高い Token 上限を設定していても、役割指示によって回答の長さを制約できます。

```
良い例：
「ユーザーが詳細な説明を求めない限り、簡潔に答えてください」

悪い例：
「各質問にできるだけ詳細に答えてください」（回答が長くなりすぎる可能性があります）
```

#### モデルの選択 <a href="#model-selection" id="model-selection"></a>

モデルによってサポートされる最大出力 Token 数は異なります。AI アシスタントで使用するモデルを切り替えると、カスタマイズできる範囲もそれに応じて変わり、画面に表示される範囲のヒントが現在選択しているモデルの上限・下限を示します。「モデルの最大値を使用」を選択すると、システムが自動的にそのモデルの最大値を適用します。

***

### コスト最適化のおすすめ <a href="#cost-optimization-recommendations" id="cost-optimization-recommendations"></a>

#### Token 消費を計算する <a href="#calculate-token-consumption" id="calculate-token-consumption"></a>

1 回の会話の Token 消費には以下が含まれます。

* **入力 Token**：ユーザーの質問 + 会話履歴 + 役割指示
* **出力 Token**：AI の回答（この設定によって制限されます）

**計算例**：

```
入力：ユーザーの質問 50 Token + 会話履歴 200 Token + 役割指示 100 Token = 350 Token
出力：AI の回答（上限を 512 Token に設定）
合計：350 + 512 = 862 Token（最大）
```

#### 最適化の戦略 <a href="#optimization-strategies" id="optimization-strategies"></a>

1. **シーンに応じて調整する**
   * 簡単な質問には低い Token 上限を使う
   * 複雑な質問のときだけ上限を引き上げる
2. **不要な長い回答を避ける**
   * 役割指示で簡潔さを明確に求める
   * 1 回の長い回答ではなく、複数回の会話で対応する
3. **利用状況を定期的に確認する**
   * 「使用分析」タブで会話文字数などの利用傾向を確認する
   * コストを最適化するために設定を調整する

{% hint style="info" %}
詳細なコスト計算と最適化のおすすめについては、[使用量計算](/maiagent-user-guide/maiagent-user-guide-ja/others/usage.md) をご参照ください。
{% endhint %}

***

### よくある質問 <a href="#faq" id="faq"></a>

#### Q：Token 上限を設定すると、AI の回答は強制的に途中で切られますか？ <a href="#q-will-ai-response-be-cut-off-after-setting-token-limit" id="q-will-ai-response-be-cut-off-after-setting-token-limit"></a>

**A**：はい。AI が生成する回答が Token 上限に達すると、その位置で停止するため、文が途中で切れる場合があります。おすすめは次のとおりです。

* 適切な上限を設定する（低く設定しすぎない）
* 役割指示で「文字数の上限に達する前に自然に締めくくる」よう求める

#### Q：自分の AI アシスタントが平均でどのくらいの Token を使っているか、どうすればわかりますか？ <a href="#q-how-to-check-average-token-usage" id="q-how-to-check-average-token-usage"></a>

**A**：AI アシスタントの「<mark style="color:blue;">設定</mark>」ページの「<mark style="color:blue;">使用分析</mark>」タブで、日付期間ごとに「<mark style="color:blue;">会話文字数</mark>」「会話回数」「メッセージ回数」「平均会話インタラクション回数」「ユーザー満足度」などの傾向グラフを確認できます。このうち「会話文字数」はそのアシスタントが累計で生成した文字数であり、文字数は Token 数と正の相関があるため、Token 消費の目安として利用できます。

<figure><img src="/files/5O1YRchhHZ9PoCXp7kuQ" alt="使用分析タブ"><figcaption><p>AI アシスタントの「使用分析」タブ：日付期間ごとに会話文字数、会話回数、メッセージ回数、平均会話インタラクション回数、ユーザー満足度などの傾向グラフを確認できます</p></figcaption></figure>

#### Q：Token 上限を高めに設定すると、回答速度は遅くなりますか？ <a href="#q-does-higher-token-limit-slow-down-responses" id="q-does-higher-token-limit-slow-down-responses"></a>

**A**：わずかに影響があります。回答が長くなると生成により多くの時間がかかりますが、通常その差は大きくありません（数秒以内）。主な影響要因は依然として次のとおりです。

* モデルの選択
* ネットワーク接続速度
* サーバー負荷

#### Q：言語によって異なる Token 上限を設定する必要はありますか？ <a href="#q-different-languages-need-different-token-limits" id="q-different-languages-need-different-token-limits"></a>

**A**：適度な調整をおすすめします。

* **日本語**：同じ文字数でも Token 消費が多くなるため、上限をやや高めにできます
* **英語**：Token 効率が高いため、低めの上限を使用できます
* **多言語環境**：柔軟性を確保するため、高めの上限を設定することをおすすめします

#### Q：Token 上限はナレッジベースの検索結果に影響しますか？ <a href="#q-does-token-limit-affect-knowledge-base-retrieval" id="q-does-token-limit-affect-knowledge-base-retrieval"></a>

**A**：検索そのものには直接影響しませんが、検索結果の提示のしかたには影響します。

* **高い Token 上限**：より多くのナレッジベースの断片を引用できます
* **低い Token 上限**：最も関連性の高い断片のみを引用します

***

### テストと調整 <a href="#testing-and-adjustment" id="testing-and-adjustment"></a>

#### テストの流れ <a href="#testing-process" id="testing-process"></a>

1. **初期値を設定する**
   * 推奨値から始める（例：1024）
2. **テスト会話を行う**
   * 典型的なユーザーの質問を入力する
   * 回答の長さと完全性を観察する
3. **結果を評価する**
   * 回答は完全ですか？
   * 不要な冗長さはありませんか？
   * Token 消費は妥当ですか？
4. **段階的に調整する**
   * 長すぎる → Token 上限を下げる
   * 短すぎる／途中で切れる → Token 上限を上げる
5. **継続的に監視する**
   * 利用状況を定期的に確認する
   * 実際のニーズに応じて微調整する

#### テスト例 <a href="#testing-examples" id="testing-examples"></a>

```
テスト 1：Token 上限 256
ユーザー：御社について紹介してください
AI：当社は AI 技術に特化した企業で、エンタープライズ向けの対話ボットソリューションを提供しています。[回答が途中で切れる]
評価：短すぎるため、引き上げが必要

テスト 2：Token 上限 1024
ユーザー：御社について紹介してください
AI：当社は AI 技術に特化した企業で…[完全で詳細な紹介]…詳細についてはお気軽にお問い合わせください。
評価：適切なため、採用
```

***

### 関連機能 <a href="#related-features" id="related-features"></a>

{% hint style="info" %}
**関連機能**

* [AI アシスタントの作成](/maiagent-user-guide/maiagent-user-guide-ja/build/setup.md)
* [役割指示の設計ガイド](/maiagent-user-guide/maiagent-user-guide-ja/build/system-prompt.md)
* [使用量計算](/maiagent-user-guide/maiagent-user-guide-ja/others/usage.md)
* [使用分析](/maiagent-user-guide/maiagent-user-guide-ja/org/usage.md)
  {% endhint %}


---

# Agent Instructions
This documentation is published with GitBook. GitBook is the documentation platform designed so that both humans and AI agents can read, navigate, and reason over technical content effectively. Learn more at gitbook.com.

## Querying This Documentation
If you need additional information that is not directly available in this page, you can query the documentation dynamically by asking a question.

Perform an HTTP GET request on the current page URL with the `ask` query parameter, and the optional `goal` query parameter:

```
GET https://docs.maiagent.ai/maiagent-user-guide/maiagent-user-guide-ja/build/custom-max-tokens.md?ask=<question>&goal=<endgoal>
```

`ask` is the immediate question: it should be specific, self-contained, and written in natural language.
`goal` is optional and describes the broader end goal you are ultimately trying to accomplish on behalf of the user. GitBook uses it to tailor the answer towards what is most useful for that goal.

The response will contain a direct answer to the question and relevant excerpts and sources from the documentation.

Use this mechanism when the answer is not explicitly present in the current page, you need clarification or additional context, or you want to retrieve related documentation sections.
