Skip to content
  • 0 Votes
    1 Posts
    67 Views
    A
    <p>OpenAIの最新の料金ルールに基づき、GPT-5.6 Solなどのモデルでは、超長文コンテキストのリクエストに段階料金が適用されます。</p><p>1回のリクエストのコンテキストが272Kトークンを超えると、入力、キャッシュ読み取り、出力に対して、より高い段階の料金が適用される場合があります。このルールはOpenAI公式の料金設定に基づくものであり、AI-ROUTERによる一時的な値上げや異常な請求ではありません。</p><p></p><p>GPT-5.6 Solの標準料金を例にすると、次のとおりです。</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 項目 272K以内 272K超過</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 入力 $5 / 1Mトークン $10 / 1Mトークン</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> キャッシュ読み取り $0.50 / 1Mトークン $1 / 1Mトークン</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 出力 $30 / 1Mトークン $45 / 1Mトークン</code></pre><p></p><p>最終的な料金は、具体的なグループ、アカウント倍率、その他の料金設定に基づいて計算されます。</p><p></p><p>利用履歴に表示されるx2フラグは、そのリクエストで長文コンテキストの段階課金が適用されたことを示します。このフラグは主に入力とキャッシュ読み取りがより高い段階に入ったことを示すものであり、リクエスト全体のすべての料金が単純に2倍になることを意味するわけではありません。出力には異なる段階倍率が適用される場合があります。</p><p></p><p><strong> ## 段階課金の適用を避ける方法</strong></p><p>1Mトークンのコンテキストウィンドウが必要ない場合は、Codexのコンテキスト上限を272K以内に戻すことをおすすめします。</p><p></p><p>次のファイルを開きます。</p><p> ~/.codex/config.toml</p><p></p><p>記事で以前使用していた1M設定:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>次のように変更します。</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>保存後、Codexを再起動して新しいセッションを作成します。</p><p></p><p>単一のセッションに一時的に適用したい場合は、次のコマンドを使用できます。</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> あわせて、次の対応もおすすめします。</p><p> - 自動圧縮を早めに有効にする。</p><p> - 長時間にわたるタスクを複数のセッションに分割する。</p><p> - 一度に大量のツール出力を返さないようにする。</p><p> - 定期的に要約し、古い会話内容を整理する。</p><p></p><p>1Mトークンのコンテキストウィンドウが本当に必要な場合は、以前の設定を引き続き使用できます。ただし、272Kを超えた分については、OpenAIの高い段階料金に基づいて請求されます。</p><p></p><p>元の設定については、次の記事を参照してください:<a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">CodexでGPT-5.6 Solの100万トークンコンテキストウィンドウを有効にする方法 </a></p><p></p><p>ご理解とご支援に感謝いたします。</p>