<p>OpenAI의 최신 과금 규칙에 따라 GPT-5.6 Sol 등의 모델은 초장문 컨텍스트 요청에 단계별 요금을 적용합니다.</p><p>단일 요청의 컨텍스트가 272K tokens를 초과하면 입력, 캐시 읽기 및 출력에 더 높은 단계의 요금이 적용될 수 있습니다. 이 규칙은 OpenAI의 공식 가격 정책에 따른 것이며, AI-ROUTER가 임시로 요금을 인상했거나 비정상적으로 과금한 것이 아닙니다.</p><p></p><p>GPT-5.6 Sol 표준 요금을 예로 들면 다음과 같습니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 항목 272K 이하 272K 초과</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 입력 $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 캐시 읽기 $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 출력 $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>최종 비용은 구체적인 그룹, 계정 배율 및 기타 과금 설정에 따라 계산됩니다.</p><p></p><p>사용 기록에 x2 표시가 나타나는 것은 해당 요청이 초장문 컨텍스트 단계별 과금을 적용받았다는 의미입니다. 이 표시는 주로 입력 및 캐시 읽기가 더 높은 단계에 진입했음을 나타내며, 요청 전체의 모든 비용이 단순히 2배가 되었다는 뜻은 아닙니다. 출력에는 다른 단계별 배율이 적용될 수 있습니다.</p><p></p><p><strong> ## 단계별 과금 적용을 피하는 방법</strong></p><p>1M Token 컨텍스트 창이 필요하지 않다면 Codex의 컨텍스트 한도를 272K 이하로 다시 조정하는 것이 좋습니다.</p><p></p><p>다음 파일을 엽니다.</p><p> ~/.codex/config.toml</p><p></p><p>기존 글의 1M 설정:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>다음과 같이 변경합니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>저장한 후 Codex를 다시 시작하고 새 세션을 만듭니다.</p><p></p><p>특정 세션 하나에만 임시로 적용하려면 다음 명령을 사용할 수 있습니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> 다음 사항도 권장합니다.</p><p> - 자동 압축을 적시에 활성화합니다.</p><p> - 초장문 작업을 여러 세션으로 나눕니다.</p><p> - 한 번에 반환되는 대량의 도구 출력을 줄입니다.</p><p> - 정기적으로 대화를 요약하고 오래된 대화 내용을 정리합니다.</p><p></p><p>1M Token 컨텍스트 창이 실제로 필요하다면 기존 설정을 계속 사용할 수 있습니다. 다만 272K를 초과하는 부분에는 OpenAI의 더 높은 단계 요금이 적용됩니다.</p><p></p><p>기존 설정 안내는 다음을 참고하세요: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Codex에서 GPT-5.6 Sol에 100만 Token 컨텍스트 창을 활성화하는 방법 </a></p><p></p><p>이해와 지원에 감사드립니다.</p>