Skip to content
  • 0 Votes
    1 Posts
    53 Views
    A
    <p>OpenAI의 최신 요금 정책에 따라 GPT-5.6 Sol 등의 모델은 초장문 컨텍스트 요청에 계단식 요금을 적용합니다.</p><p>단일 요청의 컨텍스트가 272K tokens를 초과하면 입력, 캐시 읽기 및 출력에 더 높은 계단식 요금이 적용될 수 있습니다. 이 규칙은 OpenAI의 공식 가격 정책에 따른 것이며, AI-ROUTER의 임시 추가 요금이나 비정상적인 과금이 아닙니다.</p><p></p><p>GPT-5.6 Sol의 표준 요금을 예로 들면 다음과 같습니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 항목 272K 이하 272K 초과</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 입력 $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 캐시 읽기 $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 출력 $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>최종 비용은 구체적인 그룹, 계정 배율 및 기타 과금 설정에 따라 계산됩니다.</p><p></p><p>사용 기록에 x2 표시가 나타나는 것은 해당 요청에 장문 컨텍스트 계단식 요금이 적용되었음을 의미합니다. 이 표시는 주로 입력 및 캐시 읽기가 더 높은 요금 계단에 진입했음을 나타내며, 요청 전체의 모든 비용이 단순히 2배가 된다는 의미는 아닙니다. 출력에는 다른 계단식 배율이 적용될 수 있습니다.</p><p></p><p><strong> ## 계단식 요금 적용을 피하는 방법</strong></p><p>1M Token 컨텍스트 창이 필요하지 않다면 Codex의 컨텍스트 한도를 272K 이하로 조정하는 것이 좋습니다.</p><p></p><p>다음 파일을 엽니다.</p><p> ~/.codex/config.toml</p><p></p><p>기존 글의 1M 설정을 다음과 같이 변경합니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>다음과 같이 조정합니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>저장한 후 Codex를 다시 시작하고 새 세션을 만드세요.</p><p></p><p>특정 세션 하나에만 임시로 적용하려면 다음 명령을 사용할 수 있습니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> 다음 사항도 권장합니다.</p><p> - 자동 압축을 적절히 활성화합니다.</p><p> - 초장문 작업을 여러 세션으로 나눕니다.</p><p> - 한 번에 반환되는 대량의 도구 출력을 줄입니다.</p><p> - 오래된 대화 내용을 정기적으로 요약하고 정리합니다.</p><p></p><p>1M Token 컨텍스트 창이 실제로 필요하다면 기존 설정을 계속 사용할 수 있습니다. 단, 272K를 초과하는 부분에는 OpenAI의 더 높은 계단식 요금이 적용됩니다.</p><p></p><p>기존 설정 안내는 다음을 참고하세요. <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Codex에서 GPT-5.6 Sol에 100만 Token 컨텍스트 창을 활성화하는 방법 </a></p><p></p><p>이해와 지원에 감사드립니다.</p>
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>OpenAI의 최신 과금 규칙에 따라 GPT-5.6 Sol 등의 모델은 초장문 컨텍스트 요청에 단계별 요금을 적용합니다.</p><p>단일 요청의 컨텍스트가 272K tokens를 초과하면 입력, 캐시 읽기 및 출력에 더 높은 단계의 요금이 적용될 수 있습니다. 이 규칙은 OpenAI의 공식 가격 정책에 따른 것이며, AI-ROUTER가 임시로 요금을 인상했거나 비정상적으로 과금한 것이 아닙니다.</p><p></p><p>GPT-5.6 Sol 표준 요금을 예로 들면 다음과 같습니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 항목 272K 이하 272K 초과</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 입력 $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 캐시 읽기 $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 출력 $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>최종 비용은 구체적인 그룹, 계정 배율 및 기타 과금 설정에 따라 계산됩니다.</p><p></p><p>사용 기록에 x2 표시가 나타나는 것은 해당 요청이 초장문 컨텍스트 단계별 과금을 적용받았다는 의미입니다. 이 표시는 주로 입력 및 캐시 읽기가 더 높은 단계에 진입했음을 나타내며, 요청 전체의 모든 비용이 단순히 2배가 되었다는 뜻은 아닙니다. 출력에는 다른 단계별 배율이 적용될 수 있습니다.</p><p></p><p><strong> ## 단계별 과금 적용을 피하는 방법</strong></p><p>1M Token 컨텍스트 창이 필요하지 않다면 Codex의 컨텍스트 한도를 272K 이하로 다시 조정하는 것이 좋습니다.</p><p></p><p>다음 파일을 엽니다.</p><p> ~/.codex/config.toml</p><p></p><p>기존 글의 1M 설정:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>다음과 같이 변경합니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>저장한 후 Codex를 다시 시작하고 새 세션을 만듭니다.</p><p></p><p>특정 세션 하나에만 임시로 적용하려면 다음 명령을 사용할 수 있습니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> 다음 사항도 권장합니다.</p><p> - 자동 압축을 적시에 활성화합니다.</p><p> - 초장문 작업을 여러 세션으로 나눕니다.</p><p> - 한 번에 반환되는 대량의 도구 출력을 줄입니다.</p><p> - 정기적으로 대화를 요약하고 오래된 대화 내용을 정리합니다.</p><p></p><p>1M Token 컨텍스트 창이 실제로 필요하다면 기존 설정을 계속 사용할 수 있습니다. 다만 272K를 초과하는 부분에는 OpenAI의 더 높은 단계 요금이 적용됩니다.</p><p></p><p>기존 설정 안내는 다음을 참고하세요: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Codex에서 GPT-5.6 Sol에 100만 Token 컨텍스트 창을 활성화하는 방법 </a></p><p></p><p>이해와 지원에 감사드립니다.</p>
  • 0 Votes
    1 Posts
    71 Views
    A
    <p>OpenAI의 최신 과금 규정에 따라 GPT-5.6 Sol 등의 모델은 초장문 컨텍스트 요청에 계단식 요금을 적용합니다.</p><p>단일 요청의 컨텍스트가 272K tokens를 초과하면 입력, 캐시 읽기 및 출력에 더 높은 계단식 요금이 적용될 수 있습니다. 이 규정은 OpenAI 공식 가격 정책에 따른 것으로, AI-ROUTER가 임시로 추가 요금을 부과하거나 비정상적으로 과금하는 것이 아닙니다.</p><p></p><p>GPT-5.6 Sol 표준 요금을 예로 들면 다음과 같습니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 항목 272K 이내 272K 초과</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 입력 $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 캐시 읽기 $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 출력 $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>최종 비용은 구체적인 그룹, 계정 배율 및 기타 과금 설정에 따라 계산됩니다.</p><p></p><p>사용 기록에 x2 표시가 나타나는 것은 해당 요청에 장문 컨텍스트 계단식 과금이 적용되었음을 의미합니다. 이 표시는 주로 입력 및 캐시 읽기가 더 높은 계단에 진입했음을 나타내며, 요청 전체의 모든 비용이 단순히 두 배가 되었다는 뜻은 아닙니다. 출력에는 다른 계단식 배율이 적용될 수 있습니다.</p><p></p><p><strong> ## 계단식 과금 적용을 피하는 방법</strong></p><p>1M Token 컨텍스트 창이 필요하지 않다면 Codex의 컨텍스트 한도를 272K 이하로 조정하는 것이 좋습니다.</p><p></p><p>다음 파일을 엽니다.</p><p> ~/.codex/config.toml</p><p></p><p>기존 글의 1M 설정을 다음과 같이 적용했다면:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>다음과 같이 변경합니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>저장한 후 Codex를 다시 시작하고 새 세션을 생성합니다.</p><p></p><p>특정 세션 하나에만 임시로 적용하려면 다음 명령을 사용할 수 있습니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> 다음 사항도 권장합니다.</p><p> - 자동 압축을 적시에 활성화합니다.</p><p> - 초장문 작업을 여러 세션으로 나눕니다.</p><p> - 한 번에 반환되는 대량의 도구 출력을 줄입니다.</p><p> - 정기적으로 대화 내용을 요약하고 오래된 내용을 정리합니다.</p><p></p><p>실제로 1M Token 컨텍스트 창이 필요하다면 기존 설정을 계속 사용할 수 있습니다. 단, 272K를 초과하는 부분에는 OpenAI의 높은 계단식 요금이 적용됩니다.</p><p></p><p>기존 설정 안내는 다음 문서를 참고하세요: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Codex에서 GPT-5.6 Sol에 100만 Token 컨텍스트 창을 활성화하는 방법 </a></p><p></p><p>이해와 성원에 감사드립니다.</p>