Skip to content
  • 0 Votes
    1 Posts
    4 Views
    A
    <p>Ifølge OpenAIs seneste prisregler anvender modeller som GPT-5.6 Sol trindelt prissætning for anmodninger med ekstremt lange kontekster.</p><p>Når konteksten i en enkelt anmodning overstiger 272K tokens, kan input, cachelæsninger og output blive beregnet efter højere prisniveauer. Denne regel stammer fra OpenAIs officielle priser og er ikke en midlertidig prisstigning eller en unormal opkrævning fra AI-ROUTER.</p><p></p><p>Eksempel med GPT-5.6 Sols standardpriser:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Post Inden for 272K Over 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cachelæsning $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den endelige pris beregnes fortsat ud fra den konkrete gruppe, kontomultiplikatorer og andre faktureringsindstillinger.</p><p></p><p>Hvis der vises en x2-markering i brugsoversigten, betyder det, at anmodningen har udløst trindelt prissætning for lange kontekster. Markeringen betyder primært, at input og cachelæsning er gået over på et højere prisniveau. Det betyder ikke, at alle omkostninger for hele anmodningen ganske enkelt er fordoblet; output kan være underlagt en anden trinfaktor.</p><p></p><p><strong> ## Sådan undgår du trindelt prissætning</strong></p><p>Hvis du ikke har brug for et kontekstvindue på 1M tokens, anbefales det at justere Codex' kontekstgrænse tilbage til højst 272K.</p><p></p><p>Åbn:</p><p> ~/.codex/config.toml</p><p></p><p>Skift den tidligere 1M-konfiguration:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>til:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Gem filen, genstart Codex, og opret en ny session.</p><p></p><p>Hvis ændringen kun skal gælde midlertidigt for en enkelt session, kan du bruge:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det anbefales også at:</p><p> - aktivere automatisk komprimering i tide;</p><p> - dele meget lange opgaver op i flere sessioner;</p><p> - begrænse store mængder værktøjsoutput, der returneres på én gang;</p><p> - opsummere og rydde op i ældre samtaleindhold regelmæssigt.</p><p></p><p>Hvis du faktisk har brug for et kontekstvindue på 1M tokens, kan du fortsætte med den oprindelige konfiguration, men tokens over 272K vil blive faktureret efter OpenAIs højere prisniveau.</p><p></p><p>Se den oprindelige konfigurationsvejledning her: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Sådan aktiverer du et kontekstvindue på 1 million tokens for GPT-5.6 Sol i Codex </a></p><p></p><p>Tak for din forståelse og støtte.</p>
  • 0 Votes
    1 Posts
    1 Views
    A
    <p>Az OpenAI legújabb díjszabási szabályai alapján a GPT-5.6 Sol és más modellek sávos árazást alkalmaznak az extra hosszú kontextust használó kérésekre.</p><p>Ha egyetlen kérés kontextusa meghaladja a 272K tokent, a bemenet, a gyorsítótárból történő olvasás és a kimenet magasabb díjsáv szerint kerülhet kiszámításra. Ez a szabály az OpenAI hivatalos árazásából ered, nem pedig az AI-ROUTER ideiglenes felára vagy rendellenes terhelése.</p><p></p><p>Példaként a GPT-5.6 Sol standard árai:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Tétel 272K alatt 272K felett</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Bemenet $5 / 1M token $10 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Gyorsítótárból olvasás $0.50 / 1M token $1 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Kimenet $30 / 1M token $45 / 1M token</code></pre><p></p><p>A végső költséget továbbra is az adott csoport, a fiók szorzója és egyéb díjszabási beállítások alapján számítják ki.</p><p></p><p>Ha a használati előzményekben x2 jelölés jelenik meg, az azt jelenti, hogy a kérés aktiválta az extra hosszú kontextusra vonatkozó sávos díjszabást. Ez a jelölés elsősorban azt mutatja, hogy a bemenet vagy a gyorsítótárból történő olvasás magasabb díjsávba került; nem jelenti azt, hogy a teljes kérés minden költsége egyszerűen megduplázódott. A kimenetre eltérő sávos szorzó vonatkozhat.</p><p></p><p><strong> ## Hogyan kerülhető el a sávos díjszabás aktiválása</strong></p><p>Ha nincs szükség 1M tokenes kontextusablakra, javasoljuk, hogy állítsa vissza a Codex kontextuskorlátját legfeljebb 272K tokenre.</p><p></p><p>Nyissa meg:</p><p> ~/.codex/config.toml</p><p></p><p>A korábbi cikkben szereplő 1M-es beállítás:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>módosítsa erre:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Mentse a módosításokat, indítsa újra a Codexet, majd hozzon létre új munkamenetet.</p><p></p><p>Ha csak ideiglenesen, egyetlen munkamenetre szeretné alkalmazni a beállítást, használhatja ezt:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Emellett javasoljuk:</p><p> - időben kapcsolja be az automatikus tömörítést;</p><p> - ossza fel az extra hosszú feladatokat több munkamenetre;</p><p> - csökkentse az egyszerre visszaadott eszközkimenetek mennyiségét;</p><p> - rendszeresen foglalja össze és tisztítsa meg a korábbi beszélgetési tartalmakat.</p><p></p><p>Ha valóban szüksége van 1M tokenes kontextusablakra, továbbra is használhatja az eredeti konfigurációt, azonban 272K token felett az OpenAI magasabb díjsáv szerinti árazása érvényes.</p><p></p><p>Az eredeti konfiguráció leírását itt találja: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Hogyan engedélyezhető az 1 millió tokenes kontextusablak a GPT-5.6 Solhoz a Codexben </a></p><p></p><p>Köszönjük megértését és támogatását.</p>
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>OpenAI의 최신 과금 규칙에 따라 GPT-5.6 Sol 등의 모델은 초장문 컨텍스트 요청에 단계별 요금을 적용합니다.</p><p>단일 요청의 컨텍스트가 272K tokens를 초과하면 입력, 캐시 읽기 및 출력에 더 높은 단계의 요금이 적용될 수 있습니다. 이 규칙은 OpenAI의 공식 가격 정책에 따른 것이며, AI-ROUTER가 임시로 요금을 인상했거나 비정상적으로 과금한 것이 아닙니다.</p><p></p><p>GPT-5.6 Sol 표준 요금을 예로 들면 다음과 같습니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 항목 272K 이하 272K 초과</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 입력 $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 캐시 읽기 $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 출력 $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>최종 비용은 구체적인 그룹, 계정 배율 및 기타 과금 설정에 따라 계산됩니다.</p><p></p><p>사용 기록에 x2 표시가 나타나는 것은 해당 요청이 초장문 컨텍스트 단계별 과금을 적용받았다는 의미입니다. 이 표시는 주로 입력 및 캐시 읽기가 더 높은 단계에 진입했음을 나타내며, 요청 전체의 모든 비용이 단순히 2배가 되었다는 뜻은 아닙니다. 출력에는 다른 단계별 배율이 적용될 수 있습니다.</p><p></p><p><strong> ## 단계별 과금 적용을 피하는 방법</strong></p><p>1M Token 컨텍스트 창이 필요하지 않다면 Codex의 컨텍스트 한도를 272K 이하로 다시 조정하는 것이 좋습니다.</p><p></p><p>다음 파일을 엽니다.</p><p> ~/.codex/config.toml</p><p></p><p>기존 글의 1M 설정:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>다음과 같이 변경합니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>저장한 후 Codex를 다시 시작하고 새 세션을 만듭니다.</p><p></p><p>특정 세션 하나에만 임시로 적용하려면 다음 명령을 사용할 수 있습니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> 다음 사항도 권장합니다.</p><p> - 자동 압축을 적시에 활성화합니다.</p><p> - 초장문 작업을 여러 세션으로 나눕니다.</p><p> - 한 번에 반환되는 대량의 도구 출력을 줄입니다.</p><p> - 정기적으로 대화를 요약하고 오래된 대화 내용을 정리합니다.</p><p></p><p>1M Token 컨텍스트 창이 실제로 필요하다면 기존 설정을 계속 사용할 수 있습니다. 다만 272K를 초과하는 부분에는 OpenAI의 더 높은 단계 요금이 적용됩니다.</p><p></p><p>기존 설정 안내는 다음을 참고하세요: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Codex에서 GPT-5.6 Sol에 100만 Token 컨텍스트 창을 활성화하는 방법 </a></p><p></p><p>이해와 지원에 감사드립니다.</p>
  • 0 Votes
    1 Posts
    4 Views
    A
    <p>Enligt OpenAI:s senaste prisregler använder modeller som GPT-5.6 Sol trappstegsbaserade priser för förfrågningar med extra långa kontexter.</p><p>När kontexten i en enskild förfrågan överstiger 272K tokens kan indata, läsning från cache och utdata beräknas enligt en högre prisnivå. Regeln kommer från OpenAI:s officiella prissättning och innebär inte ett tillfälligt påslag eller en felaktig debitering från AI-ROUTER.</p><p></p><p>Som exempel kan GPT-5.6 Sol:s standardpriser sammanfattas så här:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Post Inom 272K Över 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Indata $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cacheläsning $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Utdata $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den slutliga kostnaden beräknas fortfarande utifrån den specifika gruppen, kontots multiplikator och andra prisinställningar.</p><p></p><p>Om en x2-markering visas i användningshistoriken betyder det att förfrågan har utlösts av trappstegsbaserad prissättning för lång kontext. Markeringen innebär främst att indata och cacheläsning har gått över till en högre prisnivå. Det betyder inte att alla kostnader för hela förfrågan helt enkelt har fördubblats; utdata kan ha en annan trappstegsmultiplikator.</p><p></p><p><strong> ## Så undviker du trappstegsbaserad prissättning</strong></p><p>Om du inte behöver ett kontextfönster på 1M tokens rekommenderas att du justerar Codex kontextgräns till högst 272K.</p><p></p><p>Öppna:</p><p> ~/.codex/config.toml</p><p></p><p>Ändra den tidigare konfigurationen för 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>till:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Spara filen, starta om Codex och skapa en ny session.</p><p></p><p>Om du bara vill att ändringen ska gälla tillfälligt för en enskild session kan du använda:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det rekommenderas även att:</p><p> - aktivera automatisk komprimering i tid;</p><p> - dela upp långa uppgifter i flera sessioner;</p><p> - minska mängden verktygsutdata som returneras på en gång;</p><p> - regelbundet sammanfatta och rensa bort äldre konversationsinnehåll.</p><p></p><p>Om du faktiskt behöver ett kontextfönster på 1M tokens kan du fortsätta använda den ursprungliga konfigurationen, men tokens över 272K debiteras enligt OpenAI:s högre prisnivå.</p><p></p><p>Den ursprungliga konfigurationsbeskrivningen finns här: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Så aktiverar du ett kontextfönster på 1 miljon tokens i Codex för GPT-5.6 Sol </a></p><p></p><p>Tack för er förståelse och ert stöd.</p>
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>Nach den neuesten Abrechnungsregeln von OpenAI verwenden Modelle wie GPT-5.6 Sol für Anfragen mit überlangen Kontexten gestaffelte Preise.</p><p>Wenn der Kontext einer einzelnen Anfrage 272K Tokens überschreitet, können Eingabe, Cache-Lesevorgänge und Ausgabe nach einer höheren Preisstufe berechnet werden. Diese Regel stammt aus der offiziellen Preisgestaltung von OpenAI und stellt weder einen vorübergehenden Aufschlag von AI-ROUTER noch eine fehlerhafte Abrechnung dar.</p><p></p><p>Beispiel anhand der Standardpreise für GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Position Bis 272K Über 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Eingabe $5 / 1M Tokens $10 / 1M Tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cache-Lesevorgang $0.50 / 1M Tokens $1 / 1M Tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ausgabe $30 / 1M Tokens $45 / 1M Tokens</code></pre><p></p><p>Die endgültigen Kosten werden weiterhin anhand der jeweiligen Gruppe, des Kontomultiplikators und weiterer Abrechnungseinstellungen berechnet.</p><p></p><p>Wenn in den Nutzungsdaten das Kennzeichen x2 erscheint, bedeutet dies, dass für diese Anfrage die gestaffelte Abrechnung für lange Kontexte ausgelöst wurde. Das Kennzeichen weist hauptsächlich darauf hin, dass Eingabe und Cache-Lesevorgänge in eine höhere Preisstufe fallen. Es bedeutet nicht, dass alle Kosten der gesamten Anfrage einfach verdoppelt werden; für die Ausgabe kann ein anderer Staffelmultiplikator gelten.</p><p></p><p><strong> ## So vermeiden Sie die gestaffelte Abrechnung</strong></p><p>Wenn Sie kein Kontextfenster von 1M Tokens benötigen, empfiehlt es sich, das Codex-Kontextlimit wieder auf höchstens 272K zu setzen.</p><p></p><p>Öffnen Sie:</p><p> ~/.codex/config.toml</p><p></p><p>Ändern Sie die ursprünglich im Artikel beschriebene 1M-Konfiguration:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>in:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Speichern Sie die Datei, starten Sie Codex neu und beginnen Sie eine neue Sitzung.</p><p></p><p>Wenn die Änderung nur vorübergehend für eine einzelne Sitzung gelten soll, können Sie Folgendes verwenden:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Zusätzlich wird empfohlen:</p><p> - die automatische Komprimierung rechtzeitig zu aktivieren;</p><p> - sehr lange Aufgaben auf mehrere Sitzungen aufzuteilen;</p><p> - die Menge umfangreicher Tool-Ausgaben in einer einzelnen Antwort zu reduzieren;</p><p> - frühere Gesprächsinhalte regelmäßig zusammenzufassen und zu bereinigen.</p><p></p><p>Wenn Sie tatsächlich ein Kontextfenster von 1M Tokens benötigen, können Sie die ursprüngliche Konfiguration weiterhin verwenden. Für den Anteil über 272K werden dann jedoch die höheren Preisstufen von OpenAI berechnet.</p><p></p><p>Die ursprüngliche Konfigurationsanleitung finden Sie hier: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">So aktivieren Sie ein Kontextfenster von 1 Million Tokens für GPT-5.6 Sol in Codex </a></p><p></p><p>Vielen Dank für Ihr Verständnis und Ihre Unterstützung.</p>
  • 0 Votes
    1 Posts
    1 Views
    A
    <p>בהתאם לכללי התמחור העדכניים של OpenAI, מודלים כגון GPT-5.6 Sol משתמשים בתמחור מדורג עבור בקשות עם הקשר ארוך במיוחד.</p><p>כאשר ההקשר של בקשה יחידה עולה על 272K טוקנים, הקלט, קריאת המטמון והפלט עשויים להיות מחויבים לפי מדרגת תמחור גבוהה יותר. כלל זה מבוסס על התמחור הרשמי של OpenAI, ואינו תוספת מחיר זמנית או חיוב חריג מצד AI-ROUTER.</p><p></p><p>לדוגמה, המחיר הסטנדרטי של GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> פריט עד 272K מעל 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> קלט $5 / 1M טוקנים $10 / 1M טוקנים</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> קריאת מטמון $0.50 / 1M טוקנים $1 / 1M טוקנים</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> פלט $30 / 1M טוקנים $45 / 1M טוקנים</code></pre><p></p><p>העלות הסופית עדיין תחושב בהתאם לקבוצה הספציפית, למכפיל החשבון ולהגדרות חיוב נוספות.</p><p></p><p>כאשר מופיע הסימון x2 ברשומות השימוש, פירוש הדבר הוא שהבקשה הפעילה את תמחור המדרגה עבור הקשר ארוך. הסימון מציין בעיקר שהקלט או קריאת המטמון נכנסו למדרגת תמחור גבוהה יותר, ואינו אומר שכל העלויות של הבקשה הוכפלו באופן פשוט; הפלט עשוי להשתמש במכפיל מדרגה שונה.</p><p></p><p><strong> ## כיצד להימנע מהפעלת תמחור מדורג</strong></p><p>אם אין צורך בחלון הקשר של 1M טוקנים, מומלץ להגדיר את מגבלת ההקשר של Codex מחדש ל-272K או פחות.</p><p></p><p>פתחו את:</p><p> ~/.codex/config.toml</p><p></p><p>החליפו את ההגדרה של 1M טוקנים מהמאמר המקורי:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>בהגדרות הבאות:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>לאחר השמירה, הפעילו מחדש את Codex ופתחו שיחה חדשה.</p><p></p><p>אם ברצונכם להחיל את ההגדרה באופן זמני על שיחה יחידה בלבד, ניתן להשתמש בפקודה:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> כמו כן, מומלץ:</p><p> - להפעיל דחיסה אוטומטית בזמן;</p><p> - לפצל משימות ארוכות במיוחד למספר שיחות;</p><p> - לצמצם את כמות פלט הכלים המוחזרת בבת אחת;</p><p> - לסכם ולנקות באופן קבוע תוכן מוקדם יותר בשיחה.</p><p></p><p>אם אכן נדרש חלון הקשר של 1M טוקנים, ניתן להמשיך להשתמש בהגדרה המקורית, אך על החלק שמעל 272K יחול תמחור המדרגה הגבוהה של OpenAI.</p><p></p><p>להסבר על ההגדרה המקורית, ראו: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">כיצד להפעיל חלון הקשר של מיליון טוקנים עבור GPT-5.6 Sol ב-Codex </a></p><p></p><p>תודה על ההבנה והתמיכה.</p>
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>Volgens de nieuwste prijsregels van OpenAI geldt voor modellen zoals GPT-5.6 Sol getrapte prijsstelling voor verzoeken met extra lange contexten.</p><p>Wanneer de context van één verzoek meer dan 272K tokens bevat, kunnen invoer, lezen uit de cache en uitvoer volgens een hoger tariefniveau worden berekend. Deze regel is afkomstig uit de officiële prijsstelling van OpenAI en is geen tijdelijke toeslag of abnormale afschrijving van AI-ROUTER.</p><p></p><p>Bij wijze van voorbeeld, op basis van de standaardprijzen van GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Onderdeel Tot en met 272K Meer dan 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Invoer $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lezen uit cache $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Uitvoer $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>De uiteindelijke kosten worden nog steeds berekend op basis van de specifieke groep, de accountvermenigvuldigingsfactor en andere factureringsinstellingen.</p><p></p><p>De markering x2 in de gebruiksgegevens betekent dat dit verzoek de getrapte prijsstelling voor lange contexten heeft geactiveerd. Deze markering geeft voornamelijk aan dat invoer en lezen uit de cache in een hoger tariefniveau vallen. Dit betekent niet dat alle kosten van het volledige verzoek eenvoudigweg worden verdubbeld; voor uitvoer kan een andere tariefvermenigvuldigingsfactor gelden.</p><p></p><p><strong> ## Zo voorkom je getrapte prijsstelling</strong></p><p>Als je geen contextvenster van 1M tokens nodig hebt, wordt aanbevolen om de contextlimiet van Codex terug te zetten naar maximaal 272K.</p><p></p><p>Open:</p><p> ~/.codex/config.toml</p><p></p><p>Vervang de 1M-configuratie uit het oorspronkelijke artikel:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>door:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Sla het bestand op, start Codex opnieuw en maak een nieuwe sessie aan.</p><p></p><p>Als je dit alleen tijdelijk voor één sessie wilt instellen, kun je het volgende gebruiken:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Daarnaast wordt het volgende aanbevolen:</p><p> - Schakel tijdig automatische compressie in;</p><p> - Splits lange taken op in meerdere sessies;</p><p> - Beperk de hoeveelheid tooluitvoer die in één keer wordt teruggestuurd;</p><p> - Vat oudere gespreksinhoud regelmatig samen en ruim deze op.</p><p></p><p>Als je daadwerkelijk een contextvenster van 1M tokens nodig hebt, kun je de oorspronkelijke configuratie blijven gebruiken. Voor het gedeelte boven 272K worden dan echter de hogere tariefniveaus van OpenAI toegepast.</p><p></p><p>Raadpleeg voor de oorspronkelijke configuratie-instructies: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Zo schakel je een contextvenster van 1 miljoen tokens in Codex in voor GPT-5.6 Sol </a></p><p></p><p>Bedankt voor je begrip en steun.</p>
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>Según las últimas reglas de facturación de OpenAI, modelos como GPT-5.6 Sol utilizan precios escalonados para las solicitudes con contextos ultralargos.</p><p>Cuando el contexto de una solicitud individual supera los 272K tokens, la entrada, la lectura de caché y la salida pueden calcularse según precios de niveles superiores. Esta regla procede de los precios oficiales de OpenAI y no representa un recargo temporal ni un cobro anómalo de AI-ROUTER.</p><p></p><p>Tomando como ejemplo los precios estándar de GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Concepto Hasta 272K Más de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrada $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lectura de caché $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Salida $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>El coste final seguirá calculándose según el grupo específico, el multiplicador de la cuenta y otras configuraciones de facturación.</p><p></p><p>La aparición de la marca x2 en el historial de uso indica que la solicitud activó la tarificación escalonada para contextos largos. Esta marca indica principalmente que la entrada o la lectura de caché pasó a un nivel superior, y no significa que todos los costes de la solicitud se hayan duplicado de forma simple; la salida puede utilizar un multiplicador escalonado diferente.</p><p></p><p><strong> ## Cómo evitar activar la tarificación escalonada</strong></p><p>Si no necesitas una ventana de contexto de 1M de tokens, se recomienda ajustar el límite de contexto de Codex a 272K o menos.</p><p></p><p>Abre:</p><p> ~/.codex/config.toml</p><p></p><p>La configuración de 1M utilizada en el artículo anterior:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Ajústala a:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Guarda los cambios, reinicia Codex y crea una sesión nueva.</p><p></p><p>Si solo quieres aplicar el cambio temporalmente a una sesión individual, puedes utilizar:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> También se recomienda:</p><p> - Activar la compactación automática a tiempo;</p><p> - Dividir las tareas muy largas en varias sesiones;</p><p> - Reducir la cantidad de resultados de herramientas que se devuelven de una sola vez;</p><p> - Resumir periódicamente y limpiar el contenido antiguo de la conversación.</p><p></p><p>Si realmente necesitas una ventana de contexto de 1M de tokens, puedes seguir utilizando la configuración original, pero los tokens que superen los 272K se facturarán según los precios de nivel superior de OpenAI.</p><p></p><p>Consulta la explicación de la configuración original en: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Cómo habilitar una ventana de contexto de 1 millón de tokens para GPT-5.6 Sol en Codex </a></p><p></p><p>Gracias por tu comprensión y apoyo.</p>
  • 0 Votes
    1 Posts
    1 Views
    A
    <p>Selon les dernières règles de facturation d’OpenAI, les modèles tels que GPT-5.6 Sol appliquent une tarification progressive aux requêtes utilisant un contexte ultra-long.</p><p>Lorsque le contexte d’une requête dépasse 272K tokens, les tokens d’entrée, de lecture du cache et de sortie peuvent être facturés selon un niveau tarifaire supérieur. Cette règle provient de la tarification officielle d’OpenAI ; il ne s’agit pas d’une majoration temporaire ni d’une facturation anormale d’AI-ROUTER.</p><p></p><p>À titre d’exemple, voici les tarifs standard de GPT-5.6 Sol :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Élément Jusqu’à 272K Au-delà de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrée $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lecture cache $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Sortie $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Le coût final dépend toujours du groupe concerné, du multiplicateur du compte et des autres paramètres de facturation.</p><p></p><p>La présence du marqueur x2 dans l’historique d’utilisation signifie que la requête a déclenché la tarification progressive du contexte long. Ce marqueur indique principalement que l’entrée et la lecture du cache sont passées au niveau tarifaire supérieur ; il ne signifie pas que tous les frais de la requête ont simplement doublé. La sortie peut être soumise à un multiplicateur différent selon le niveau tarifaire.</p><p></p><p><strong>## Comment éviter de déclencher la tarification progressive</strong></p><p>Si vous n’avez pas besoin d’une fenêtre de contexte de 1M tokens, il est recommandé de ramener la limite de contexte de Codex à 272K ou moins.</p><p></p><p>Ouvrez :</p><p> ~/.codex/config.toml</p><p></p><p>Remplacez la configuration de 1M tokens indiquée dans l’article précédent :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>par :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Enregistrez le fichier, redémarrez Codex et créez une nouvelle session.</p><p></p><p>Pour appliquer temporairement ces paramètres à une seule session, utilisez :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Il est également recommandé de :</p><p> - activer rapidement la compression automatique ;</p><p> - diviser les tâches très longues en plusieurs sessions ;</p><p> - réduire la quantité de sorties d’outils renvoyées en une seule fois ;</p><p> - résumer et nettoyer régulièrement le contenu plus ancien des conversations.</p><p></p><p>Si vous avez réellement besoin d’une fenêtre de contexte de 1M tokens, vous pouvez continuer à utiliser la configuration d’origine, mais les tokens au-delà de 272K seront facturés selon les tarifs élevés des niveaux supérieurs d’OpenAI.</p><p></p><p>Pour consulter les explications relatives à la configuration d’origine, reportez-vous à : <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Comment activer une fenêtre de contexte de 1 million de tokens dans Codex pour GPT-5.6 Sol </a></p><p></p><p>Merci de votre compréhension et de votre soutien.</p>
  • 0 Votes
    1 Posts
    4 Views
    A
    <p>I henhold til OpenAIs nyeste prisregler bruker GPT-5.6 Sol og tilsvarende modeller trinnvis prising for forespørsler med ekstra lang kontekst.</p><p>Når konteksten i en enkelt forespørsel overstiger 272K tokens, kan input, lesing fra hurtigbuffer og output beregnes etter et høyere prisnivå. Denne regelen kommer fra OpenAIs offisielle prissetting og er ikke et midlertidig pristillegg eller en feilaktig belastning fra AI-ROUTER.</p><p></p><p>Eksempel med standardprisene for GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Element Innenfor 272K Over 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Hurtigbuffer- $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> lesing</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den endelige kostnaden beregnes fortsatt ut fra den konkrete gruppen, kontomultiplikatoren og andre prisinnstillinger.</p><p></p><p>En x2-markering i bruksoversikten betyr at forespørselen utløste trinnvis prising for lang kontekst. Markeringen betyr hovedsakelig at input og lesing fra hurtigbuffer har gått inn på et høyere prisnivå. Det betyr ikke at alle kostnadene for hele forespørselen enkelt dobles; output kan bruke en annen trinnvis multiplikator.</p><p></p><p><strong> ## Slik unngår du trinnvis prising</strong></p><p>Hvis du ikke trenger et kontekstvindu på 1M tokens, anbefales det å justere Codex-kontekstgrensen tilbake til 272K eller mindre.</p><p></p><p>Åpne:</p><p> ~/.codex/config.toml</p><p></p><p>Endre den tidligere 1M-konfigurasjonen:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>til:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Lagre endringene, start Codex på nytt og opprett en ny økt.</p><p></p><p>Hvis du bare vil bruke innstillingen midlertidig for én enkelt økt, kan du bruke:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det anbefales også å:</p><p> - aktivere automatisk komprimering i tide;</p><p> - dele opp lange oppgaver i flere økter;</p><p> - redusere mengden verktøyoutput som returneres på én gang;</p><p> - oppsummere og rydde bort eldre samtaleinnhold regelmessig.</p><p></p><p>Hvis du faktisk trenger et kontekstvindu på 1M tokens, kan du fortsette å bruke den opprinnelige konfigurasjonen. Når konteksten overstiger 272K, beregnes kostnadene imidlertid etter OpenAIs høyere prisnivå.</p><p></p><p>Du finner den opprinnelige konfigurasjonsveiledningen her: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Slik aktiverer du et kontekstvindu på 1 million tokens i Codex for GPT-5.6 Sol </a></p><p></p><p>Takk for forståelsen og støtten.</p>
  • 0 Votes
    1 Posts
    1 Views
    A
    <p>وفقًا لأحدث قواعد الفوترة لدى OpenAI، تستخدم نماذج مثل GPT-5.6 Sol أسعارًا متدرجة للطلبات ذات السياق فائق الطول.</p><p>عندما يتجاوز سياق الطلب الواحد 272 ألف رمز، قد تُحتسب تكلفة الإدخال وقراءة التخزين المؤقت والإخراج وفق شريحة سعرية أعلى. وتأتي هذه القاعدة من التسعير الرسمي لدى OpenAI، وليست زيادة مؤقتة في الأسعار أو خصمًا غير معتاد من AI-ROUTER.</p><p></p><p>على سبيل المثال، وفق الأسعار القياسية لـ GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> العنصر حتى 272K أكثر من 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> الإدخال $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> قراءة التخزين المؤقت $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> الإخراج $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>تُحتسب التكلفة النهائية وفق المجموعة المحددة، ومعامل الحساب، وإعدادات الفوترة الأخرى.</p><p></p><p>ظهور علامة x2 في سجل الاستخدام يعني أن هذا الطلب فعّل التسعير المتدرج للسياق الطويل. وتشير هذه العلامة أساسًا إلى أن الإدخال وقراءة التخزين المؤقت انتقلا إلى شريحة سعرية أعلى، ولا تعني أن جميع تكاليف الطلب تضاعفت ببساطة؛ فقد يستخدم الإخراج معاملًا مختلفًا حسب الشريحة.</p><p></p><p><strong> ## كيفية تجنب تفعيل التسعير المتدرج</strong></p><p>إذا لم تكن بحاجة إلى نافذة سياق بسعة مليون رمز، فمن المستحسن ضبط الحد الأقصى لسياق Codex مجددًا إلى 272 ألف رمز أو أقل.</p><p></p><p>افتح:</p><p> ~/.codex/config.toml</p><p></p><p>استبدل إعداد المليون رمز الوارد في المقالة السابقة:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>بالإعدادات التالية:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>بعد الحفظ، أعد تشغيل Codex وأنشئ جلسة جديدة.</p><p></p><p>إذا كنت تريد تطبيق الإعداد مؤقتًا على جلسة واحدة فقط، يمكنك استخدام:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> يُنصح أيضًا بما يلي:</p><p> - تفعيل الضغط التلقائي في الوقت المناسب؛</p><p> - تقسيم المهام الطويلة جدًا إلى عدة جلسات؛</p><p> - تقليل كمية مخرجات الأدوات التي يتم إرجاعها دفعة واحدة؛</p><p> - تلخيص محتوى المحادثات الأقدم وتنظيفه بانتظام.</p><p></p><p>إذا كنت تحتاج فعلًا إلى نافذة سياق بسعة مليون رمز، يمكنك الاستمرار في استخدام الإعدادات الأصلية، لكن سيتم احتساب الجزء الذي يتجاوز 272 ألف رمز وفق الأسعار الأعلى للشريحة التي تحددها OpenAI.</p><p></p><p>للاطلاع على شرح الإعدادات الأصلية، يُرجى الرجوع إلى: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">كيفية تفعيل نافذة سياق بسعة مليون رمز لـ GPT-5.6 Sol في Codex </a></p><p></p><p>شكرًا لتفهمكم ودعمكم.</p>
  • 0 Votes
    1 Posts
    4 Views
    A
    <p>OpenAIの最新の料金ルールに基づき、GPT-5.6 Solなどのモデルでは、超長コンテキストリクエストに段階料金が適用されます。</p><p>1回のリクエストでコンテキストが272Kトークンを超えると、入力、キャッシュ読み取り、出力に対して、より高い段階の料金が適用される場合があります。このルールはOpenAI公式の料金体系によるものであり、AI-ROUTERによる一時的な上乗せ料金や異常な請求ではありません。</p><p></p><p>GPT-5.6 Solの標準料金を例にすると、次のようになります。</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 項目 272K以内 272K超過</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 入力 $5 / 1Mトークン $10 / 1Mトークン</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> キャッシュ読み取り $0.50 / 1Mトークン $1 / 1Mトークン</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 出力 $30 / 1Mトークン $45 / 1Mトークン</code></pre><p></p><p>最終的な料金は、具体的なグループ、アカウント倍率、その他の料金設定に基づいて計算されます。</p><p></p><p>利用記録にx2フラグが表示されている場合、そのリクエストで長いコンテキスト向けの段階料金が適用されたことを示します。このフラグは主に、入力やキャッシュ読み取りがより高い段階に移行したことを示すものであり、リクエスト全体のすべての料金が単純に2倍になったことを意味するわけではありません。出力には異なる段階倍率が適用される場合があります。</p><p></p><p><strong> ## 段階料金の適用を避ける方法</strong></p><p>1Mトークンのコンテキストウィンドウが不要な場合は、Codexのコンテキスト上限を272K以内に戻すことをおすすめします。</p><p></p><p>次のファイルを開きます。</p><p> ~/.codex/config.toml</p><p></p><p>記事内で以前使用していた1M設定:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>次のように変更します。</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>保存後、Codexを再起動して新しいセッションを開始します。</p><p></p><p>単一のセッションに一時的にのみ適用したい場合は、次のコマンドを使用できます。</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> あわせて、次の対策もおすすめします。</p><p> - 自動圧縮を適時有効にする;</p><p> - 長時間のタスクを複数のセッションに分割する;</p><p> - 1回の応答で大量のツール出力を返さないようにする;</p><p> - 定期的に要約し、古い会話内容を整理する。</p><p></p><p>1Mトークンのコンテキストウィンドウが本当に必要な場合は、元の設定を引き続き使用できます。ただし、272Kを超えた部分には、OpenAIの高い段階の料金が適用されます。</p><p></p><p>元の設定については、次の記事を参照してください:<a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">CodexでGPT-5.6 Solの100万トークンコンテキストウィンドウを有効にする方法 </a></p><p></p><p>ご理解とご支援に感謝いたします。</p>
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>According to OpenAI's latest billing rules, models such as GPT-5.6 Sol use tiered pricing for ultra-long context requests.</p><p>When the context of a single request exceeds 272K tokens, input, cached reads, and output may be billed at higher tier prices. This rule comes from OpenAI's official pricing and is not a temporary surcharge or abnormal charge from AI-ROUTER.</p><p></p><p>Using GPT-5.6 Sol's standard prices as an example:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Item Within 272K Over 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cached reads $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>The final cost is still calculated based on the specific group, account multiplier, and other billing settings.</p><p></p><p>If an x2 flag appears in usage records, it means that the request triggered tiered billing for long contexts. This flag mainly indicates that input or cached reads entered a higher tier; it does not mean that all charges for the request were simply doubled. Output may use a different tier multiplier.</p><p></p><p><strong> ## How to Avoid Triggering Tiered Billing</strong></p><p>If you do not need a 1M-token context window, we recommend adjusting Codex's context limit back to within 272K.</p><p></p><p>Open:</p><p> ~/.codex/config.toml</p><p></p><p>Change the 1M configuration from the original article:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>To:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Save the changes, restart Codex, and start a new session.</p><p></p><p>If you only want this to apply temporarily to a single session, you can use:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> We also recommend:</p><p> - Enable automatic compaction promptly;</p><p> - Split ultra-long tasks across multiple sessions;</p><p> - Reduce the amount of tool output returned at once;</p><p> - Periodically summarize and clear older conversation content.</p><p></p><p>If you do need a 1M-token context window, you can continue using the original configuration, but usage beyond 272K will be billed according to OpenAI's higher tier pricing.</p><p></p><p>For the original configuration instructions, see: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">How to Enable a 1M-Token Context Window in Codex for GPT-5.6 Sol </a></p><p></p><p>Thank you for your understanding and support.</p>
  • 0 Votes
    1 Posts
    5 Views
    A
    <p>根据 OpenAI 最新计费规则,GPT-5.6 Sol 等模型对超长上下文请求采用阶梯价格。</p><p>当单次请求的上下文超过 272K tokens 时,输入、缓存读取以及输出可能按照更高阶梯价格计算。该规则来自 OpenAI 官方定价,并非 AI-ROUTER 临时加价或异常扣费。</p><p></p><p>以 GPT-5.6 Sol 标准价格为例:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 项目 272K 以内 超过 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 输入 $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 缓存读取 $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 输出 $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>最终费用仍会根据具体分组、账号倍率及其他计费配置计算。</p><p></p><p>使用记录中出现 x2 标志,表示本次请求触发了长上下文阶梯计费。该标志主要表示输入/缓存读取进入更高阶梯,并不代表整条请求的所有费用简单翻倍;输出可能采用不同的阶梯倍率。</p><p></p><p><strong> ## 如何避免触发阶梯计费</strong></p><p>如果不需要 1M Token 上下文窗口,建议将 Codex 的上下文上限调整回 272K 以内。</p><p></p><p>打开:</p><p> ~/.codex/config.toml</p><p></p><p>将原先文章中的 1M 配置:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>调整为:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>保存后重启 Codex,并新建会话。</p><p></p><p>如果只希望临时对单个会话生效,可以使用:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> 同时建议:</p><p> - 及时开启自动压缩;</p><p> - 将超长任务拆分为多个会话;</p><p> - 减少一次性返回的大量工具输出;</p><p> - 定期总结并清理较早的对话内容。</p><p></p><p>如果确实需要 1M Token 上下文窗口,可以继续使用原配置,但超出 272K 后将按照 OpenAI 的高阶梯价格计费。</p><p></p><p>原始配置说明请参考:<a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">如何在 Codex 中为 GPT-5.6 Sol 启用 100 万 Token 上下文窗口 </a></p><p></p><p>感谢您的理解与支持。</p>
  • 0 Votes
    1 Posts
    78 Views
    A
    <p>OpenAI-nin ən son tarif qaydalarına əsasən, GPT-5.6 Sol kimi modellər çox uzun kontekstli sorğular üçün pilləli qiymətlərdən istifadə edir.</p><p>Bir sorğunun konteksti 272K tokeni aşdıqda, giriş, keşdən oxuma və çıxış daha yüksək pillə üzrə qiymətləndirilə bilər. Bu qayda OpenAI-nin rəsmi qiymət siyasətindən irəli gəlir və AI-ROUTER-in müvəqqəti qiymət artımı və ya qeyri-adi ödənişi deyil.</p><p></p><p>GPT-5.6 Sol-un standart qiymətini nümunə kimi götürək:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Bölmə 272K daxilində 272K-dan çox</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Giriş $5 / 1M token $10 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Keşdən oxuma $0.50 / 1M token $1 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Çıxış $30 / 1M token $45 / 1M token</code></pre><p></p><p>Yekun məbləğ konkret qruplaşdırma, hesab əmsalı və digər tarif parametrlərinə əsasən hesablanır.</p><p></p><p>İstifadə qeydlərində x2 işarəsinin görünməsi bu sorğunun uzun kontekst üzrə pilləli tarifləndirməni işə saldığını göstərir. Bu işarə əsasən girişin və keşdən oxumanın daha yüksək pilləyə keçdiyini bildirir və sorğunun bütün xərclərinin sadəcə ikiqat artdığı anlamına gəlmir; çıxış üçün fərqli pillə əmsalı tətbiq oluna bilər.</p><p></p><p><strong> ## Pilləli tarifləndirmənin işə düşməsinin qarşısını necə almaq olar</strong></p><p>1M tokenlik kontekst pəncərəsinə ehtiyac yoxdursa, Codex-in kontekst limitini 272K və ya daha aşağı səviyyəyə qaytarmaq tövsiyə olunur.</p><p></p><p>Bu faylı açın:</p><p> ~/.codex/config.toml</p><p></p><p>Əvvəlki məqalədəki 1M konfiqurasiyasını:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>aşağıdakı ilə əvəz edin:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Faylı yadda saxladıqdan sonra Codex-i yenidən başladın və yeni sessiya yaradın.</p><p></p><p>Yalnız bir sessiya üçün müvəqqəti tətbiq etmək istəyirsinizsə, aşağıdakı əmrdən istifadə edə bilərsiniz:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Həmçinin aşağıdakılar tövsiyə olunur:</p><p> - avtomatik sıxışdırmanı vaxtında aktivləşdirin;</p><p> - çox uzun tapşırıqları bir neçə sessiyaya bölün;</p><p> - bir dəfəyə qaytarılan çoxsaylı alət çıxışlarını azaldın;</p><p> - əvvəlki söhbət məzmununu mütəmadi olaraq ümumiləşdirin və təmizləyin.</p><p></p><p>Əgər həqiqətən 1M tokenlik kontekst pəncərəsinə ehtiyacınız varsa, əvvəlki konfiqurasiyadan istifadə etməyə davam edə bilərsiniz. Lakin 272K tokeni keçdikdən sonra OpenAI-nin yüksək pillə qiymətləri tətbiq olunacaq.</p><p></p><p>Əvvəlki konfiqurasiya haqqında ətraflı məlumat üçün bu məqaləyə baxın: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Codex-də GPT-5.6 Sol üçün 1 milyon tokenlik kontekst pəncərəsini necə aktivləşdirmək olar </a></p><p></p><p>Anlayışınız və dəstəyiniz üçün təşəkkür edirik.</p>
  • 0 Votes
    1 Posts
    81 Views
    A
    <p>Ayon sa pinakabagong tuntunin sa billing ng OpenAI, gumagamit ang mga modelong gaya ng GPT-5.6 Sol ng tiered pricing para sa mga request na may napakahabang context.</p><p>Kapag lumampas sa 272K tokens ang context ng isang request, maaaring singilin ang input, cache read, at output ayon sa mas mataas na tier ng presyo. Nagmula ang tuntuning ito sa opisyal na pricing ng OpenAI at hindi ito pansamantalang dagdag-singil o maling pagsingil ng AI-ROUTER.</p><p></p><p>Bilang halimbawa, narito ang standard na presyo ng GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Item Sa loob ng 272K Higit sa 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cache read $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Ang aktuwal na halaga ay kakalkulahin pa rin batay sa partikular na grupo, account multiplier, at iba pang configuration sa billing.</p><p></p><p>Kapag lumitaw ang x2 flag sa usage record, nangangahulugan itong na-trigger ng request na ito ang tiered billing para sa long context. Pangunahing ipinapahiwatig ng flag na pumasok ang input o cache read sa mas mataas na tier; hindi ito nangangahulugang basta na lang dodoble ang lahat ng bayarin para sa buong request. Maaaring gumamit ang output ng ibang tier multiplier.</p><p></p><p><strong> ## Paano maiiwasang ma-trigger ang tiered billing</strong></p><p>Kung hindi kailangan ang 1M Token context window, inirerekomendang ibalik sa loob ng 272K ang context limit ng Codex.</p><p></p><p>Buksan ang:</p><p> ~/.codex/config.toml</p><p></p><p>Palitan ang 1M configuration mula sa naunang artikulo:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>ng:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Pagkatapos mag-save, i-restart ang Codex at gumawa ng bagong session.</p><p></p><p>Kung pansamantala lamang itong gagamitin para sa isang session, maaaring gamitin ang:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p>Inirerekomenda rin ang mga sumusunod:</p><p> - Agad na paganahin ang awtomatikong compression;</p><p> - Hatiin ang mahahabang gawain sa maraming session;</p><p> - Bawasan ang dami ng tool output na ibinabalik nang sabay-sabay;</p><p> - Regular na ibuod at linisin ang mas naunang nilalaman ng pag-uusap.</p><p></p><p>Kung talagang kailangan ang 1M Token context window, maaari pa ring gamitin ang orihinal na configuration, ngunit kapag lumampas sa 272K, sisingilin ito ayon sa mas mataas na tier ng presyo ng OpenAI.</p><p></p><p>Para sa orihinal na paliwanag tungkol sa configuration, sumangguni sa: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Paano paganahin ang 1 milyong Token context window para sa GPT-5.6 Sol sa Codex </a></p><p></p><p>Salamat sa inyong pag-unawa at suporta.</p>
  • 0 Votes
    1 Posts
    80 Views
    A
    <p>በOpenAI የቅርብ ጊዜ የክፍያ ደንቦች መሠረት፣ እንደ GPT-5.6 Sol ያሉ ሞዴሎች ከመጠን በላይ ረጅም ኮንቴክስት ላላቸው ጥያቄዎች ደረጃዊ ዋጋ ይጠቀማሉ።</p><p>የአንድ ጥያቄ ኮንቴክስት ከ272K tokens በላይ ሲሆን፣ ግብዓት፣ የተሸጎጠ ውሂብ ንባብ እና ውጤት በከፍተኛ የዋጋ ደረጃ ሊተመኑ ይችላሉ። ይህ ደንብ ከOpenAI ይፋዊ የዋጋ መረጃ የመጣ ነው፤ በAI-ROUTER የተደረገ ጊዜያዊ የዋጋ ጭማሪ ወይም ያልተለመደ ክፍያ አይደለም።</p><p></p><p>የGPT-5.6 Sol መደበኛ ዋጋን እንደ ምሳሌ ከወሰድን፦</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ንጥል እስከ 272K ድረስ ከ272K በላይ</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ግብዓት $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> የተሸጎጠ ውሂብ ንባብ $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ውጤት $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>የመጨረሻው ወጪ አሁንም በተወሰነው የሞዴል ቡድን፣ በመለያው ብዜት እና በሌሎች የክፍያ ውቅሮች መሠረት ይቆጠራል።</p><p></p><p>በአጠቃቀም መዝገብ ውስጥ x2 ምልክት መታየቱ ይህ ጥያቄ የረጅም ኮንቴክስት ደረጃዊ ክፍያን እንዳስነሳ ያመለክታል። ይህ ምልክት በዋናነት ግብዓት/የተሸጎጠ ውሂብ ንባብ ወደ ከፍተኛ የዋጋ ደረጃ መግባቱን ያሳያል፤ የጥያቄው አጠቃላይ ወጪ በቀላሉ ሁለት እጥፍ ሆኗል ማለት አይደለም። ውጤት የተለየ የደረጃ ብዜት ሊኖረው ይችላል።</p><p></p><p><strong> ## ደረጃዊ ክፍያ እንዳይተገበር እንዴት መከላከል ይቻላል</strong></p><p>የ1M Token ኮንቴክስት መስኮት ካላስፈለገዎት፣ የCodex ኮንቴክስት ገደብን ወደ272K ውስጥ እንዲሆን ማስተካከል ይመከራል።</p><p></p><p>ይክፈቱ፦</p><p> ~/.codex/config.toml</p><p></p><p>በቀድሞው ጽሑፍ የተጠቀሰውን የ1M ውቅር፦</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>ወደዚህ ይቀይሩት፦</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>ካስቀመጡ በኋላ Codexን እንደገና ያስነሱ እና አዲስ ክፍለ ጊዜ ይፍጠሩ።</p><p></p><p>ለአንድ ክፍለ ጊዜ ብቻ ለጊዜው እንዲሠራ ከፈለጉ፣ ይህን መጠቀም ይችላሉ፦</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> በተጨማሪም የሚከተሉት ይመከራሉ፦</p><p> - የራስ-ሰር መጠቅለያን በወቅቱ ያንቁ፤</p><p> - እጅግ ረጅም ስራዎችን ወደ ብዙ ክፍለ ጊዜዎች ይከፋፍሉ፤</p><p> - በአንድ ጊዜ የሚመለሱ ብዙ የመሣሪያ ውጤቶችን ይቀንሱ፤</p><p> - በየጊዜው ማጠቃለያ ያዘጋጁ እና የቆዩ የውይይት ይዘቶችን ያጽዱ።</p><p></p><p>በእርግጥ የ1M Token ኮንቴክስት መስኮት ካስፈለገዎት፣ የቀድሞውን ውቅር መጠቀምዎን መቀጠል ይችላሉ፤ ነገር ግን ከ272K በላይ ሲሆን በOpenAI ከፍተኛ የዋጋ ደረጃ መሠረት ክፍያ ይተመናል።</p><p></p><p>የመጀመሪያውን የውቅር መመሪያ ለማጣቀሻ፦ <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">በCodex ውስጥ ለGPT-5.6 Sol 1 ሚሊዮን Token ኮንቴክስት መስኮትን እንዴት ማንቃት እንደሚቻል </a></p><p></p><p>ለግንዛቤዎ እና ለድጋፍዎ እናመሰግናለን።</p>
  • 0 Votes
    1 Posts
    63 Views
    A
    <p>Kulingana na sheria za hivi karibuni za bili za OpenAI, miundo kama GPT-5.6 Sol hutumia bei za viwango kwa maombi yenye muktadha mrefu kupita kiasi.</p><p>Wakati muktadha wa ombi moja unapozidi tokeni 272K, ingizo, usomaji wa akiba na matokeo vinaweza kutozwa kwa bei ya kiwango cha juu zaidi. Sheria hii inatokana na bei rasmi za OpenAI, wala si ongezeko la muda la bei au utozaji usio wa kawaida kutoka AI-ROUTER.</p><p></p><p>Kwa mfano, kwa bei ya kawaida ya GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Kipengee Ndani ya 272K Zaidi ya 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ingizo $5 / tokeni 1M $10 / tokeni 1M</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Usomaji wa akiba $0.50 / tokeni 1M $1 / tokeni 1M</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Matokeo $30 / tokeni 1M $45 / tokeni 1M</code></pre><p></p><p>Gharama ya mwisho bado itahesabiwa kulingana na kundi husika, kizidishi cha akaunti na mipangilio mingine ya bili.</p><p></p><p>Alama ya x2 inapoonekana katika rekodi ya matumizi, inaonyesha kuwa ombi hilo limeanzisha bei za kiwango cha juu kwa muktadha mrefu. Alama hii inaonyesha hasa kuwa ingizo/usomaji wa akiba umeingia katika kiwango cha juu zaidi; haimaanishi kuwa gharama zote za ombi zimeongezwa mara mbili kwa urahisi. Matokeo yanaweza kutumia kizidishi tofauti cha kiwango.</p><p></p><p><strong> ## Jinsi ya kuepuka kuanzisha bei za viwango</strong></p><p>Ikiwa huhitaji dirisha la muktadha la Tokeni milioni 1, inashauriwa kurekebisha kikomo cha muktadha cha Codex hadi ndani ya 272K.</p><p></p><p>Fungua:</p><p> ~/.codex/config.toml</p><p></p><p>Badilisha usanidi wa Tokeni milioni 1 kutoka kwenye makala ya awali:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>kuwa:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Hifadhi mabadiliko, kisha uanze upya Codex na uunde kikao kipya.</p><p></p><p>Ikiwa ungependa mipangilio hiyo itumike kwa muda kwenye kikao kimoja pekee, unaweza kutumia:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Pia inapendekezwa:</p><p> - Kuwasha ukandamizaji wa kiotomatiki kwa wakati unaofaa;</p><p> - Kugawanya kazi ndefu sana katika vikao vingi;</p><p> - Kupunguza kiasi kikubwa cha matokeo ya zana yanayorejeshwa kwa wakati mmoja;</p><p> - Kufanya muhtasari na kusafisha maudhui ya mazungumzo ya awali mara kwa mara.</p><p></p><p>Ikiwa kwa kweli unahitaji dirisha la muktadha la Tokeni milioni 1, unaweza kuendelea kutumia usanidi wa awali, lakini sehemu inayozidi 272K itatozwa kwa bei za juu za viwango kulingana na OpenAI.</p><p></p><p>Kwa maelezo ya usanidi wa awali, rejelea: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Jinsi ya kuwezesha muktadha wa Tokeni milioni 1 katika Codex kwa GPT-5.6 Sol </a></p><p></p><p>Asante kwa uelewa na usaidizi wako.</p>
  • 0 Votes
    1 Posts
    70 Views
    A
    <p>OpenAI च्या नवीनतम शुल्क नियमांनुसार, GPT-5.6 Sol सारखी मॉडेल्स अतिदीर्घ संदर्भ विनंत्यांसाठी स्तरित दर लागू करतात.</p><p>एकाच विनंतीचा संदर्भ 272K tokens पेक्षा अधिक झाल्यास, इनपुट, कॅशे वाचन आणि आउटपुट यांची गणना उच्च स्तरावरील दरांनुसार केली जाऊ शकते. हा नियम OpenAI च्या अधिकृत किमतींवर आधारित आहे; तो AI-ROUTER कडून केलेली तात्पुरती अतिरिक्त शुल्क आकारणी किंवा असामान्य कपात नाही.</p><p></p><p>GPT-5.6 Sol च्या मानक किमतींचे उदाहरण:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> घटक 272K च्या आत 272K पेक्षा अधिक</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> इनपुट $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> कॅशे वाचन $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> आउटपुट $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>अंतिम शुल्काची गणना संबंधित गट, खात्याचा गुणक आणि इतर शुल्क कॉन्फिगरेशननुसार केली जाईल.</p><p></p><p>वापराच्या नोंदींमध्ये दिसणारे x2 चिन्ह म्हणजे या विनंतीसाठी अतिदीर्घ संदर्भाची स्तरित शुल्क आकारणी लागू झाली आहे. हे चिन्ह प्रामुख्याने इनपुट किंवा कॅशे वाचन उच्च स्तरावर गेले असल्याचे दर्शवते; संपूर्ण विनंतीवरील सर्व शुल्क साध्या पद्धतीने दुप्पट झाले आहेत, असा त्याचा अर्थ नाही. आउटपुटसाठी वेगळा स्तरित गुणक लागू होऊ शकतो.</p><p></p><p><strong> ## स्तरित शुल्क आकारणी लागू होण्यापासून कसे टाळावे</strong></p><p>1M Token संदर्भ विंडोची आवश्यकता नसल्यास, Codex ची संदर्भ मर्यादा 272K च्या आत समायोजित करण्याची शिफारस केली जाते.</p><p></p><p>ही फाइल उघडा:</p><p> ~/.codex/config.toml</p><p></p><p>मूळ लेखातील 1M कॉन्फिगरेशन:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>याऐवजी पुढील मूल्ये वापरा:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>फाइल जतन केल्यानंतर Codex पुन्हा सुरू करा आणि नवीन सत्र तयार करा.</p><p></p><p>ही सेटिंग फक्त एखाद्या एकाच सत्रासाठी तात्पुरती लागू करायची असल्यास, पुढील कमांड वापरा:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> तसेच पुढील उपाय सुचवले जातात:</p><p> - स्वयंचलित संक्षेपण वेळेवर सुरू करा;</p><p> - अतिदीर्घ काम अनेक सत्रांमध्ये विभागा;</p><p> - एकाच वेळी परत मिळणारे मोठ्या प्रमाणातील टूल आउटपुट कमी करा;</p><p> - जुन्या संभाषणातील मजकुराचा नियमितपणे सारांश तयार करून तो साफ करा.</p><p></p><p>1M Token संदर्भ विंडोची खरोखर आवश्यकता असल्यास, मूळ कॉन्फिगरेशन वापरणे सुरू ठेवू शकता; मात्र 272K पेक्षा अधिक वापरासाठी OpenAI च्या उच्च स्तरावरील दरांनुसार शुल्क आकारले जाईल.</p><p></p><p>मूळ कॉन्फिगरेशनसाठी संदर्भ: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Codex मध्ये GPT-5.6 Sol साठी 1 दशलक्ष Token संदर्भ विंडो कशी सक्षम करावी </a></p><p></p><p>आपल्या समजुतीबद्दल आणि सहकार्याबद्दल धन्यवाद.</p>
  • 0 Votes
    1 Posts
    77 Views
    A
    <p>OpenAI తాజా బిల్లింగ్ నియమాల ప్రకారం, GPT-5.6 Sol వంటి మోడళ్లు సుదీర్ఘ కాంటెక్స్ట్ అభ్యర్థనలకు స్థాయివారీ ధరలను ఉపయోగిస్తాయి.</p><p>ఒక్క అభ్యర్థనలోని కాంటెక్స్ట్ 272K టోకెన్లను మించినప్పుడు, ఇన్‌పుట్, కాష్ రీడ్స్ మరియు అవుట్‌పుట్‌కు అధిక స్థాయి ధరలు వర్తించవచ్చు. ఈ నియమం OpenAI అధికారిక ధరల విధానంలో భాగం; ఇది AI-ROUTER తాత్కాలికంగా విధించిన అదనపు ఛార్జీ లేదా అసాధారణ బిల్లింగ్ కాదు.</p><p></p><p>GPT-5.6 Sol ప్రామాణిక ధరలను ఉదాహరణగా తీసుకుంటే:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> అంశం 272K లోపు 272K మించినప్పుడు</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ఇన్‌పుట్ $5 / 1M టోకెన్లు $10 / 1M టోకెన్లు</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> కాష్ రీడ్స్ $0.50 / 1M టోకెన్లు $1 / 1M టోకెన్లు</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> అవుట్‌పుట్ $30 / 1M టోకెన్లు $45 / 1M టోకెన్లు</code></pre><p></p><p>తుది ఛార్జీ నిర్దిష్ట గ్రూప్, ఖాతా గుణకం మరియు ఇతర బిల్లింగ్ కాన్ఫిగరేషన్‌ల ఆధారంగా లెక్కించబడుతుంది.</p><p></p><p>వినియోగ రికార్డుల్లో కనిపించే x2 గుర్తు, ఈ అభ్యర్థన సుదీర్ఘ కాంటెక్స్ట్ స్థాయివారీ బిల్లింగ్‌ను ప్రేరేపించిందని సూచిస్తుంది. ఈ గుర్తు ప్రధానంగా ఇన్‌పుట్ లేదా కాష్ రీడ్స్ అధిక స్థాయిలోకి వెళ్లినట్లు సూచిస్తుంది. మొత్తం అభ్యర్థనకు సంబంధించిన అన్ని ఛార్జీలు సులభంగా రెట్టింపు అవుతాయని దీని అర్థం కాదు; అవుట్‌పుట్‌కు వేరే స్థాయివారీ గుణకం వర్తించవచ్చు.</p><p></p><p><strong> ## స్థాయివారీ బిల్లింగ్‌ను ఎలా నివారించాలి</strong></p><p>1M టోకెన్ల కాంటెక్స్ట్ విండో అవసరం లేకపోతే, Codex కాంటెక్స్ట్ పరిమితిని 272K లోపు సర్దుబాటు చేయాలని సూచిస్తున్నాము.</p><p></p><p>తెరవండి:</p><p> ~/.codex/config.toml</p><p></p><p>వ్యాసంలోని అసలు 1M కాన్ఫిగరేషన్‌ను:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>ఇలా మార్చండి:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>ఫైల్‌ను సేవ్ చేసిన తర్వాత Codex‌ను పునఃప్రారంభించి, కొత్త సెషన్‌ను సృష్టించండి.</p><p></p><p>ఒక్క సెషన్‌కు మాత్రమే తాత్కాలికంగా వర్తింపజేయాలనుకుంటే, ఈ ఆదేశాన్ని ఉపయోగించవచ్చు:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p>అదే సమయంలో, ఈ సూచనలను కూడా పాటించండి:</p><p> - ఆటోమేటిక్ కాంపాక్షన్‌ను సమయానికి ప్రారంభించండి;</p><p> - సుదీర్ఘ పనులను అనేక సెషన్‌లుగా విభజించండి;</p><p> - ఒకేసారి తిరిగి ఇవ్వాల్సిన అధిక పరిమాణంలోని టూల్ అవుట్‌పుట్‌ను తగ్గించండి;</p><p> - పాత సంభాషణ కంటెంట్‌ను క్రమం తప్పకుండా సారాంశం చేసి శుభ్రం చేయండి.</p><p></p><p>నిజంగా 1M టోకెన్ల కాంటెక్స్ట్ విండో అవసరమైతే, మీరు అసలు కాన్ఫిగరేషన్‌ను కొనసాగించవచ్చు. అయితే 272K దాటిన కాంటెక్స్ట్‌కు OpenAI అధిక స్థాయి ధరలను వర్తింపజేస్తుంది.</p><p></p><p>అసలు కాన్ఫిగరేషన్ వివరణ కోసం చూడండి: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">GPT-5.6 Sol కోసం Codex‌లో 1 మిలియన్ టోకెన్ల కాంటెక్స్ట్ విండోను ఎలా ప్రారంభించాలి </a></p><p></p><p>మీ అవగాహన మరియు మద్దతుకు ధన్యవాదాలు.</p>