Skip to content

Blogs

830 Topics 831 Posts

Blog posts from individual members

This category can be followed from the open social web via the handle [email protected]

  • 0 Votes
    1 Posts
    4 Views
    A
    <p>Enligt OpenAI:s senaste prisregler använder modeller som GPT-5.6 Sol trappstegsbaserade priser för förfrågningar med extra långa kontexter.</p><p>När kontexten i en enskild förfrågan överstiger 272K tokens kan indata, läsning från cache och utdata beräknas enligt en högre prisnivå. Regeln kommer från OpenAI:s officiella prissättning och innebär inte ett tillfälligt påslag eller en felaktig debitering från AI-ROUTER.</p><p></p><p>Som exempel kan GPT-5.6 Sol:s standardpriser sammanfattas så här:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Post Inom 272K Över 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Indata $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cacheläsning $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Utdata $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den slutliga kostnaden beräknas fortfarande utifrån den specifika gruppen, kontots multiplikator och andra prisinställningar.</p><p></p><p>Om en x2-markering visas i användningshistoriken betyder det att förfrågan har utlösts av trappstegsbaserad prissättning för lång kontext. Markeringen innebär främst att indata och cacheläsning har gått över till en högre prisnivå. Det betyder inte att alla kostnader för hela förfrågan helt enkelt har fördubblats; utdata kan ha en annan trappstegsmultiplikator.</p><p></p><p><strong> ## Så undviker du trappstegsbaserad prissättning</strong></p><p>Om du inte behöver ett kontextfönster på 1M tokens rekommenderas att du justerar Codex kontextgräns till högst 272K.</p><p></p><p>Öppna:</p><p> ~/.codex/config.toml</p><p></p><p>Ändra den tidigare konfigurationen för 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>till:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Spara filen, starta om Codex och skapa en ny session.</p><p></p><p>Om du bara vill att ändringen ska gälla tillfälligt för en enskild session kan du använda:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det rekommenderas även att:</p><p> - aktivera automatisk komprimering i tid;</p><p> - dela upp långa uppgifter i flera sessioner;</p><p> - minska mängden verktygsutdata som returneras på en gång;</p><p> - regelbundet sammanfatta och rensa bort äldre konversationsinnehåll.</p><p></p><p>Om du faktiskt behöver ett kontextfönster på 1M tokens kan du fortsätta använda den ursprungliga konfigurationen, men tokens över 272K debiteras enligt OpenAI:s högre prisnivå.</p><p></p><p>Den ursprungliga konfigurationsbeskrivningen finns här: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Så aktiverar du ett kontextfönster på 1 miljon tokens i Codex för GPT-5.6 Sol </a></p><p></p><p>Tack för er förståelse och ert stöd.</p>
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>Nach den neuesten Abrechnungsregeln von OpenAI verwenden Modelle wie GPT-5.6 Sol für Anfragen mit überlangen Kontexten gestaffelte Preise.</p><p>Wenn der Kontext einer einzelnen Anfrage 272K Tokens überschreitet, können Eingabe, Cache-Lesevorgänge und Ausgabe nach einer höheren Preisstufe berechnet werden. Diese Regel stammt aus der offiziellen Preisgestaltung von OpenAI und stellt weder einen vorübergehenden Aufschlag von AI-ROUTER noch eine fehlerhafte Abrechnung dar.</p><p></p><p>Beispiel anhand der Standardpreise für GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Position Bis 272K Über 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Eingabe $5 / 1M Tokens $10 / 1M Tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cache-Lesevorgang $0.50 / 1M Tokens $1 / 1M Tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ausgabe $30 / 1M Tokens $45 / 1M Tokens</code></pre><p></p><p>Die endgültigen Kosten werden weiterhin anhand der jeweiligen Gruppe, des Kontomultiplikators und weiterer Abrechnungseinstellungen berechnet.</p><p></p><p>Wenn in den Nutzungsdaten das Kennzeichen x2 erscheint, bedeutet dies, dass für diese Anfrage die gestaffelte Abrechnung für lange Kontexte ausgelöst wurde. Das Kennzeichen weist hauptsächlich darauf hin, dass Eingabe und Cache-Lesevorgänge in eine höhere Preisstufe fallen. Es bedeutet nicht, dass alle Kosten der gesamten Anfrage einfach verdoppelt werden; für die Ausgabe kann ein anderer Staffelmultiplikator gelten.</p><p></p><p><strong> ## So vermeiden Sie die gestaffelte Abrechnung</strong></p><p>Wenn Sie kein Kontextfenster von 1M Tokens benötigen, empfiehlt es sich, das Codex-Kontextlimit wieder auf höchstens 272K zu setzen.</p><p></p><p>Öffnen Sie:</p><p> ~/.codex/config.toml</p><p></p><p>Ändern Sie die ursprünglich im Artikel beschriebene 1M-Konfiguration:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>in:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Speichern Sie die Datei, starten Sie Codex neu und beginnen Sie eine neue Sitzung.</p><p></p><p>Wenn die Änderung nur vorübergehend für eine einzelne Sitzung gelten soll, können Sie Folgendes verwenden:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Zusätzlich wird empfohlen:</p><p> - die automatische Komprimierung rechtzeitig zu aktivieren;</p><p> - sehr lange Aufgaben auf mehrere Sitzungen aufzuteilen;</p><p> - die Menge umfangreicher Tool-Ausgaben in einer einzelnen Antwort zu reduzieren;</p><p> - frühere Gesprächsinhalte regelmäßig zusammenzufassen und zu bereinigen.</p><p></p><p>Wenn Sie tatsächlich ein Kontextfenster von 1M Tokens benötigen, können Sie die ursprüngliche Konfiguration weiterhin verwenden. Für den Anteil über 272K werden dann jedoch die höheren Preisstufen von OpenAI berechnet.</p><p></p><p>Die ursprüngliche Konfigurationsanleitung finden Sie hier: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">So aktivieren Sie ein Kontextfenster von 1 Million Tokens für GPT-5.6 Sol in Codex </a></p><p></p><p>Vielen Dank für Ihr Verständnis und Ihre Unterstützung.</p>
  • 0 Votes
    1 Posts
    1 Views
    A
    <p>בהתאם לכללי התמחור העדכניים של OpenAI, מודלים כגון GPT-5.6 Sol משתמשים בתמחור מדורג עבור בקשות עם הקשר ארוך במיוחד.</p><p>כאשר ההקשר של בקשה יחידה עולה על 272K טוקנים, הקלט, קריאת המטמון והפלט עשויים להיות מחויבים לפי מדרגת תמחור גבוהה יותר. כלל זה מבוסס על התמחור הרשמי של OpenAI, ואינו תוספת מחיר זמנית או חיוב חריג מצד AI-ROUTER.</p><p></p><p>לדוגמה, המחיר הסטנדרטי של GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> פריט עד 272K מעל 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> קלט $5 / 1M טוקנים $10 / 1M טוקנים</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> קריאת מטמון $0.50 / 1M טוקנים $1 / 1M טוקנים</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> פלט $30 / 1M טוקנים $45 / 1M טוקנים</code></pre><p></p><p>העלות הסופית עדיין תחושב בהתאם לקבוצה הספציפית, למכפיל החשבון ולהגדרות חיוב נוספות.</p><p></p><p>כאשר מופיע הסימון x2 ברשומות השימוש, פירוש הדבר הוא שהבקשה הפעילה את תמחור המדרגה עבור הקשר ארוך. הסימון מציין בעיקר שהקלט או קריאת המטמון נכנסו למדרגת תמחור גבוהה יותר, ואינו אומר שכל העלויות של הבקשה הוכפלו באופן פשוט; הפלט עשוי להשתמש במכפיל מדרגה שונה.</p><p></p><p><strong> ## כיצד להימנע מהפעלת תמחור מדורג</strong></p><p>אם אין צורך בחלון הקשר של 1M טוקנים, מומלץ להגדיר את מגבלת ההקשר של Codex מחדש ל-272K או פחות.</p><p></p><p>פתחו את:</p><p> ~/.codex/config.toml</p><p></p><p>החליפו את ההגדרה של 1M טוקנים מהמאמר המקורי:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>בהגדרות הבאות:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>לאחר השמירה, הפעילו מחדש את Codex ופתחו שיחה חדשה.</p><p></p><p>אם ברצונכם להחיל את ההגדרה באופן זמני על שיחה יחידה בלבד, ניתן להשתמש בפקודה:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> כמו כן, מומלץ:</p><p> - להפעיל דחיסה אוטומטית בזמן;</p><p> - לפצל משימות ארוכות במיוחד למספר שיחות;</p><p> - לצמצם את כמות פלט הכלים המוחזרת בבת אחת;</p><p> - לסכם ולנקות באופן קבוע תוכן מוקדם יותר בשיחה.</p><p></p><p>אם אכן נדרש חלון הקשר של 1M טוקנים, ניתן להמשיך להשתמש בהגדרה המקורית, אך על החלק שמעל 272K יחול תמחור המדרגה הגבוהה של OpenAI.</p><p></p><p>להסבר על ההגדרה המקורית, ראו: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">כיצד להפעיל חלון הקשר של מיליון טוקנים עבור GPT-5.6 Sol ב-Codex </a></p><p></p><p>תודה על ההבנה והתמיכה.</p>
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>Volgens de nieuwste prijsregels van OpenAI geldt voor modellen zoals GPT-5.6 Sol getrapte prijsstelling voor verzoeken met extra lange contexten.</p><p>Wanneer de context van één verzoek meer dan 272K tokens bevat, kunnen invoer, lezen uit de cache en uitvoer volgens een hoger tariefniveau worden berekend. Deze regel is afkomstig uit de officiële prijsstelling van OpenAI en is geen tijdelijke toeslag of abnormale afschrijving van AI-ROUTER.</p><p></p><p>Bij wijze van voorbeeld, op basis van de standaardprijzen van GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Onderdeel Tot en met 272K Meer dan 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Invoer $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lezen uit cache $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Uitvoer $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>De uiteindelijke kosten worden nog steeds berekend op basis van de specifieke groep, de accountvermenigvuldigingsfactor en andere factureringsinstellingen.</p><p></p><p>De markering x2 in de gebruiksgegevens betekent dat dit verzoek de getrapte prijsstelling voor lange contexten heeft geactiveerd. Deze markering geeft voornamelijk aan dat invoer en lezen uit de cache in een hoger tariefniveau vallen. Dit betekent niet dat alle kosten van het volledige verzoek eenvoudigweg worden verdubbeld; voor uitvoer kan een andere tariefvermenigvuldigingsfactor gelden.</p><p></p><p><strong> ## Zo voorkom je getrapte prijsstelling</strong></p><p>Als je geen contextvenster van 1M tokens nodig hebt, wordt aanbevolen om de contextlimiet van Codex terug te zetten naar maximaal 272K.</p><p></p><p>Open:</p><p> ~/.codex/config.toml</p><p></p><p>Vervang de 1M-configuratie uit het oorspronkelijke artikel:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>door:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Sla het bestand op, start Codex opnieuw en maak een nieuwe sessie aan.</p><p></p><p>Als je dit alleen tijdelijk voor één sessie wilt instellen, kun je het volgende gebruiken:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Daarnaast wordt het volgende aanbevolen:</p><p> - Schakel tijdig automatische compressie in;</p><p> - Splits lange taken op in meerdere sessies;</p><p> - Beperk de hoeveelheid tooluitvoer die in één keer wordt teruggestuurd;</p><p> - Vat oudere gespreksinhoud regelmatig samen en ruim deze op.</p><p></p><p>Als je daadwerkelijk een contextvenster van 1M tokens nodig hebt, kun je de oorspronkelijke configuratie blijven gebruiken. Voor het gedeelte boven 272K worden dan echter de hogere tariefniveaus van OpenAI toegepast.</p><p></p><p>Raadpleeg voor de oorspronkelijke configuratie-instructies: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Zo schakel je een contextvenster van 1 miljoen tokens in Codex in voor GPT-5.6 Sol </a></p><p></p><p>Bedankt voor je begrip en steun.</p>
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>Según las últimas reglas de facturación de OpenAI, modelos como GPT-5.6 Sol utilizan precios escalonados para las solicitudes con contextos ultralargos.</p><p>Cuando el contexto de una solicitud individual supera los 272K tokens, la entrada, la lectura de caché y la salida pueden calcularse según precios de niveles superiores. Esta regla procede de los precios oficiales de OpenAI y no representa un recargo temporal ni un cobro anómalo de AI-ROUTER.</p><p></p><p>Tomando como ejemplo los precios estándar de GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Concepto Hasta 272K Más de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrada $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lectura de caché $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Salida $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>El coste final seguirá calculándose según el grupo específico, el multiplicador de la cuenta y otras configuraciones de facturación.</p><p></p><p>La aparición de la marca x2 en el historial de uso indica que la solicitud activó la tarificación escalonada para contextos largos. Esta marca indica principalmente que la entrada o la lectura de caché pasó a un nivel superior, y no significa que todos los costes de la solicitud se hayan duplicado de forma simple; la salida puede utilizar un multiplicador escalonado diferente.</p><p></p><p><strong> ## Cómo evitar activar la tarificación escalonada</strong></p><p>Si no necesitas una ventana de contexto de 1M de tokens, se recomienda ajustar el límite de contexto de Codex a 272K o menos.</p><p></p><p>Abre:</p><p> ~/.codex/config.toml</p><p></p><p>La configuración de 1M utilizada en el artículo anterior:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Ajústala a:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Guarda los cambios, reinicia Codex y crea una sesión nueva.</p><p></p><p>Si solo quieres aplicar el cambio temporalmente a una sesión individual, puedes utilizar:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> También se recomienda:</p><p> - Activar la compactación automática a tiempo;</p><p> - Dividir las tareas muy largas en varias sesiones;</p><p> - Reducir la cantidad de resultados de herramientas que se devuelven de una sola vez;</p><p> - Resumir periódicamente y limpiar el contenido antiguo de la conversación.</p><p></p><p>Si realmente necesitas una ventana de contexto de 1M de tokens, puedes seguir utilizando la configuración original, pero los tokens que superen los 272K se facturarán según los precios de nivel superior de OpenAI.</p><p></p><p>Consulta la explicación de la configuración original en: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Cómo habilitar una ventana de contexto de 1 millón de tokens para GPT-5.6 Sol en Codex </a></p><p></p><p>Gracias por tu comprensión y apoyo.</p>
  • 0 Votes
    1 Posts
    1 Views
    A
    <p>Selon les dernières règles de facturation d’OpenAI, les modèles tels que GPT-5.6 Sol appliquent une tarification progressive aux requêtes utilisant un contexte ultra-long.</p><p>Lorsque le contexte d’une requête dépasse 272K tokens, les tokens d’entrée, de lecture du cache et de sortie peuvent être facturés selon un niveau tarifaire supérieur. Cette règle provient de la tarification officielle d’OpenAI ; il ne s’agit pas d’une majoration temporaire ni d’une facturation anormale d’AI-ROUTER.</p><p></p><p>À titre d’exemple, voici les tarifs standard de GPT-5.6 Sol :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Élément Jusqu’à 272K Au-delà de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrée $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lecture cache $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Sortie $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Le coût final dépend toujours du groupe concerné, du multiplicateur du compte et des autres paramètres de facturation.</p><p></p><p>La présence du marqueur x2 dans l’historique d’utilisation signifie que la requête a déclenché la tarification progressive du contexte long. Ce marqueur indique principalement que l’entrée et la lecture du cache sont passées au niveau tarifaire supérieur ; il ne signifie pas que tous les frais de la requête ont simplement doublé. La sortie peut être soumise à un multiplicateur différent selon le niveau tarifaire.</p><p></p><p><strong>## Comment éviter de déclencher la tarification progressive</strong></p><p>Si vous n’avez pas besoin d’une fenêtre de contexte de 1M tokens, il est recommandé de ramener la limite de contexte de Codex à 272K ou moins.</p><p></p><p>Ouvrez :</p><p> ~/.codex/config.toml</p><p></p><p>Remplacez la configuration de 1M tokens indiquée dans l’article précédent :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>par :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Enregistrez le fichier, redémarrez Codex et créez une nouvelle session.</p><p></p><p>Pour appliquer temporairement ces paramètres à une seule session, utilisez :</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Il est également recommandé de :</p><p> - activer rapidement la compression automatique ;</p><p> - diviser les tâches très longues en plusieurs sessions ;</p><p> - réduire la quantité de sorties d’outils renvoyées en une seule fois ;</p><p> - résumer et nettoyer régulièrement le contenu plus ancien des conversations.</p><p></p><p>Si vous avez réellement besoin d’une fenêtre de contexte de 1M tokens, vous pouvez continuer à utiliser la configuration d’origine, mais les tokens au-delà de 272K seront facturés selon les tarifs élevés des niveaux supérieurs d’OpenAI.</p><p></p><p>Pour consulter les explications relatives à la configuration d’origine, reportez-vous à : <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Comment activer une fenêtre de contexte de 1 million de tokens dans Codex pour GPT-5.6 Sol </a></p><p></p><p>Merci de votre compréhension et de votre soutien.</p>
  • 0 Votes
    1 Posts
    4 Views
    A
    <p>I henhold til OpenAIs nyeste prisregler bruker GPT-5.6 Sol og tilsvarende modeller trinnvis prising for forespørsler med ekstra lang kontekst.</p><p>Når konteksten i en enkelt forespørsel overstiger 272K tokens, kan input, lesing fra hurtigbuffer og output beregnes etter et høyere prisnivå. Denne regelen kommer fra OpenAIs offisielle prissetting og er ikke et midlertidig pristillegg eller en feilaktig belastning fra AI-ROUTER.</p><p></p><p>Eksempel med standardprisene for GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Element Innenfor 272K Over 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Hurtigbuffer- $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> lesing</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den endelige kostnaden beregnes fortsatt ut fra den konkrete gruppen, kontomultiplikatoren og andre prisinnstillinger.</p><p></p><p>En x2-markering i bruksoversikten betyr at forespørselen utløste trinnvis prising for lang kontekst. Markeringen betyr hovedsakelig at input og lesing fra hurtigbuffer har gått inn på et høyere prisnivå. Det betyr ikke at alle kostnadene for hele forespørselen enkelt dobles; output kan bruke en annen trinnvis multiplikator.</p><p></p><p><strong> ## Slik unngår du trinnvis prising</strong></p><p>Hvis du ikke trenger et kontekstvindu på 1M tokens, anbefales det å justere Codex-kontekstgrensen tilbake til 272K eller mindre.</p><p></p><p>Åpne:</p><p> ~/.codex/config.toml</p><p></p><p>Endre den tidligere 1M-konfigurasjonen:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>til:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Lagre endringene, start Codex på nytt og opprett en ny økt.</p><p></p><p>Hvis du bare vil bruke innstillingen midlertidig for én enkelt økt, kan du bruke:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det anbefales også å:</p><p> - aktivere automatisk komprimering i tide;</p><p> - dele opp lange oppgaver i flere økter;</p><p> - redusere mengden verktøyoutput som returneres på én gang;</p><p> - oppsummere og rydde bort eldre samtaleinnhold regelmessig.</p><p></p><p>Hvis du faktisk trenger et kontekstvindu på 1M tokens, kan du fortsette å bruke den opprinnelige konfigurasjonen. Når konteksten overstiger 272K, beregnes kostnadene imidlertid etter OpenAIs høyere prisnivå.</p><p></p><p>Du finner den opprinnelige konfigurasjonsveiledningen her: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Slik aktiverer du et kontekstvindu på 1 million tokens i Codex for GPT-5.6 Sol </a></p><p></p><p>Takk for forståelsen og støtten.</p>
  • 0 Votes
    1 Posts
    1 Views
    A
    <p>وفقًا لأحدث قواعد الفوترة لدى OpenAI، تستخدم نماذج مثل GPT-5.6 Sol أسعارًا متدرجة للطلبات ذات السياق فائق الطول.</p><p>عندما يتجاوز سياق الطلب الواحد 272 ألف رمز، قد تُحتسب تكلفة الإدخال وقراءة التخزين المؤقت والإخراج وفق شريحة سعرية أعلى. وتأتي هذه القاعدة من التسعير الرسمي لدى OpenAI، وليست زيادة مؤقتة في الأسعار أو خصمًا غير معتاد من AI-ROUTER.</p><p></p><p>على سبيل المثال، وفق الأسعار القياسية لـ GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> العنصر حتى 272K أكثر من 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> الإدخال $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> قراءة التخزين المؤقت $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> الإخراج $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>تُحتسب التكلفة النهائية وفق المجموعة المحددة، ومعامل الحساب، وإعدادات الفوترة الأخرى.</p><p></p><p>ظهور علامة x2 في سجل الاستخدام يعني أن هذا الطلب فعّل التسعير المتدرج للسياق الطويل. وتشير هذه العلامة أساسًا إلى أن الإدخال وقراءة التخزين المؤقت انتقلا إلى شريحة سعرية أعلى، ولا تعني أن جميع تكاليف الطلب تضاعفت ببساطة؛ فقد يستخدم الإخراج معاملًا مختلفًا حسب الشريحة.</p><p></p><p><strong> ## كيفية تجنب تفعيل التسعير المتدرج</strong></p><p>إذا لم تكن بحاجة إلى نافذة سياق بسعة مليون رمز، فمن المستحسن ضبط الحد الأقصى لسياق Codex مجددًا إلى 272 ألف رمز أو أقل.</p><p></p><p>افتح:</p><p> ~/.codex/config.toml</p><p></p><p>استبدل إعداد المليون رمز الوارد في المقالة السابقة:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>بالإعدادات التالية:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>بعد الحفظ، أعد تشغيل Codex وأنشئ جلسة جديدة.</p><p></p><p>إذا كنت تريد تطبيق الإعداد مؤقتًا على جلسة واحدة فقط، يمكنك استخدام:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> يُنصح أيضًا بما يلي:</p><p> - تفعيل الضغط التلقائي في الوقت المناسب؛</p><p> - تقسيم المهام الطويلة جدًا إلى عدة جلسات؛</p><p> - تقليل كمية مخرجات الأدوات التي يتم إرجاعها دفعة واحدة؛</p><p> - تلخيص محتوى المحادثات الأقدم وتنظيفه بانتظام.</p><p></p><p>إذا كنت تحتاج فعلًا إلى نافذة سياق بسعة مليون رمز، يمكنك الاستمرار في استخدام الإعدادات الأصلية، لكن سيتم احتساب الجزء الذي يتجاوز 272 ألف رمز وفق الأسعار الأعلى للشريحة التي تحددها OpenAI.</p><p></p><p>للاطلاع على شرح الإعدادات الأصلية، يُرجى الرجوع إلى: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">كيفية تفعيل نافذة سياق بسعة مليون رمز لـ GPT-5.6 Sol في Codex </a></p><p></p><p>شكرًا لتفهمكم ودعمكم.</p>
  • 0 Votes
    1 Posts
    4 Views
    A
    <p>OpenAIの最新の料金ルールに基づき、GPT-5.6 Solなどのモデルでは、超長コンテキストリクエストに段階料金が適用されます。</p><p>1回のリクエストでコンテキストが272Kトークンを超えると、入力、キャッシュ読み取り、出力に対して、より高い段階の料金が適用される場合があります。このルールはOpenAI公式の料金体系によるものであり、AI-ROUTERによる一時的な上乗せ料金や異常な請求ではありません。</p><p></p><p>GPT-5.6 Solの標準料金を例にすると、次のようになります。</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 項目 272K以内 272K超過</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 入力 $5 / 1Mトークン $10 / 1Mトークン</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> キャッシュ読み取り $0.50 / 1Mトークン $1 / 1Mトークン</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 出力 $30 / 1Mトークン $45 / 1Mトークン</code></pre><p></p><p>最終的な料金は、具体的なグループ、アカウント倍率、その他の料金設定に基づいて計算されます。</p><p></p><p>利用記録にx2フラグが表示されている場合、そのリクエストで長いコンテキスト向けの段階料金が適用されたことを示します。このフラグは主に、入力やキャッシュ読み取りがより高い段階に移行したことを示すものであり、リクエスト全体のすべての料金が単純に2倍になったことを意味するわけではありません。出力には異なる段階倍率が適用される場合があります。</p><p></p><p><strong> ## 段階料金の適用を避ける方法</strong></p><p>1Mトークンのコンテキストウィンドウが不要な場合は、Codexのコンテキスト上限を272K以内に戻すことをおすすめします。</p><p></p><p>次のファイルを開きます。</p><p> ~/.codex/config.toml</p><p></p><p>記事内で以前使用していた1M設定:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>次のように変更します。</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>保存後、Codexを再起動して新しいセッションを開始します。</p><p></p><p>単一のセッションに一時的にのみ適用したい場合は、次のコマンドを使用できます。</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> あわせて、次の対策もおすすめします。</p><p> - 自動圧縮を適時有効にする;</p><p> - 長時間のタスクを複数のセッションに分割する;</p><p> - 1回の応答で大量のツール出力を返さないようにする;</p><p> - 定期的に要約し、古い会話内容を整理する。</p><p></p><p>1Mトークンのコンテキストウィンドウが本当に必要な場合は、元の設定を引き続き使用できます。ただし、272Kを超えた部分には、OpenAIの高い段階の料金が適用されます。</p><p></p><p>元の設定については、次の記事を参照してください:<a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">CodexでGPT-5.6 Solの100万トークンコンテキストウィンドウを有効にする方法 </a></p><p></p><p>ご理解とご支援に感謝いたします。</p>
  • 0 Votes
    1 Posts
    3 Views
    A
    <p>According to OpenAI's latest billing rules, models such as GPT-5.6 Sol use tiered pricing for ultra-long context requests.</p><p>When the context of a single request exceeds 272K tokens, input, cached reads, and output may be billed at higher tier prices. This rule comes from OpenAI's official pricing and is not a temporary surcharge or abnormal charge from AI-ROUTER.</p><p></p><p>Using GPT-5.6 Sol's standard prices as an example:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Item Within 272K Over 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cached reads $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>The final cost is still calculated based on the specific group, account multiplier, and other billing settings.</p><p></p><p>If an x2 flag appears in usage records, it means that the request triggered tiered billing for long contexts. This flag mainly indicates that input or cached reads entered a higher tier; it does not mean that all charges for the request were simply doubled. Output may use a different tier multiplier.</p><p></p><p><strong> ## How to Avoid Triggering Tiered Billing</strong></p><p>If you do not need a 1M-token context window, we recommend adjusting Codex's context limit back to within 272K.</p><p></p><p>Open:</p><p> ~/.codex/config.toml</p><p></p><p>Change the 1M configuration from the original article:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>To:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Save the changes, restart Codex, and start a new session.</p><p></p><p>If you only want this to apply temporarily to a single session, you can use:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> We also recommend:</p><p> - Enable automatic compaction promptly;</p><p> - Split ultra-long tasks across multiple sessions;</p><p> - Reduce the amount of tool output returned at once;</p><p> - Periodically summarize and clear older conversation content.</p><p></p><p>If you do need a 1M-token context window, you can continue using the original configuration, but usage beyond 272K will be billed according to OpenAI's higher tier pricing.</p><p></p><p>For the original configuration instructions, see: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">How to Enable a 1M-Token Context Window in Codex for GPT-5.6 Sol </a></p><p></p><p>Thank you for your understanding and support.</p>
  • 0 Votes
    1 Posts
    5 Views
    A
    <p>根据 OpenAI 最新计费规则,GPT-5.6 Sol 等模型对超长上下文请求采用阶梯价格。</p><p>当单次请求的上下文超过 272K tokens 时,输入、缓存读取以及输出可能按照更高阶梯价格计算。该规则来自 OpenAI 官方定价,并非 AI-ROUTER 临时加价或异常扣费。</p><p></p><p>以 GPT-5.6 Sol 标准价格为例:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 项目 272K 以内 超过 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 输入 $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 缓存读取 $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 输出 $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>最终费用仍会根据具体分组、账号倍率及其他计费配置计算。</p><p></p><p>使用记录中出现 x2 标志,表示本次请求触发了长上下文阶梯计费。该标志主要表示输入/缓存读取进入更高阶梯,并不代表整条请求的所有费用简单翻倍;输出可能采用不同的阶梯倍率。</p><p></p><p><strong> ## 如何避免触发阶梯计费</strong></p><p>如果不需要 1M Token 上下文窗口,建议将 Codex 的上下文上限调整回 272K 以内。</p><p></p><p>打开:</p><p> ~/.codex/config.toml</p><p></p><p>将原先文章中的 1M 配置:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>调整为:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>保存后重启 Codex,并新建会话。</p><p></p><p>如果只希望临时对单个会话生效,可以使用:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> 同时建议:</p><p> - 及时开启自动压缩;</p><p> - 将超长任务拆分为多个会话;</p><p> - 减少一次性返回的大量工具输出;</p><p> - 定期总结并清理较早的对话内容。</p><p></p><p>如果确实需要 1M Token 上下文窗口,可以继续使用原配置,但超出 272K 后将按照 OpenAI 的高阶梯价格计费。</p><p></p><p>原始配置说明请参考:<a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">如何在 Codex 中为 GPT-5.6 Sol 启用 100 万 Token 上下文窗口 </a></p><p></p><p>感谢您的理解与支持。</p>
  • 0 Votes
    1 Posts
    78 Views
    A
    <p>OpenAI-nin ən son tarif qaydalarına əsasən, GPT-5.6 Sol kimi modellər çox uzun kontekstli sorğular üçün pilləli qiymətlərdən istifadə edir.</p><p>Bir sorğunun konteksti 272K tokeni aşdıqda, giriş, keşdən oxuma və çıxış daha yüksək pillə üzrə qiymətləndirilə bilər. Bu qayda OpenAI-nin rəsmi qiymət siyasətindən irəli gəlir və AI-ROUTER-in müvəqqəti qiymət artımı və ya qeyri-adi ödənişi deyil.</p><p></p><p>GPT-5.6 Sol-un standart qiymətini nümunə kimi götürək:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Bölmə 272K daxilində 272K-dan çox</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Giriş $5 / 1M token $10 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Keşdən oxuma $0.50 / 1M token $1 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Çıxış $30 / 1M token $45 / 1M token</code></pre><p></p><p>Yekun məbləğ konkret qruplaşdırma, hesab əmsalı və digər tarif parametrlərinə əsasən hesablanır.</p><p></p><p>İstifadə qeydlərində x2 işarəsinin görünməsi bu sorğunun uzun kontekst üzrə pilləli tarifləndirməni işə saldığını göstərir. Bu işarə əsasən girişin və keşdən oxumanın daha yüksək pilləyə keçdiyini bildirir və sorğunun bütün xərclərinin sadəcə ikiqat artdığı anlamına gəlmir; çıxış üçün fərqli pillə əmsalı tətbiq oluna bilər.</p><p></p><p><strong> ## Pilləli tarifləndirmənin işə düşməsinin qarşısını necə almaq olar</strong></p><p>1M tokenlik kontekst pəncərəsinə ehtiyac yoxdursa, Codex-in kontekst limitini 272K və ya daha aşağı səviyyəyə qaytarmaq tövsiyə olunur.</p><p></p><p>Bu faylı açın:</p><p> ~/.codex/config.toml</p><p></p><p>Əvvəlki məqalədəki 1M konfiqurasiyasını:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>aşağıdakı ilə əvəz edin:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Faylı yadda saxladıqdan sonra Codex-i yenidən başladın və yeni sessiya yaradın.</p><p></p><p>Yalnız bir sessiya üçün müvəqqəti tətbiq etmək istəyirsinizsə, aşağıdakı əmrdən istifadə edə bilərsiniz:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Həmçinin aşağıdakılar tövsiyə olunur:</p><p> - avtomatik sıxışdırmanı vaxtında aktivləşdirin;</p><p> - çox uzun tapşırıqları bir neçə sessiyaya bölün;</p><p> - bir dəfəyə qaytarılan çoxsaylı alət çıxışlarını azaldın;</p><p> - əvvəlki söhbət məzmununu mütəmadi olaraq ümumiləşdirin və təmizləyin.</p><p></p><p>Əgər həqiqətən 1M tokenlik kontekst pəncərəsinə ehtiyacınız varsa, əvvəlki konfiqurasiyadan istifadə etməyə davam edə bilərsiniz. Lakin 272K tokeni keçdikdən sonra OpenAI-nin yüksək pillə qiymətləri tətbiq olunacaq.</p><p></p><p>Əvvəlki konfiqurasiya haqqında ətraflı məlumat üçün bu məqaləyə baxın: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Codex-də GPT-5.6 Sol üçün 1 milyon tokenlik kontekst pəncərəsini necə aktivləşdirmək olar </a></p><p></p><p>Anlayışınız və dəstəyiniz üçün təşəkkür edirik.</p>
  • 0 Votes
    1 Posts
    81 Views
    A
    <p>Ayon sa pinakabagong tuntunin sa billing ng OpenAI, gumagamit ang mga modelong gaya ng GPT-5.6 Sol ng tiered pricing para sa mga request na may napakahabang context.</p><p>Kapag lumampas sa 272K tokens ang context ng isang request, maaaring singilin ang input, cache read, at output ayon sa mas mataas na tier ng presyo. Nagmula ang tuntuning ito sa opisyal na pricing ng OpenAI at hindi ito pansamantalang dagdag-singil o maling pagsingil ng AI-ROUTER.</p><p></p><p>Bilang halimbawa, narito ang standard na presyo ng GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Item Sa loob ng 272K Higit sa 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cache read $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Ang aktuwal na halaga ay kakalkulahin pa rin batay sa partikular na grupo, account multiplier, at iba pang configuration sa billing.</p><p></p><p>Kapag lumitaw ang x2 flag sa usage record, nangangahulugan itong na-trigger ng request na ito ang tiered billing para sa long context. Pangunahing ipinapahiwatig ng flag na pumasok ang input o cache read sa mas mataas na tier; hindi ito nangangahulugang basta na lang dodoble ang lahat ng bayarin para sa buong request. Maaaring gumamit ang output ng ibang tier multiplier.</p><p></p><p><strong> ## Paano maiiwasang ma-trigger ang tiered billing</strong></p><p>Kung hindi kailangan ang 1M Token context window, inirerekomendang ibalik sa loob ng 272K ang context limit ng Codex.</p><p></p><p>Buksan ang:</p><p> ~/.codex/config.toml</p><p></p><p>Palitan ang 1M configuration mula sa naunang artikulo:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>ng:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Pagkatapos mag-save, i-restart ang Codex at gumawa ng bagong session.</p><p></p><p>Kung pansamantala lamang itong gagamitin para sa isang session, maaaring gamitin ang:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p>Inirerekomenda rin ang mga sumusunod:</p><p> - Agad na paganahin ang awtomatikong compression;</p><p> - Hatiin ang mahahabang gawain sa maraming session;</p><p> - Bawasan ang dami ng tool output na ibinabalik nang sabay-sabay;</p><p> - Regular na ibuod at linisin ang mas naunang nilalaman ng pag-uusap.</p><p></p><p>Kung talagang kailangan ang 1M Token context window, maaari pa ring gamitin ang orihinal na configuration, ngunit kapag lumampas sa 272K, sisingilin ito ayon sa mas mataas na tier ng presyo ng OpenAI.</p><p></p><p>Para sa orihinal na paliwanag tungkol sa configuration, sumangguni sa: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Paano paganahin ang 1 milyong Token context window para sa GPT-5.6 Sol sa Codex </a></p><p></p><p>Salamat sa inyong pag-unawa at suporta.</p>
  • 0 Votes
    1 Posts
    80 Views
    A
    <p>በOpenAI የቅርብ ጊዜ የክፍያ ደንቦች መሠረት፣ እንደ GPT-5.6 Sol ያሉ ሞዴሎች ከመጠን በላይ ረጅም ኮንቴክስት ላላቸው ጥያቄዎች ደረጃዊ ዋጋ ይጠቀማሉ።</p><p>የአንድ ጥያቄ ኮንቴክስት ከ272K tokens በላይ ሲሆን፣ ግብዓት፣ የተሸጎጠ ውሂብ ንባብ እና ውጤት በከፍተኛ የዋጋ ደረጃ ሊተመኑ ይችላሉ። ይህ ደንብ ከOpenAI ይፋዊ የዋጋ መረጃ የመጣ ነው፤ በAI-ROUTER የተደረገ ጊዜያዊ የዋጋ ጭማሪ ወይም ያልተለመደ ክፍያ አይደለም።</p><p></p><p>የGPT-5.6 Sol መደበኛ ዋጋን እንደ ምሳሌ ከወሰድን፦</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ንጥል እስከ 272K ድረስ ከ272K በላይ</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ግብዓት $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> የተሸጎጠ ውሂብ ንባብ $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ውጤት $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>የመጨረሻው ወጪ አሁንም በተወሰነው የሞዴል ቡድን፣ በመለያው ብዜት እና በሌሎች የክፍያ ውቅሮች መሠረት ይቆጠራል።</p><p></p><p>በአጠቃቀም መዝገብ ውስጥ x2 ምልክት መታየቱ ይህ ጥያቄ የረጅም ኮንቴክስት ደረጃዊ ክፍያን እንዳስነሳ ያመለክታል። ይህ ምልክት በዋናነት ግብዓት/የተሸጎጠ ውሂብ ንባብ ወደ ከፍተኛ የዋጋ ደረጃ መግባቱን ያሳያል፤ የጥያቄው አጠቃላይ ወጪ በቀላሉ ሁለት እጥፍ ሆኗል ማለት አይደለም። ውጤት የተለየ የደረጃ ብዜት ሊኖረው ይችላል።</p><p></p><p><strong> ## ደረጃዊ ክፍያ እንዳይተገበር እንዴት መከላከል ይቻላል</strong></p><p>የ1M Token ኮንቴክስት መስኮት ካላስፈለገዎት፣ የCodex ኮንቴክስት ገደብን ወደ272K ውስጥ እንዲሆን ማስተካከል ይመከራል።</p><p></p><p>ይክፈቱ፦</p><p> ~/.codex/config.toml</p><p></p><p>በቀድሞው ጽሑፍ የተጠቀሰውን የ1M ውቅር፦</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>ወደዚህ ይቀይሩት፦</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>ካስቀመጡ በኋላ Codexን እንደገና ያስነሱ እና አዲስ ክፍለ ጊዜ ይፍጠሩ።</p><p></p><p>ለአንድ ክፍለ ጊዜ ብቻ ለጊዜው እንዲሠራ ከፈለጉ፣ ይህን መጠቀም ይችላሉ፦</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> በተጨማሪም የሚከተሉት ይመከራሉ፦</p><p> - የራስ-ሰር መጠቅለያን በወቅቱ ያንቁ፤</p><p> - እጅግ ረጅም ስራዎችን ወደ ብዙ ክፍለ ጊዜዎች ይከፋፍሉ፤</p><p> - በአንድ ጊዜ የሚመለሱ ብዙ የመሣሪያ ውጤቶችን ይቀንሱ፤</p><p> - በየጊዜው ማጠቃለያ ያዘጋጁ እና የቆዩ የውይይት ይዘቶችን ያጽዱ።</p><p></p><p>በእርግጥ የ1M Token ኮንቴክስት መስኮት ካስፈለገዎት፣ የቀድሞውን ውቅር መጠቀምዎን መቀጠል ይችላሉ፤ ነገር ግን ከ272K በላይ ሲሆን በOpenAI ከፍተኛ የዋጋ ደረጃ መሠረት ክፍያ ይተመናል።</p><p></p><p>የመጀመሪያውን የውቅር መመሪያ ለማጣቀሻ፦ <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">በCodex ውስጥ ለGPT-5.6 Sol 1 ሚሊዮን Token ኮንቴክስት መስኮትን እንዴት ማንቃት እንደሚቻል </a></p><p></p><p>ለግንዛቤዎ እና ለድጋፍዎ እናመሰግናለን።</p>
  • 0 Votes
    1 Posts
    63 Views
    A
    <p>Kulingana na sheria za hivi karibuni za bili za OpenAI, miundo kama GPT-5.6 Sol hutumia bei za viwango kwa maombi yenye muktadha mrefu kupita kiasi.</p><p>Wakati muktadha wa ombi moja unapozidi tokeni 272K, ingizo, usomaji wa akiba na matokeo vinaweza kutozwa kwa bei ya kiwango cha juu zaidi. Sheria hii inatokana na bei rasmi za OpenAI, wala si ongezeko la muda la bei au utozaji usio wa kawaida kutoka AI-ROUTER.</p><p></p><p>Kwa mfano, kwa bei ya kawaida ya GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Kipengee Ndani ya 272K Zaidi ya 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ingizo $5 / tokeni 1M $10 / tokeni 1M</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Usomaji wa akiba $0.50 / tokeni 1M $1 / tokeni 1M</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Matokeo $30 / tokeni 1M $45 / tokeni 1M</code></pre><p></p><p>Gharama ya mwisho bado itahesabiwa kulingana na kundi husika, kizidishi cha akaunti na mipangilio mingine ya bili.</p><p></p><p>Alama ya x2 inapoonekana katika rekodi ya matumizi, inaonyesha kuwa ombi hilo limeanzisha bei za kiwango cha juu kwa muktadha mrefu. Alama hii inaonyesha hasa kuwa ingizo/usomaji wa akiba umeingia katika kiwango cha juu zaidi; haimaanishi kuwa gharama zote za ombi zimeongezwa mara mbili kwa urahisi. Matokeo yanaweza kutumia kizidishi tofauti cha kiwango.</p><p></p><p><strong> ## Jinsi ya kuepuka kuanzisha bei za viwango</strong></p><p>Ikiwa huhitaji dirisha la muktadha la Tokeni milioni 1, inashauriwa kurekebisha kikomo cha muktadha cha Codex hadi ndani ya 272K.</p><p></p><p>Fungua:</p><p> ~/.codex/config.toml</p><p></p><p>Badilisha usanidi wa Tokeni milioni 1 kutoka kwenye makala ya awali:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>kuwa:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Hifadhi mabadiliko, kisha uanze upya Codex na uunde kikao kipya.</p><p></p><p>Ikiwa ungependa mipangilio hiyo itumike kwa muda kwenye kikao kimoja pekee, unaweza kutumia:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Pia inapendekezwa:</p><p> - Kuwasha ukandamizaji wa kiotomatiki kwa wakati unaofaa;</p><p> - Kugawanya kazi ndefu sana katika vikao vingi;</p><p> - Kupunguza kiasi kikubwa cha matokeo ya zana yanayorejeshwa kwa wakati mmoja;</p><p> - Kufanya muhtasari na kusafisha maudhui ya mazungumzo ya awali mara kwa mara.</p><p></p><p>Ikiwa kwa kweli unahitaji dirisha la muktadha la Tokeni milioni 1, unaweza kuendelea kutumia usanidi wa awali, lakini sehemu inayozidi 272K itatozwa kwa bei za juu za viwango kulingana na OpenAI.</p><p></p><p>Kwa maelezo ya usanidi wa awali, rejelea: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Jinsi ya kuwezesha muktadha wa Tokeni milioni 1 katika Codex kwa GPT-5.6 Sol </a></p><p></p><p>Asante kwa uelewa na usaidizi wako.</p>
  • 0 Votes
    1 Posts
    70 Views
    A
    <p>OpenAI च्या नवीनतम शुल्क नियमांनुसार, GPT-5.6 Sol सारखी मॉडेल्स अतिदीर्घ संदर्भ विनंत्यांसाठी स्तरित दर लागू करतात.</p><p>एकाच विनंतीचा संदर्भ 272K tokens पेक्षा अधिक झाल्यास, इनपुट, कॅशे वाचन आणि आउटपुट यांची गणना उच्च स्तरावरील दरांनुसार केली जाऊ शकते. हा नियम OpenAI च्या अधिकृत किमतींवर आधारित आहे; तो AI-ROUTER कडून केलेली तात्पुरती अतिरिक्त शुल्क आकारणी किंवा असामान्य कपात नाही.</p><p></p><p>GPT-5.6 Sol च्या मानक किमतींचे उदाहरण:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> घटक 272K च्या आत 272K पेक्षा अधिक</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> इनपुट $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> कॅशे वाचन $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> आउटपुट $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>अंतिम शुल्काची गणना संबंधित गट, खात्याचा गुणक आणि इतर शुल्क कॉन्फिगरेशननुसार केली जाईल.</p><p></p><p>वापराच्या नोंदींमध्ये दिसणारे x2 चिन्ह म्हणजे या विनंतीसाठी अतिदीर्घ संदर्भाची स्तरित शुल्क आकारणी लागू झाली आहे. हे चिन्ह प्रामुख्याने इनपुट किंवा कॅशे वाचन उच्च स्तरावर गेले असल्याचे दर्शवते; संपूर्ण विनंतीवरील सर्व शुल्क साध्या पद्धतीने दुप्पट झाले आहेत, असा त्याचा अर्थ नाही. आउटपुटसाठी वेगळा स्तरित गुणक लागू होऊ शकतो.</p><p></p><p><strong> ## स्तरित शुल्क आकारणी लागू होण्यापासून कसे टाळावे</strong></p><p>1M Token संदर्भ विंडोची आवश्यकता नसल्यास, Codex ची संदर्भ मर्यादा 272K च्या आत समायोजित करण्याची शिफारस केली जाते.</p><p></p><p>ही फाइल उघडा:</p><p> ~/.codex/config.toml</p><p></p><p>मूळ लेखातील 1M कॉन्फिगरेशन:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>याऐवजी पुढील मूल्ये वापरा:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>फाइल जतन केल्यानंतर Codex पुन्हा सुरू करा आणि नवीन सत्र तयार करा.</p><p></p><p>ही सेटिंग फक्त एखाद्या एकाच सत्रासाठी तात्पुरती लागू करायची असल्यास, पुढील कमांड वापरा:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> तसेच पुढील उपाय सुचवले जातात:</p><p> - स्वयंचलित संक्षेपण वेळेवर सुरू करा;</p><p> - अतिदीर्घ काम अनेक सत्रांमध्ये विभागा;</p><p> - एकाच वेळी परत मिळणारे मोठ्या प्रमाणातील टूल आउटपुट कमी करा;</p><p> - जुन्या संभाषणातील मजकुराचा नियमितपणे सारांश तयार करून तो साफ करा.</p><p></p><p>1M Token संदर्भ विंडोची खरोखर आवश्यकता असल्यास, मूळ कॉन्फिगरेशन वापरणे सुरू ठेवू शकता; मात्र 272K पेक्षा अधिक वापरासाठी OpenAI च्या उच्च स्तरावरील दरांनुसार शुल्क आकारले जाईल.</p><p></p><p>मूळ कॉन्फिगरेशनसाठी संदर्भ: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Codex मध्ये GPT-5.6 Sol साठी 1 दशलक्ष Token संदर्भ विंडो कशी सक्षम करावी </a></p><p></p><p>आपल्या समजुतीबद्दल आणि सहकार्याबद्दल धन्यवाद.</p>
  • 0 Votes
    1 Posts
    77 Views
    A
    <p>OpenAI తాజా బిల్లింగ్ నియమాల ప్రకారం, GPT-5.6 Sol వంటి మోడళ్లు సుదీర్ఘ కాంటెక్స్ట్ అభ్యర్థనలకు స్థాయివారీ ధరలను ఉపయోగిస్తాయి.</p><p>ఒక్క అభ్యర్థనలోని కాంటెక్స్ట్ 272K టోకెన్లను మించినప్పుడు, ఇన్‌పుట్, కాష్ రీడ్స్ మరియు అవుట్‌పుట్‌కు అధిక స్థాయి ధరలు వర్తించవచ్చు. ఈ నియమం OpenAI అధికారిక ధరల విధానంలో భాగం; ఇది AI-ROUTER తాత్కాలికంగా విధించిన అదనపు ఛార్జీ లేదా అసాధారణ బిల్లింగ్ కాదు.</p><p></p><p>GPT-5.6 Sol ప్రామాణిక ధరలను ఉదాహరణగా తీసుకుంటే:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> అంశం 272K లోపు 272K మించినప్పుడు</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ఇన్‌పుట్ $5 / 1M టోకెన్లు $10 / 1M టోకెన్లు</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> కాష్ రీడ్స్ $0.50 / 1M టోకెన్లు $1 / 1M టోకెన్లు</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> అవుట్‌పుట్ $30 / 1M టోకెన్లు $45 / 1M టోకెన్లు</code></pre><p></p><p>తుది ఛార్జీ నిర్దిష్ట గ్రూప్, ఖాతా గుణకం మరియు ఇతర బిల్లింగ్ కాన్ఫిగరేషన్‌ల ఆధారంగా లెక్కించబడుతుంది.</p><p></p><p>వినియోగ రికార్డుల్లో కనిపించే x2 గుర్తు, ఈ అభ్యర్థన సుదీర్ఘ కాంటెక్స్ట్ స్థాయివారీ బిల్లింగ్‌ను ప్రేరేపించిందని సూచిస్తుంది. ఈ గుర్తు ప్రధానంగా ఇన్‌పుట్ లేదా కాష్ రీడ్స్ అధిక స్థాయిలోకి వెళ్లినట్లు సూచిస్తుంది. మొత్తం అభ్యర్థనకు సంబంధించిన అన్ని ఛార్జీలు సులభంగా రెట్టింపు అవుతాయని దీని అర్థం కాదు; అవుట్‌పుట్‌కు వేరే స్థాయివారీ గుణకం వర్తించవచ్చు.</p><p></p><p><strong> ## స్థాయివారీ బిల్లింగ్‌ను ఎలా నివారించాలి</strong></p><p>1M టోకెన్ల కాంటెక్స్ట్ విండో అవసరం లేకపోతే, Codex కాంటెక్స్ట్ పరిమితిని 272K లోపు సర్దుబాటు చేయాలని సూచిస్తున్నాము.</p><p></p><p>తెరవండి:</p><p> ~/.codex/config.toml</p><p></p><p>వ్యాసంలోని అసలు 1M కాన్ఫిగరేషన్‌ను:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>ఇలా మార్చండి:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>ఫైల్‌ను సేవ్ చేసిన తర్వాత Codex‌ను పునఃప్రారంభించి, కొత్త సెషన్‌ను సృష్టించండి.</p><p></p><p>ఒక్క సెషన్‌కు మాత్రమే తాత్కాలికంగా వర్తింపజేయాలనుకుంటే, ఈ ఆదేశాన్ని ఉపయోగించవచ్చు:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p>అదే సమయంలో, ఈ సూచనలను కూడా పాటించండి:</p><p> - ఆటోమేటిక్ కాంపాక్షన్‌ను సమయానికి ప్రారంభించండి;</p><p> - సుదీర్ఘ పనులను అనేక సెషన్‌లుగా విభజించండి;</p><p> - ఒకేసారి తిరిగి ఇవ్వాల్సిన అధిక పరిమాణంలోని టూల్ అవుట్‌పుట్‌ను తగ్గించండి;</p><p> - పాత సంభాషణ కంటెంట్‌ను క్రమం తప్పకుండా సారాంశం చేసి శుభ్రం చేయండి.</p><p></p><p>నిజంగా 1M టోకెన్ల కాంటెక్స్ట్ విండో అవసరమైతే, మీరు అసలు కాన్ఫిగరేషన్‌ను కొనసాగించవచ్చు. అయితే 272K దాటిన కాంటెక్స్ట్‌కు OpenAI అధిక స్థాయి ధరలను వర్తింపజేస్తుంది.</p><p></p><p>అసలు కాన్ఫిగరేషన్ వివరణ కోసం చూడండి: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">GPT-5.6 Sol కోసం Codex‌లో 1 మిలియన్ టోకెన్ల కాంటెక్స్ట్ విండోను ఎలా ప్రారంభించాలి </a></p><p></p><p>మీ అవగాహన మరియు మద్దతుకు ధన్యవాదాలు.</p>
  • 0 Votes
    1 Posts
    69 Views
    A
    <p>OpenAI-யின் சமீபத்திய கட்டண விதிகளின்படி, GPT-5.6 Sol உள்ளிட்ட மாடல்கள் மிக நீளமான சூழல் கோரிக்கைகளுக்கு படிநிலை விலையைப் பயன்படுத்துகின்றன.</p><p>ஒரு கோரிக்கையின் சூழல் 272K tokens-ஐ மீறும்போது, உள்ளீடு, கேச் வாசிப்பு மற்றும் வெளியீடு ஆகியவை அதிக படிநிலை விலையின்படி கணக்கிடப்படலாம். இந்த விதி OpenAI-யின் அதிகாரப்பூர்வ விலையிலிருந்து வருகிறது; இது AI-ROUTER விதித்த தற்காலிக கூடுதல் கட்டணமோ அல்லது அசாதாரண கட்டணப் பிடித்தமோ அல்ல.</p><p></p><p>GPT-5.6 Sol-ன் நிலையான விலையை எடுத்துக்காட்டாகக் கொண்டால்:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> உருப்படி 272K-க்குள் 272K-ஐ மீறும்போது</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> உள்ளீடு $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> கேச் வாசிப்பு $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> வெளியீடு $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>இறுதி கட்டணம் குறிப்பிட்ட குழு, கணக்கு பெருக்கி மற்றும் பிற கட்டண அமைப்புகளின் அடிப்படையில் கணக்கிடப்படும்.</p><p></p><p>பயன்பாட்டு பதிவுகளில் தோன்றும் x2 குறியீடு, அந்தக் கோரிக்கை நீண்ட சூழல் படிநிலை கட்டணத்தைத் தூண்டியதைக் குறிக்கிறது. இந்தக் குறியீடு முக்கியமாக உள்ளீடு/கேச் வாசிப்பு அதிக படிநிலைக்குள் சென்றதைக் குறிக்கிறது; முழுக் கோரிக்கைக்கான அனைத்து கட்டணங்களும் எளிமையாக இரட்டிப்பாகின்றன என்று அர்த்தமல்ல. வெளியீட்டிற்கு வேறுபட்ட படிநிலை பெருக்கி பயன்படுத்தப்படலாம்.</p><p></p><p><strong> ## படிநிலை கட்டணம் விதிக்கப்படுவதைத் தவிர்ப்பது எப்படி</strong></p><p>1M Token சூழல் சாளரம் தேவையில்லை என்றால், Codex-ன் சூழல் வரம்பை 272K-க்குள் மீண்டும் அமைக்க பரிந்துரைக்கப்படுகிறது.</p><p></p><p>இந்தக் கோப்பைத் திறக்கவும்:</p><p> ~/.codex/config.toml</p><p></p><p>முந்தைய கட்டுரையில் உள்ள 1M அமைப்பை:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>இதற்கு மாற்றவும்:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>சேமித்த பிறகு Codex-ஐ மறுதொடக்கம் செய்து, புதிய அமர்வைத் தொடங்கவும்.</p><p></p><p>ஒரு குறிப்பிட்ட அமர்வுக்கு மட்டும் தற்காலிகமாகப் பயன்படுத்த விரும்பினால், இதைப் பயன்படுத்தலாம்:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> மேலும் பின்வருவனவும் பரிந்துரைக்கப்படுகின்றன:</p><p> - தானியங்கி சுருக்கத்தைச் சரியான நேரத்தில் இயக்கவும்;</p><p> - மிக நீளமான பணிகளை பல அமர்வுகளாகப் பிரிக்கவும்;</p><p> - ஒரே முறையில் திருப்பி அனுப்பப்படும் அதிக அளவிலான கருவி வெளியீட்டைக் குறைக்கவும்;</p><p> - பழைய உரையாடல் உள்ளடக்கங்களைத் தவறாமல் சுருக்கி, சுத்தம் செய்யவும்.</p><p></p><p>உங்களுக்கு உண்மையாகவே 1M Token சூழல் சாளரம் தேவைப்பட்டால், அசல் அமைப்பைத் தொடர்ந்து பயன்படுத்தலாம். ஆனால் 272K-ஐ மீறும் பகுதி OpenAI-யின் அதிக படிநிலை விலையின்படி கணக்கிடப்படும்.</p><p></p><p>அசல் அமைப்பு குறித்த விளக்கத்திற்கு பார்க்கவும்: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Codex-ல் GPT-5.6 Sol-க்கு 1 மில்லியன் Token சூழல் சாளரத்தை எவ்வாறு இயக்குவது </a></p><p></p><p>உங்கள் புரிதலுக்கும் ஆதரவுக்கும் நன்றி.</p>
  • 0 Votes
    1 Posts
    88 Views
    A
    <p>OpenAI-এর সর্বশেষ বিলিং নিয়ম অনুযায়ী, GPT-5.6 Sol-এর মতো মডেলগুলো অতি দীর্ঘ কনটেক্সট অনুরোধের জন্য ধাপভিত্তিক মূল্য ব্যবহার করে।</p><p>একটি অনুরোধের কনটেক্সট 272K tokens ছাড়িয়ে গেলে ইনপুট, ক্যাশ রিড এবং আউটপুটের জন্য বেশি ধাপের মূল্য প্রযোজ্য হতে পারে। এই নিয়ম OpenAI-এর অফিসিয়াল মূল্য নির্ধারণ থেকে এসেছে; এটি AI-ROUTER-এর সাময়িক অতিরিক্ত চার্জ বা অস্বাভাবিক বিলিং নয়।</p><p></p><p>GPT-5.6 Sol-এর স্ট্যান্ডার্ড মূল্যকে উদাহরণ হিসেবে ধরলে:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> বিষয় 272K-এর মধ্যে 272K-এর বেশি</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ইনপুট $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ক্যাশ রিড $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> আউটপুট $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>চূড়ান্ত খরচ নির্দিষ্ট গ্রুপ, অ্যাকাউন্ট মাল্টিপ্লায়ার এবং অন্যান্য বিলিং কনফিগারেশনের ভিত্তিতে গণনা করা হবে।</p><p></p><p>ব্যবহারের রেকর্ডে x2 চিহ্ন দেখা গেলে তার অর্থ হলো এই অনুরোধে দীর্ঘ কনটেক্সটের ধাপভিত্তিক বিলিং প্রযোজ্য হয়েছে। এই চিহ্নটি মূলত নির্দেশ করে যে ইনপুট/ক্যাশ রিড বেশি ধাপের মধ্যে পড়েছে; এর অর্থ এই নয় যে পুরো অনুরোধের সব খরচ সরলভাবে দ্বিগুণ হয়েছে। আউটপুটের জন্য ভিন্ন ধাপভিত্তিক গুণক প্রযোজ্য হতে পারে।</p><p></p><p><strong> ## ধাপভিত্তিক বিলিং কীভাবে এড়াবেন</strong></p><p>আপনার 1M Token-এর কনটেক্সট উইন্ডোর প্রয়োজন না থাকলে, Codex-এর কনটেক্সট সীমা আবার 272K-এর মধ্যে নির্ধারণ করার পরামর্শ দেওয়া হচ্ছে।</p><p></p><p>খুলুন:</p><p> ~/.codex/config.toml</p><p></p><p>আগের নিবন্ধের 1M কনফিগারেশন:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>পরিবর্তন করে করুন:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>সংরক্ষণ করার পর Codex পুনরায় চালু করুন এবং একটি নতুন সেশন তৈরি করুন।</p><p></p><p>শুধু একটি নির্দিষ্ট সেশনের জন্য সাময়িকভাবে প্রয়োগ করতে চাইলে ব্যবহার করুন:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> একই সঙ্গে পরামর্শ দেওয়া হচ্ছে:</p><p> - সময়মতো স্বয়ংক্রিয় কমপ্যাকশন চালু করুন;</p><p> - অতি দীর্ঘ কাজকে একাধিক সেশনে ভাগ করুন;</p><p> - একবারে ফেরত আসা বিপুল টুল আউটপুট কমিয়ে দিন;</p><p> - নিয়মিত সারসংক্ষেপ তৈরি করুন এবং পুরোনো কথোপকথনের বিষয়বস্তু পরিষ্কার করুন।</p><p></p><p>আপনার সত্যিই 1M Token-এর কনটেক্সট উইন্ডোর প্রয়োজন হলে, আগের কনফিগারেশন ব্যবহার চালিয়ে যেতে পারেন। তবে 272K ছাড়িয়ে গেলে OpenAI-এর বেশি ধাপের মূল্য অনুযায়ী বিল করা হবে।</p><p></p><p>মূল কনফিগারেশন নির্দেশনার জন্য দেখুন: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Codex-এ GPT-5.6 Sol-এর জন্য ১০ লক্ষ Token-এর কনটেক্সট উইন্ডো কীভাবে চালু করবেন </a></p><p></p><p>আপনাদের বোঝাপড়া ও সমর্থনের জন্য ধন্যবাদ।</p>
  • 0 Votes
    1 Posts
    63 Views
    A
    <p>OpenAI کے تازہ ترین بلنگ قواعد کے مطابق، GPT-5.6 Sol جیسے ماڈلز انتہائی طویل کانٹیکسٹ والی درخواستوں کے لیے تدریجی قیمتوں کا نظام استعمال کرتے ہیں۔</p><p>جب کسی ایک درخواست کی کانٹیکسٹ 272K ٹوکنز سے زیادہ ہو جائے تو ان پٹ، کیش ریڈ اور آؤٹ پٹ کا حساب زیادہ درجے کی قیمتوں کے مطابق کیا جا سکتا ہے۔ یہ اصول OpenAI کی سرکاری قیمتوں سے حاصل ہوتا ہے، AI-ROUTER کی عارضی اضافی فیس یا غیر معمولی کٹوتی نہیں ہے۔</p><p></p><p>GPT-5.6 Sol کی معیاری قیمتوں کی مثال:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> آئٹم 272K تک 272K سے زیادہ</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ان پٹ $5 / 1M ٹوکنز $10 / 1M ٹوکنز</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> کیش ریڈ $0.50 / 1M ٹوکنز $1 / 1M ٹوکنز</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> آؤٹ پٹ $30 / 1M ٹوکنز $45 / 1M ٹوکنز</code></pre><p></p><p>حتمی فیس کا حساب اب بھی مخصوص گروپ، اکاؤنٹ کے ملٹی پلائر اور دیگر بلنگ ترتیبات کے مطابق کیا جائے گا۔</p><p></p><p>استعمال کے ریکارڈ میں x2 نشان ظاہر ہونے کا مطلب ہے کہ اس درخواست پر طویل کانٹیکسٹ کی تدریجی بلنگ لاگو ہوئی۔ یہ نشان بنیادی طور پر اس بات کی نشاندہی کرتا ہے کہ ان پٹ/کیش ریڈ زیادہ درجے میں داخل ہو گئے ہیں، اس کا مطلب یہ نہیں کہ پوری درخواست کی تمام فیس سادہ طور پر دوگنی ہو گئی ہے؛ آؤٹ پٹ پر مختلف تدریجی شرح لاگو ہو سکتی ہے۔</p><p></p><p><strong> ## تدریجی بلنگ سے کیسے بچیں</strong></p><p>اگر آپ کو 1M ٹوکنز کی کانٹیکسٹ ونڈو درکار نہیں ہے تو Codex کی کانٹیکسٹ حد کو دوبارہ 272K کے اندر ایڈجسٹ کرنے کی تجویز دی جاتی ہے۔</p><p></p><p>یہ فائل کھولیں:</p><p> ~/.codex/config.toml</p><p></p><p>مضمون میں موجود اصل 1M کنفیگریشن:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>اسے تبدیل کر کے یہ کریں:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>فائل محفوظ کرنے کے بعد Codex کو دوبارہ شروع کریں اور نیا سیشن بنائیں۔</p><p></p><p>اگر آپ صرف کسی ایک سیشن کے لیے عارضی طور پر یہ ترتیب نافذ کرنا چاہتے ہیں تو یہ کمانڈ استعمال کریں:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> اس کے ساتھ یہ بھی تجویز کیا جاتا ہے:</p><p> - خودکار کمپریشن بروقت فعال کریں؛</p><p> - انتہائی طویل کام کو متعدد سیشنز میں تقسیم کریں؛</p><p> - ایک ہی بار میں واپس آنے والے ٹول آؤٹ پٹ کی بڑی مقدار کم کریں؛</p><p> - پرانی گفتگو کے مواد کا باقاعدگی سے خلاصہ بنائیں اور اسے صاف کریں۔</p><p></p><p>اگر آپ کو واقعی 1M ٹوکنز کی کانٹیکسٹ ونڈو درکار ہے تو اصل کنفیگریشن استعمال جاری رکھ سکتے ہیں، لیکن 272K سے زیادہ ہونے کے بعد OpenAI کی زیادہ درجے والی قیمتوں کے مطابق بلنگ کی جائے گی۔</p><p></p><p>اصل کنفیگریشن کی وضاحت کے لیے ملاحظہ کریں: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Codex میں GPT-5.6 Sol کے لیے 1 ملین ٹوکنز کی کانٹیکسٹ ونڈو کیسے فعال کریں </a></p><p></p><p>آپ کی سمجھ اور تعاون کا شکریہ۔</p>