Informacje o progowym rozliczaniu bardzo długiego kontekstu GPT-5.6 Sol
-
<p>Zgodnie z najnowszymi zasadami rozliczeń OpenAI modele takie jak GPT-5.6 Sol stosują stawki progowe dla żądań z bardzo długim kontekstem.</p><p>Gdy kontekst pojedynczego żądania przekracza 272K tokenów, dane wejściowe, odczyt z pamięci podręcznej oraz dane wyjściowe mogą być rozliczane według wyższej stawki progowej. Zasada ta wynika z oficjalnego cennika OpenAI i nie oznacza tymczasowej podwyżki ani nieprawidłowego naliczenia opłat przez AI-ROUTER.</p><p></p><p>Przykładowe standardowe ceny GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Pozycja Do 272K Powyżej 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Dane wejściowe $5 / 1M tokenów $10 / 1M tokenów</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Odczyt z pamięci $0.50 / 1M tokenów $1 / 1M tokenów</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Dane wyjściowe $30 / 1M tokenów $45 / 1M tokenów</code></pre><p></p><p>Ostateczna opłata nadal zależy od konkretnej grupy, mnożnika konta oraz innych ustawień rozliczeń.</p><p></p><p>Oznaczenie x2 widoczne w historii użycia oznacza, że dane żądanie uruchomiło progowe rozliczanie długiego kontekstu. Oznaczenie to wskazuje przede wszystkim, że dane wejściowe lub odczyt z pamięci podręcznej zostały rozliczone według wyższej stawki progowej. Nie oznacza ono, że wszystkie opłaty za całe żądanie zostały po prostu podwojone; dane wyjściowe mogą podlegać innemu mnożnikowi progowemu.</p><p></p><p><strong> ## Jak uniknąć progowego rozliczania</strong></p><p>Jeśli nie potrzebujesz okna kontekstu o wielkości 1M tokenów, zalecamy ustawienie limitu kontekstu Codex z powrotem na poziomie nieprzekraczającym 272K.</p><p></p><p>Otwórz:</p><p> ~/.codex/config.toml</p><p></p><p>Zmień wcześniejszą konfigurację 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>na:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Po zapisaniu zmian uruchom ponownie Codex i rozpocznij nową sesję.</p><p></p><p>Jeśli chcesz tymczasowo zastosować ustawienia tylko do jednej sesji, możesz użyć:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Zalecamy również:</p><p> - włączyć automatyczną kompresję w odpowiednim momencie;</p><p> - dzielić bardzo długie zadania na wiele sesji;</p><p> - ograniczyć ilość danych wyjściowych z narzędzi zwracanych jednorazowo;</p><p> - regularnie podsumowywać i usuwać starszą treść rozmowy.</p><p></p><p>Jeśli rzeczywiście potrzebujesz okna kontekstu o wielkości 1M tokenów, możesz nadal korzystać z wcześniejszej konfiguracji, jednak po przekroczeniu 272K opłaty będą naliczane według wyższej stawki progowej OpenAI.</p><p></p><p>Oryginalne informacje o konfiguracji znajdziesz tutaj: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Jak włączyć okno kontekstu o wielkości 1 miliona tokenów dla GPT-5.6 Sol w Codexie </a></p><p></p><p>Dziękujemy za wyrozumiałość i wsparcie.</p>
Hello! It looks like you're interested in this conversation, but you don't have an account yet.
Getting fed up of having to scroll through the same posts each visit? When you register for an account, you'll always come back to exactly where you were before, and choose to be notified of new replies (either via email, or push notification). You'll also be able to save bookmarks and upvote posts to show your appreciation to other community members.
With your input, this post could be even better 💗
Register Login