Skip to content
  • 0 Votes
    1 Posts
    50 Views
    A
    <p>Saskaņā ar jaunākajiem OpenAI norēķinu noteikumiem tādiem modeļiem kā GPT-5.6 Sol pieprasījumiem ar īpaši garu kontekstu tiek piemērotas pakāpeniskas cenas.</p><p>Ja viena pieprasījuma konteksts pārsniedz 272K tokenu, ievadei, kešatmiņas nolasīšanai un izvadei var tikt piemērota augstāka cenu pakāpe. Šis noteikums izriet no OpenAI oficiālās cenu politikas, un tas nav AI-ROUTER īslaicīgs uzcenojums vai kļūdains maksas aprēķins.</p><p></p><p>Piemēram, izmantojot GPT-5.6 Sol standarta cenas:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Pozīcija Līdz 272K Virs 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ievade $5 / 1M tokenu $10 / 1M tokenu</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Kešatmiņas $0.50 / 1M tokenu $1 / 1M tokenu</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> nolasīšana</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Izvade $30 / 1M tokenu $45 / 1M tokenu</code></pre><p></p><p>Galīgā maksa joprojām tiek aprēķināta atbilstoši konkrētajai grupai, konta reizinātājam un citiem norēķinu iestatījumiem.</p><p></p><p>Ja lietošanas ierakstos tiek parādīts marķējums x2, tas nozīmē, ka šim pieprasījumam tika piemērota īpaši gara konteksta pakāpeniskā cenu aprēķina kārta. Šis marķējums galvenokārt norāda, ka ievadei un kešatmiņas nolasīšanai tika piemērota augstāka cenu pakāpe. Tas nenozīmē, ka visas pieprasījuma izmaksas vienkārši tika dubultotas; izvadei var tikt piemērots cits pakāpes reizinātājs.</p><p></p><p><strong> ## Kā izvairīties no pakāpeniskās cenu aprēķina aktivizēšanas</strong></p><p>Ja 1M tokenu konteksta logs nav nepieciešams, ieteicams Codex konteksta ierobežojumu iestatīt uz 272K vai mazāk.</p><p></p><p>Atveriet:</p><p> ~/.codex/config.toml</p><p></p><p>Mainiet raksta sākotnējo 1M konfigurāciju:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>uz:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Pēc saglabāšanas restartējiet Codex un izveidojiet jaunu sesiju.</p><p></p><p>Ja vēlaties iestatījumu īslaicīgi piemērot tikai vienai sesijai, varat izmantot:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Ieteicams arī:</p><p> - savlaicīgi ieslēgt automātisko saspiešanu;</p><p> - sadalīt īpaši garus uzdevumus vairākās sesijās;</p><p> - samazināt vienā reizē atgrieztās apjomīgās rīku izvades daudzumu;</p><p> - regulāri apkopot un dzēst agrāko sarunu saturu.</p><p></p><p>Ja 1M tokenu konteksta logs patiešām ir nepieciešams, varat turpināt izmantot sākotnējo konfigurāciju, taču pēc 272K pārsniegšanas tiks piemērota OpenAI augstākā cenu pakāpe.</p><p></p><p>Sākotnējo konfigurācijas aprakstu skatiet: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kā Codex iespējot 1 miljona tokenu konteksta logu GPT-5.6 Sol modelim </a></p><p></p><p>Paldies par jūsu sapratni un atbalstu.</p>
  • 0 Votes
    1 Posts
    40 Views
    A
    <p>Theo quy định tính phí mới nhất của OpenAI, các mô hình như GPT-5.6 Sol áp dụng mức giá theo bậc cho các yêu cầu có ngữ cảnh siêu dài.</p><p>Khi ngữ cảnh của một yêu cầu đơn lẻ vượt quá 272K token, chi phí đầu vào, đọc bộ nhớ đệm và đầu ra có thể được tính theo mức giá cao hơn. Quy định này xuất phát từ bảng giá chính thức của OpenAI, không phải là việc AI-ROUTER tạm thời tăng giá hay tính phí bất thường.</p><p></p><p>Ví dụ với mức giá tiêu chuẩn của GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Hạng mục Trong 272K Vượt quá 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Đầu vào $5 / 1M token $10 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Đọc bộ nhớ đệm $0.50 / 1M token $1 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Đầu ra $30 / 1M token $45 / 1M token</code></pre><p></p><p>Chi phí cuối cùng vẫn được tính dựa trên nhóm cụ thể, hệ số tài khoản và các cấu hình tính phí khác.</p><p></p><p>Ký hiệu x2 xuất hiện trong lịch sử sử dụng cho biết yêu cầu này đã kích hoạt cách tính phí theo bậc đối với ngữ cảnh dài. Ký hiệu này chủ yếu cho biết đầu vào/đọc bộ nhớ đệm đã chuyển sang bậc giá cao hơn, không có nghĩa là toàn bộ chi phí của yêu cầu được nhân đôi một cách đơn giản; đầu ra có thể áp dụng hệ số bậc khác.</p><p></p><p><strong> ## Cách tránh kích hoạt tính phí theo bậc</strong></p><p>Nếu không cần cửa sổ ngữ cảnh 1M token, bạn nên điều chỉnh giới hạn ngữ cảnh của Codex về mức trong 272K.</p><p></p><p>Mở:</p><p> ~/.codex/config.toml</p><p></p><p>Thay cấu hình 1M trong bài viết trước:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>thành:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Sau khi lưu, hãy khởi động lại Codex và tạo một phiên mới.</p><p></p><p>Nếu chỉ muốn áp dụng tạm thời cho một phiên cụ thể, bạn có thể sử dụng:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Đồng thời, bạn nên:</p><p> - Bật tính năng tự động nén kịp thời;</p><p> - Chia các tác vụ dài thành nhiều phiên;</p><p> - Giảm lượng lớn kết quả công cụ được trả về trong một lần;</p><p> - Thường xuyên tóm tắt và dọn dẹp nội dung hội thoại cũ.</p><p></p><p>Nếu thực sự cần cửa sổ ngữ cảnh 1M token, bạn vẫn có thể tiếp tục sử dụng cấu hình ban đầu, nhưng phần vượt quá 272K sẽ được tính theo mức giá cao hơn của OpenAI.</p><p></p><p>Tham khảo hướng dẫn cấu hình ban đầu tại: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Cách bật cửa sổ ngữ cảnh 1 triệu Token cho GPT-5.6 Sol trong Codex </a></p><p></p><p>Cảm ơn bạn đã thông cảm và ủng hộ.</p>
  • 0 Votes
    1 Posts
    54 Views
    A
    <p>Prema najnovijim pravilima naplate OpenAI-ja, modeli poput GPT-5.6 Sol za zahtjeve s iznimno dugim kontekstom koriste stepenaste cijene.</p><p>Kada kontekst pojedinačnog zahtjeva premašuje 272K tokena, unos, čitanje iz predmemorije i izlaz mogu se obračunavati prema višoj cjenovnoj razini. Ovo pravilo proizlazi iz službenog cjenika OpenAI-ja i ne predstavlja privremeno povećanje cijena ili neuobičajenu naplatu na AI-ROUTER-u.</p><p></p><p>Primjer standardnih cijena za GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Stavka Unutar 272K Iznad 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Unos $5 / 1M tokena $10 / 1M tokena</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Čitanje iz $0.50 / 1M tokena $1 / 1M tokena</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> predmemorije</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Izlaz $30 / 1M tokena $45 / 1M tokena</code></pre><p></p><p>Konačni trošak i dalje se izračunava na temelju konkretne grupe, množitelja računa i drugih postavki naplate.</p><p></p><p>Oznaka x2 koja se pojavljuje u zapisima korištenja znači da je ovaj zahtjev aktivirao stepenasto tarifiranje za dugi kontekst. Ova oznaka uglavnom znači da su unos i čitanje iz predmemorije ušli u višu cjenovnu razinu; ne znači da su svi troškovi cijelog zahtjeva jednostavno udvostručeni. Za izlaz se može primjenjivati drugačiji stepenasti množitelj.</p><p></p><p><strong> ## Kako izbjeći stepenasto tarifiranje</strong></p><p>Ako vam nije potreban kontekstualni prozor od 1M tokena, preporučujemo da ograničenje konteksta u Codexu vratite na najviše 272K.</p><p></p><p>Otvorite:</p><p> ~/.codex/config.toml</p><p></p><p>Konfiguraciju od 1M tokena iz izvornog članka:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>promijenite u:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Nakon spremanja ponovno pokrenite Codex i otvorite novu sesiju.</p><p></p><p>Ako želite da promjena privremeno vrijedi samo za jednu sesiju, možete upotrijebiti:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Također preporučujemo:</p><p> - pravodobno uključiti automatsku kompresiju;</p><p> - podijeliti vrlo duge zadatke u više sesija;</p><p> - smanjiti količinu izlaza alata koji se vraća odjednom;</p><p> - redovito sažimati i čistiti stariji sadržaj razgovora.</p><p></p><p>Ako vam je doista potreban kontekstualni prozor od 1M tokena, možete nastaviti koristiti izvornu konfiguraciju, ali nakon 272K tokena naplata će se obračunavati prema višoj cjenovnoj razini OpenAI-ja.</p><p></p><p>Izvorne upute za konfiguraciju pogledajte ovdje: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kako omogućiti kontekstualni prozor od milijun tokena za GPT-5.6 Sol u Codexu </a></p><p></p><p>Hvala na razumijevanju i podršci.</p>
  • 0 Votes
    1 Posts
    40 Views
    A
    <p>Podľa najnovších pravidiel fakturácie OpenAI používajú modely ako GPT-5.6 Sol pre požiadavky s mimoriadne dlhým kontextom stupňovité ceny.</p><p>Ak kontext jednej požiadavky prekročí 272K tokenov, vstup, čítanie z cache aj výstup môžu byť účtované podľa vyššieho cenového stupňa. Toto pravidlo pochádza z oficiálneho cenníka OpenAI a nejde o dočasné zvýšenie cien ani o neštandardné účtovanie zo strany AI-ROUTER.</p><p></p><p>Príklad štandardných cien GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Položka Do 272K Nad 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Vstup $5 / 1M tokenov $10 / 1M tokenov</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Čítanie z cache $0.50 / 1M tokenov $1 / 1M tokenov</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Výstup $30 / 1M tokenov $45 / 1M tokenov</code></pre><p></p><p>Celkový poplatok sa bude naďalej vypočítavať podľa konkrétnej skupiny, násobku účtu a ďalších fakturačných nastavení.</p><p></p><p>Označenie x2 v záznamoch používania znamená, že požiadavka aktivovala stupňovitú fakturáciu za dlhý kontext. Toto označenie predovšetkým znamená, že vstup alebo čítanie z cache prešli do vyššieho cenového stupňa. Neznamená to, že všetky poplatky za celú požiadavku sa jednoducho zdvojnásobili; výstup môže používať inú násobkovú sadzbu.</p><p></p><p><strong> ## Ako zabrániť aktivácii stupňovitej fakturácie</strong></p><p>Ak nepotrebujete kontextové okno s kapacitou 1M tokenov, odporúčame nastaviť limit kontextu v Codexe späť na maximálne 272K tokenov.</p><p></p><p>Otvorte:</p><p> ~/.codex/config.toml</p><p></p><p>Pôvodné nastavenie 1M z predchádzajúceho článku:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>zmeňte na:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Po uložení reštartujte Codex a vytvorte novú reláciu.</p><p></p><p>Ak chcete toto nastavenie použiť iba dočasne pre jednu reláciu, môžete použiť:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Zároveň odporúčame:</p><p> - včas zapnúť automatickú kompresiu;</p><p> - rozdeliť dlhé úlohy do viacerých relácií;</p><p> - obmedziť veľké množstvo výstupov nástrojov vracaných naraz;</p><p> - pravidelne sumarizovať a odstraňovať starší obsah konverzácie.</p><p></p><p>Ak skutočne potrebujete kontextové okno s kapacitou 1M tokenov, môžete naďalej používať pôvodné nastavenie, no po prekročení 272K tokenov sa bude účtovať podľa vyššieho cenového stupňa OpenAI.</p><p></p><p>Pôvodné pokyny na konfiguráciu nájdete v článku: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Ako povoliť kontextové okno s kapacitou 1 milión tokenov v Codexe pre GPT-5.6 Sol </a></p><p></p><p>Ďakujeme za pochopenie a podporu.</p>
  • 0 Votes
    1 Posts
    37 Views
    A
    <p>De acordo com as regras de cobrança mais recentes da OpenAI, modelos como o GPT-5.6 Sol adotam preços progressivos para solicitações com contexto ultralongo.</p><p>Quando o contexto de uma única solicitação excede 272K tokens, a entrada, a leitura do cache e a saída podem ser calculadas de acordo com uma faixa de preço mais alta. Essa regra vem da precificação oficial da OpenAI e não representa um aumento temporário ou uma cobrança anormal do AI-ROUTER.</p><p></p><p>Tomando como exemplo o preço padrão do GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Item Até 272K Acima de 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Entrada $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Leitura do $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> cache</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Saída $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>O custo final ainda será calculado de acordo com o grupo específico, o multiplicador da conta e outras configurações de cobrança.</p><p></p><p>A marca x2 exibida no histórico de uso indica que a solicitação acionou a cobrança progressiva para contexto longo. Essa marca indica principalmente que a entrada ou a leitura do cache entrou em uma faixa de preço mais alta; ela não significa que todos os custos da solicitação tenham simplesmente dobrado. A saída pode utilizar um multiplicador de faixa diferente.</p><p></p><p><strong> ## Como evitar acionar a cobrança progressiva</strong></p><p>Se você não precisa de uma janela de contexto de 1M de tokens, recomendamos ajustar o limite de contexto do Codex para até 272K.</p><p></p><p>Abra:</p><p> ~/.codex/config.toml</p><p></p><p>Altere a configuração de 1M apresentada no artigo original:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Para:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Depois de salvar, reinicie o Codex e crie uma nova sessão.</p><p></p><p>Se quiser aplicar a configuração temporariamente a uma única sessão, use:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Também recomendamos:</p><p> - ativar a compactação automática em tempo hábil;</p><p> - dividir tarefas muito longas em várias sessões;</p><p> - reduzir a quantidade de saídas de ferramentas retornadas de uma só vez;</p><p> - resumir e limpar periodicamente o conteúdo mais antigo da conversa.</p><p></p><p>Se você realmente precisa de uma janela de contexto de 1M de tokens, pode continuar usando a configuração original, mas os tokens acima de 272K serão cobrados de acordo com os preços mais altos da OpenAI.</p><p></p><p>Para consultar as instruções de configuração originais, veja: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Como ativar uma janela de contexto de 1 milhão de tokens no Codex para o GPT-5.6 Sol </a></p><p></p><p>Agradecemos sua compreensão e seu apoio.</p>
  • 0 Votes
    1 Posts
    68 Views
    A
    <p>Skont l-aħħar regoli tal-kontijiet ta’ OpenAI, mudelli bħal GPT-5.6 Sol jużaw prezzijiet skont il-livelli għal talbiet b’kuntest ultra-twil.</p><p>Meta l-kuntest ta’ talba waħda jaqbeż 272K tokens, l-input, il-qari tal-cache u l-output jistgħu jiġu kkalkulati skont livell ta’ prezz ogħla. Din ir-regola ġejja mill-ipprezzar uffiċjali ta’ OpenAI, u mhijiex żieda temporanja fil-prezzijiet jew tariffa mhux tas-soltu minn AI-ROUTER.</p><p></p><p>Bħala eżempju, hawn taħt jinsabu l-prezzijiet standard ta’ GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Oġġett Fi ħdan 272K Aktar minn 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Qari tal-cache $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>L-ispiża finali xorta tiġi kkalkulata skont il-grupp speċifiku, il-multiplikatur tal-kont u konfigurazzjonijiet oħra tal-kontijiet.</p><p></p><p>Meta fir-rekords tal-użu tidher il-marka x2, dan ifisser li t-talba attivat il-kontijiet skont il-livell għal kuntest twil. Din il-marka tindika prinċipalment li l-input jew il-qari tal-cache daħal f’livell ogħla; ma tfissirx li l-ispejjeż kollha tat-talba sempliċement ġew immultiplikati b’2. L-output jista’ juża multiplikatur differenti skont il-livell.</p><p></p><p><strong> ## Kif tevita li tattiva l-kontijiet skont il-livell</strong></p><p>Jekk ma għandekx bżonn tieqa ta’ kuntest ta’ 1M Token, huwa rakkomandat li taġġusta l-limitu tal-kuntest ta’ Codex għal 272K jew inqas.</p><p></p><p>Iftaħ:</p><p> ~/.codex/config.toml</p><p></p><p>Ikkonverti l-konfigurazzjoni ta’ 1M mill-artiklu oriġinali:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>għal:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Wara li tissejvja, ibda mill-ġdid Codex u oħloq sessjoni ġdida.</p><p></p><p>Jekk tixtieq li dan japplika temporanjament għal sessjoni waħda biss, tista’ tuża:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Huwa rakkomandat ukoll li:</p><p> - tattiva l-kompressjoni awtomatika fil-ħin;</p><p> - taqsam il-kompiti twal f’diversi sessjonijiet;</p><p> - tnaqqas l-ammont kbir ta’ output mill-għodod li jintbagħat f’daqqa;</p><p> - tagħmel sommarju u tnaddaf regolarment il-kontenut ta’ konversazzjonijiet aktar antiki.</p><p></p><p>Jekk tassew għandek bżonn tieqa ta’ kuntest ta’ 1M Token, tista’ tkompli tuża l-konfigurazzjoni oriġinali, iżda wara li taqbeż 272K se jiġu applikati l-prezzijiet għoljin skont il-livell ta’ OpenAI.</p><p></p><p>Għarraf dwar il-konfigurazzjoni oriġinali, irreferi għal: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kif tattiva tieqa ta’ kuntest ta’ miljun Token f’Codex għal GPT-5.6 Sol </a></p><p></p><p>Grazzi tal-fehim u l-appoġġ tiegħek.</p>
  • 0 Votes
    1 Posts
    51 Views
    A
    <p>OpenAI uusimate hinnastamisreeglite kohaselt kasutavad GPT-5.6 Sol ja teised mudelid ülipika kontekstiga päringute puhul astmelist hinnastamist.</p><p>Kui ühe päringu kontekst ületab 272K tokenit, võidakse sisendile, vahemälust loetud tokenitele ja väljundile rakendada kõrgema astme hinda. See reegel pärineb OpenAI ametlikust hinnastamisest ega kujuta endast AI-ROUTERi ajutist lisatasu ega ebatavalist arveldust.</p><p></p><p>Näiteks GPT-5.6 Soli standardhinnad:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Üksus Kuni 272K Üle 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Sisend $5 / 1M tokenit $10 / 1M tokenit</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Vahemälust loetud $0.50 / 1M tokenit $1 / 1M tokenit</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Väljund $30 / 1M tokenit $45 / 1M tokenit</code></pre><p></p><p>Lõplik tasu arvutatakse endiselt konkreetse rühma, konto kordaja ja muude arveldusseadete alusel.</p><p></p><p>Kasutusandmetes kuvatav x2-märgis tähendab, et see päring käivitas pika konteksti astmelise hinnastamise. See märgis näitab peamiselt seda, et sisend või vahemälust lugemine jõudis kõrgemasse astmesse. See ei tähenda, et kõik päringu tasud lihtsalt kahekordistuvad; väljundile võidakse rakendada teistsugust astmelist kordajat.</p><p></p><p><strong> ## Kuidas vältida astmelise hinnastamise rakendumist</strong></p><p>Kui te ei vaja 1M tokeni suurust kontekstiakent, on soovitatav vähendada Codexi konteksti ülempiir tagasi 272K tokenini või väiksemaks.</p><p></p><p>Avage:</p><p> ~/.codex/config.toml</p><p></p><p>Asendage varasemas artiklis esitatud 1M konfiguratsioon:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>järgmise konfiguratsiooniga:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Salvestage muudatused, taaskäivitage Codex ja alustage uus seanss.</p><p></p><p>Kui soovite muudatust rakendada ajutiselt ainult ühele seansile, kasutage järgmist käsku:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Samuti on soovitatav:</p><p> - lülitada automaatne tihendamine õigel ajal sisse;</p><p> - jagada ülipikad ülesanded mitmeks seansiks;</p><p> - vähendada ühe korraga tagastatavate tööriistaväljundite hulka;</p><p> - teha regulaarselt kokkuvõtteid ja puhastada varasemad vestlussisu osad.</p><p></p><p>Kui vajate tõepoolest 1M tokeni suurust kontekstiakent, võite jätkata algse konfiguratsiooni kasutamist, kuid pärast 272K piiri ületamist rakendatakse OpenAI kõrgema astme hindu.</p><p></p><p>Algse konfiguratsiooni juhised leiate siit: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kuidas lubada Codexis GPT-5.6 Soli jaoks 1 miljoni tokeni suurune kontekstiaken </a></p><p></p><p>Täname mõistva suhtumise ja toetuse eest.</p>
  • 0 Votes
    1 Posts
    44 Views
    A
    <p>V skladu z najnovejšimi pravili obračunavanja OpenAI modeli, kot je GPT-5.6 Sol, za zahteve z izjemno dolgim kontekstom uporabljajo stopenjske cene.</p><p>Ko kontekst posamezne zahteve preseže 272K žetonov, se lahko vhod, branje predpomnilnika in izhod obračunajo po višji cenovni stopnji. To pravilo izhaja iz uradnega cenika OpenAI in ne pomeni začasnega doplačila ali nepravilnega obračunavanja pri AI-ROUTER.</p><p></p><p>Za primer vzemimo standardne cene za GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Postavka Do 272K Nad 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Vhod $5 / 1M žetonov $10 / 1M žetonov</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Branje predpomnilnika $0.50 / 1M žetonov $1 / 1M žetonov</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Izhod $30 / 1M žetonov $45 / 1M žetonov</code></pre><p></p><p>Končni strošek se še vedno izračuna glede na konkretno skupino, množilnik računa in druge nastavitve obračunavanja.</p><p></p><p>Oznaka x2 v zapisu uporabe pomeni, da je ta zahteva sprožila stopenjsko obračunavanje za dolg kontekst. Oznaka predvsem pomeni, da sta vhod in branje predpomnilnika prešla v višjo cenovno stopnjo; ne pomeni, da so se vsi stroški celotne zahteve preprosto podvojili. Za izhod se lahko uporabi drugačen stopenjski množilnik.</p><p></p><p><strong> ## Kako se izogniti stopenjskemu obračunavanju</strong></p><p>Če ne potrebujete kontekstnega okna z 1M žetoni, priporočamo, da omejitev konteksta v Codexu nastavite nazaj na največ 272K.</p><p></p><p>Odprite:</p><p> ~/.codex/config.toml</p><p></p><p>Prvotno konfiguracijo za 1M žetonov:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>spremenite v:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Po shranjevanju znova zaženite Codex in ustvarite novo sejo.</p><p></p><p>Če želite spremembo začasno uporabiti samo za eno sejo, lahko uporabite:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Priporočamo tudi:</p><p> - pravočasno vklopite samodejno stiskanje;</p><p> - zelo dolge naloge razdelite na več sej;</p><p> - zmanjšajte količino izpisov orodij, vrnjenih naenkrat;</p><p> - redno povzemajte in čistite starejšo vsebino pogovora.</p><p></p><p>Če kontekstno okno z 1M žetoni dejansko potrebujete, lahko še naprej uporabljate prvotno konfiguracijo, vendar se bo del nad 272K obračunal po višji cenovni stopnji OpenAI.</p><p></p><p>Za izvirna navodila za konfiguracijo glejte: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kako v Codexu omogočiti kontekstno okno z 1 milijonom žetonov za GPT-5.6 Sol </a></p><p></p><p>Hvala za razumevanje in podporo.</p>
  • 0 Votes
    1 Posts
    47 Views
    A
    <p>Σύμφωνα με τους πιο πρόσφατους κανόνες χρέωσης της OpenAI, μοντέλα όπως το GPT-5.6 Sol χρησιμοποιούν κλιμακωτή τιμολόγηση για αιτήματα με εξαιρετικά μεγάλο περιβάλλον συμφραζομένων.</p><p>Όταν το περιβάλλον συμφραζομένων ενός αιτήματος υπερβαίνει τα 272K tokens, η είσοδος, η ανάγνωση από την προσωρινή μνήμη και η έξοδος ενδέχεται να χρεώνονται με υψηλότερη κλίμακα. Ο κανόνας αυτός προέρχεται από την επίσημη τιμολόγηση της OpenAI και δεν αποτελεί προσωρινή πρόσθετη χρέωση ή异常 χρέωση του AI-ROUTER.</p><p></p><p>Για παράδειγμα, με τις τυπικές τιμές του GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Στοιχείο Εντός 272K Πάνω από 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Είσοδος $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Ανάγνωση cache $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Έξοδος $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Η τελική χρέωση εξακολουθεί να υπολογίζεται με βάση τη συγκεκριμένη ομάδα, τον πολλαπλασιαστή του λογαριασμού και άλλες ρυθμίσεις χρέωσης.</p><p></p><p>Η ένδειξη x2 που εμφανίζεται στις记录 χρήσης σημαίνει ότι το συγκεκριμένο αίτημα ενεργοποίησε την κλιμακωτή χρέωση για μεγάλο περιβάλλον συμφραζομένων. Η ένδειξη αφορά κυρίως την είσοδο και την ανάγνωση από την προσωρινή μνήμη, οι οποίες πέρασαν σε υψηλότερη κλίμακα. Δεν σημαίνει ότι όλες οι χρεώσεις του αιτήματος διπλασιάστηκαν απλά· η έξοδος ενδέχεται να χρησιμοποιεί διαφορετικό συντελεστή κλίμακας.</p><p></p><p><strong> ## Πώς να αποφύγετε την ενεργοποίηση της κλιμακωτής χρέωσης</strong></p><p>Αν δεν χρειάζεστε παράθυρο περιβάλλοντος συμφραζομένων 1M tokens, συνιστάται να επαναφέρετε το όριο περιβάλλοντος του Codex σε έως 272K.</p><p></p><p>Ανοίξτε το:</p><p> ~/.codex/config.toml</p><p></p><p>Αλλάξτε τη ρύθμιση 1M από το αρχικό άρθρο:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>σε:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Αποθηκεύστε τις αλλαγές, επανεκκινήστε το Codex και δημιουργήστε μια νέα συνεδρία.</p><p></p><p>Αν θέλετε να ισχύσει προσωρινά μόνο για μία συνεδρία, μπορείτε να χρησιμοποιήσετε:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Συνιστάται επίσης:</p><p> - Να ενεργοποιείτε εγκαίρως την αυτόματη συμπύκνωση·</p><p> - Να χωρίζετε τις εργασίες μεγάλης διάρκειας σε πολλές συνεδρίες·</p><p> - Να μειώνετε την ποσότητα των αποτελεσμάτων εργαλείων που επιστρέφονται ταυτόχρονα·</p><p> - Να συνοψίζετε και να καθαρίζετε τακτικά το παλαιότερο περιεχόμενο της συνομιλίας.</p><p></p><p>Αν χρειάζεστε πράγματι παράθυρο περιβάλλοντος συμφραζομένων 1M tokens, μπορείτε να συνεχίσετε να χρησιμοποιείτε την αρχική ρύθμιση. Ωστόσο, μετά τα 272K tokens θα εφαρμόζεται η υψηλότερη κλιμακωτή τιμολόγηση της OpenAI.</p><p></p><p>Για την αρχική说明 ρύθμιση, ανατρέξτε στο: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Πώς να ενεργοποιήσετε περιβάλλον συμφραζομένων 1 εκατομμυρίου Token στο Codex για το GPT-5.6 Sol </a></p><p></p><p>Σας ευχαριστούμε για την κατανόηση και την υποστήριξή σας.</p>
  • 0 Votes
    1 Posts
    51 Views
    A
    <p>OpenAI:n uusimpien hinnoittelusääntöjen mukaan GPT-5.6 Solin kaltaiset mallit käyttävät erittäin pitkille kontekstipyynnöille porrastettua hinnoittelua.</p><p>Kun yhden pyynnön konteksti ylittää 272K tokenia, syötteen, välimuistista luetun sisällön ja tulosteen hinnoittelu voidaan laskea korkeamman hintaportaan mukaan. Tämä sääntö perustuu OpenAI:n viralliseen hinnoitteluun, eikä kyse ole AI-ROUTERin tilapäisestä lisämaksusta tai poikkeavasta veloituksesta.</p><p></p><p>Esimerkkinä GPT-5.6 Solin vakiohinnat:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Kohde Enintään 272K Yli 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Syöte $5 / 1M tokenia $10 / 1M tokenia</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Välimuistiluku $0.50 / 1M tokenia $1 / 1M tokenia</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Tuloste $30 / 1M tokenia $45 / 1M tokenia</code></pre><p></p><p>Lopullinen hinta lasketaan edelleen tietyn ryhmittelyn, tilin kertoimen ja muiden hinnoitteluasetusten perusteella.</p><p></p><p>Käyttötiedoissa näkyvä x2-merkintä tarkoittaa, että kyseinen pyyntö on siirtynyt pitkän kontekstin porrastettuun hinnoitteluun. Merkintä tarkoittaa ensisijaisesti sitä, että syöte ja välimuistista lukeminen siirtyivät korkeampaan hintaportaaseen. Se ei tarkoita, että kaikki pyynnön kustannukset yksinkertaisesti kaksinkertaistuisivat; tulosteessa voidaan käyttää eri porrastuskerrointa.</p><p></p><p><strong> ## Kuinka porrastetun hinnoittelun voi välttää</strong></p><p>Jos et tarvitse 1M tokenin konteksti-ikkunaa, Codexin kontekstiraja kannattaa säätää takaisin enintään 272K tokeniin.</p><p></p><p>Avaa:</p><p> ~/.codex/config.toml</p><p></p><p>Muuta artikkelin aiempi 1M:n asetus:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>seuraavaksi:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Tallenna muutokset, käynnistä Codex uudelleen ja aloita uusi istunto.</p><p></p><p>Jos haluat ottaa asetuksen käyttöön tilapäisesti vain yhdessä istunnossa, voit käyttää seuraavaa komentoa:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Lisäksi suositellaan:</p><p> - ota automaattinen tiivistäminen käyttöön ajoissa;</p><p> - jaa erittäin pitkät tehtävät useisiin istuntoihin;</p><p> - vähennä kerralla palautettavien työkalutulosteiden määrää;</p><p> - tiivistä ja siivoa vanhempaa keskustelusisältöä säännöllisesti.</p><p></p><p>Jos tarvitset todella 1M tokenin konteksti-ikkunaa, voit jatkaa alkuperäisen asetuksen käyttöä, mutta 272K tokenin ylittävästä osuudesta veloitetaan OpenAI:n korkeamman hintaportaan mukaisesti.</p><p></p><p>Alkuperäiset määritysohjeet ovat saatavilla täällä: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Kuinka ottaa GPT-5.6 Solin miljoonan tokenin konteksti-ikkuna käyttöön Codexissa </a></p><p></p><p>Kiitos ymmärryksestäsi ja tuestasi.</p>
  • 0 Votes
    1 Posts
    51 Views
    A
    <p>Съгласно най-новите правила за ценообразуване на OpenAI, модели като GPT-5.6 Sol използват стъпаловидни цени за заявки със свръхдълъг контекст.</p><p>Когато контекстът на една заявка надхвърля 272K токена, входът, четенето от кеша и изходът могат да бъдат таксувани по по-високо ценово ниво. Това правило идва от официалното ценообразуване на OpenAI, а не представлява временно допълнително оскъпяване или необичайно таксуване от AI-ROUTER.</p><p></p><p>Например при стандартните цени на GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Елемент До 272K Над 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Вход $5 / 1M токена $10 / 1M токена</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Четене от кеша $0.50 / 1M токена $1 / 1M токена</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Изход $30 / 1M токена $45 / 1M токена</code></pre><p></p><p>Крайната сума все пак се изчислява въз основа на конкретната група, множителя за акаунта и други настройки за таксуване.</p><p></p><p>Обозначението x2 в историята на използването означава, че заявката е задействала стъпаловидно ценообразуване за дълъг контекст. То основно показва, че входът и четенето от кеша са преминали към по-високо ценово ниво, но не означава, че всички разходи по заявката са просто удвоени; за изхода може да се прилага различен множител на съответното ценово ниво.</p><p></p><p><strong> ## Как да избегнете стъпаловидното ценообразуване</strong></p><p>Ако не се нуждаете от контекстен прозорец от 1M токена, препоръчваме да намалите лимита на контекста в Codex до 272K или по-малко.</p><p></p><p>Отворете:</p><p> ~/.codex/config.toml</p><p></p><p>Променете конфигурацията от първоначалната статия за 1M:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>на:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Запазете промените, рестартирайте Codex и започнете нова сесия.</p><p></p><p>Ако искате промяната да важи временно само за една сесия, можете да използвате:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Също така препоръчваме:</p><p> - своевременно да активирате автоматичното компресиране;</p><p> - да разделяте дългите задачи на няколко сесии;</p><p> - да намалите големия обем изход от инструменти, който се връща наведнъж;</p><p> - редовно да обобщавате и изчиствате по-старото съдържание на разговорите.</p><p></p><p>Ако действително се нуждаете от контекстен прозорец от 1M токена, можете да продължите да използвате първоначалната конфигурация, но съдържанието над 272K ще бъде таксувано по високите ценови нива на OpenAI.</p><p></p><p>За първоначалните инструкции за конфигурация вижте: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Как да активирате контекстен прозорец от 1 милион токена в Codex за GPT-5.6 Sol </a></p><p></p><p>Благодарим ви за разбирането и подкрепата.</p>
  • 0 Votes
    1 Posts
    32 Views
    A
    <p>Secondo le più recenti regole di fatturazione di OpenAI, modelli come GPT-5.6 Sol applicano prezzi a scaglioni alle richieste con contesto ultra-lungo.</p><p>Quando il contesto di una singola richiesta supera 272K token, l'input, la lettura della cache e l'output possono essere calcolati secondo uno scaglione di prezzo più elevato. Questa regola deriva dai prezzi ufficiali di OpenAI e non rappresenta un aumento temporaneo o un addebito anomalo da parte di AI-ROUTER.</p><p></p><p>Prendendo come esempio i prezzi standard di GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Voce Entro 272K Oltre 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M token $10 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Lettura cache $0.50 / 1M token $1 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M token $45 / 1M token</code></pre><p></p><p>Il costo finale sarà comunque calcolato in base al gruppo specifico, al moltiplicatore dell'account e alle altre configurazioni di fatturazione.</p><p></p><p>La comparsa del contrassegno x2 nei dati di utilizzo indica che la richiesta ha attivato la tariffazione a scaglioni per il contesto lungo. Questo contrassegno indica principalmente che l'input e la lettura della cache sono passati a uno scaglione superiore; non significa che tutti i costi dell'intera richiesta siano semplicemente raddoppiati. L'output può utilizzare un moltiplicatore a scaglioni diverso.</p><p></p><p><strong> ## Come evitare di attivare la tariffazione a scaglioni</strong></p><p>Se non è necessaria una finestra di contesto da 1M token, si consiglia di riportare il limite del contesto di Codex entro 272K.</p><p></p><p>Aprire:</p><p> ~/.codex/config.toml</p><p></p><p>Sostituire la configurazione da 1M indicata nell'articolo originale:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>con:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Dopo aver salvato, riavviare Codex e creare una nuova sessione.</p><p></p><p>Se si desidera applicare temporaneamente la modifica a una singola sessione, è possibile utilizzare:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Si consiglia inoltre di:</p><p> - attivare tempestivamente la compressione automatica;</p><p> - suddividere le attività molto lunghe in più sessioni;</p><p> - ridurre la quantità di output degli strumenti restituita in una sola volta;</p><p> - riepilogare e ripulire periodicamente i contenuti meno recenti della conversazione.</p><p></p><p>Se è effettivamente necessaria una finestra di contesto da 1M token, è possibile continuare a utilizzare la configurazione originale, ma oltre 272K la fatturazione seguirà i prezzi dello scaglione superiore di OpenAI.</p><p></p><p>Per la configurazione originale, consultare: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Come abilitare una finestra di contesto da 1 milione di token in Codex per GPT-5.6 Sol </a></p><p></p><p>Grazie per la comprensione e il supporto.</p>
  • 0 Votes
    1 Posts
    35 Views
    A
    <p>Podle nejnovějších pravidel účtování OpenAI používají modely jako GPT-5.6 Sol pro požadavky s velmi dlouhým kontextem stupňovité ceny.</p><p>Pokud kontext jednorázového požadavku překročí 272K tokenů, mohou být vstup, načítání z mezipaměti i výstup účtovány podle vyššího cenového pásma. Toto pravidlo pochází z oficiálního ceníku OpenAI a nejde o dočasné navýšení ceny ani nestandardní účtování ze strany AI-ROUTER.</p><p></p><p>Například u standardních cen GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Položka Do 272K Nad 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Vstup $5 / 1M tokenů $10 / 1M tokenů</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Načítání z mezipaměti $0.50 / 1M tokenů $1 / 1M tokenů</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Výstup $30 / 1M tokenů $45 / 1M tokenů</code></pre><p></p><p>Celková cena se i nadále vypočítává podle konkrétní skupiny, násobitele účtu a dalších nastavení účtování.</p><p></p><p>Označení x2 v historii použití znamená, že požadavek aktivoval stupňovité účtování dlouhého kontextu. Toto označení se týká především vstupu a načítání z mezipaměti, které přešly do vyššího cenového pásma. Neznamená, že se všechny náklady za celý požadavek jednoduše zdvojnásobily; výstup může používat jiný násobitel cenového pásma.</p><p></p><p><strong> ## Jak se vyhnout stupňovitému účtování</strong></p><p>Pokud nepotřebujete kontextové okno o velikosti 1M tokenů, doporučujeme nastavit limit kontextu Codexu zpět na hodnotu do 272K.</p><p></p><p>Otevřete:</p><p> ~/.codex/config.toml</p><p></p><p>Původní konfiguraci pro 1M tokenů:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>upravte na:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Po uložení restartujte Codex a vytvořte novou relaci.</p><p></p><p>Pokud chcete nastavení použít dočasně pouze pro jednu relaci, můžete použít:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Zároveň doporučujeme:</p><p> - včas zapnout automatickou kompresi;</p><p> - rozdělit dlouhé úlohy do více relací;</p><p> - omezit množství výstupu nástrojů vraceného najednou;</p><p> - pravidelně shrnovat a čistit starší obsah konverzace.</p><p></p><p>Pokud skutečně potřebujete kontextové okno o velikosti 1M tokenů, můžete původní konfiguraci nadále používat. Po překročení 272K však bude účtování probíhat podle vyššího cenového pásma OpenAI.</p><p></p><p>Původní popis konfigurace najdete zde: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Jak v Codexu povolit kontextové okno o velikosti 1 milionu tokenů pro GPT-5.6 Sol </a></p><p></p><p>Děkujeme za pochopení a podporu.</p>
  • 0 Votes
    1 Posts
    52 Views
    A
    <p>Zgodnie z najnowszymi zasadami rozliczeń OpenAI modele takie jak GPT-5.6 Sol stosują ceny progowe dla żądań z bardzo długim kontekstem.</p><p>Gdy kontekst pojedynczego żądania przekracza 272 tys. tokenów, tokeny wejściowe, odczyt z pamięci podręcznej oraz dane wyjściowe mogą być rozliczane według wyższego progu cenowego. Zasada ta wynika z oficjalnego cennika OpenAI i nie jest tymczasową podwyżką ani nieprawidłowym naliczeniem opłat przez AI-ROUTER.</p><p></p><p>Przykładowe standardowe ceny GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Pozycja Do 272K Powyżej 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Wejście $5 / 1M tokenów $10 / 1M tokenów</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Odczyt z pamięci $0.50 / 1M tokenów $1 / 1M tokenów</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Wyjście $30 / 1M tokenów $45 / 1M tokenów</code></pre><p></p><p>Ostateczna opłata jest nadal obliczana na podstawie konkretnej grupy, mnożnika konta oraz innych ustawień rozliczeń.</p><p></p><p>Oznaczenie x2 widoczne w historii użycia oznacza, że dane żądanie uruchomiło progowe rozliczanie długiego kontekstu. Oznaczenie to wskazuje przede wszystkim, że wejście lub odczyt z pamięci podręcznej został rozliczony według wyższego progu. Nie oznacza ono, że wszystkie opłaty za całe żądanie zostały po prostu podwojone; dane wyjściowe mogą podlegać innemu mnożnikowi progowemu.</p><p></p><p><strong> ## Jak uniknąć progowego rozliczania</strong></p><p>Jeśli nie potrzebujesz okna kontekstu o rozmiarze 1 mln tokenów, zalecamy ustawienie limitu kontekstu Codex z powrotem na maksymalnie 272 tys. tokenów.</p><p></p><p>Otwórz:</p><p> ~/.codex/config.toml</p><p></p><p>Zmień wcześniejszą konfigurację 1 mln tokenów:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>na:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Zapisz zmiany, uruchom ponownie Codex i rozpocznij nową sesję.</p><p></p><p>Jeśli chcesz tymczasowo zastosować ustawienia tylko dla jednej sesji, możesz użyć:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Zalecamy również:</p><p> - włączyć automatyczną kompresję w odpowiednim momencie;</p><p> - dzielić bardzo długie zadania na wiele sesji;</p><p> - ograniczyć ilość danych wyjściowych z narzędzi zwracanych jednorazowo;</p><p> - regularnie podsumowywać i usuwać starsze treści rozmów.</p><p></p><p>Jeśli rzeczywiście potrzebujesz okna kontekstu o rozmiarze 1 mln tokenów, możesz nadal korzystać z pierwotnej konfiguracji, jednak tokeny przekraczające 272 tys. będą rozliczane według wyższych progów cenowych OpenAI.</p><p></p><p>Oryginalne informacje o konfiguracji znajdziesz tutaj: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Jak włączyć okno kontekstu o rozmiarze 1 miliona tokenów w Codex dla GPT-5.6 Sol </a></p><p></p><p>Dziękujemy za wyrozumiałość i wsparcie.</p>
  • 0 Votes
    1 Posts
    41 Views
    A
    <p>Ifølge OpenAIs seneste gebyrregler anvender modeller som GPT-5.6 Sol trinvise priser for anmodninger med ekstra lange kontekster.</p><p>Når konteksten i en enkelt anmodning overstiger 272K tokens, kan input, cachelæsning og output blive beregnet efter et højere prisniveau. Reglen stammer fra OpenAIs officielle prissætning og er ikke en midlertidig prisstigning eller en fejlagtig opkrævning fra AI-ROUTER.</p><p></p><p>Her er GPT-5.6 Sols standardpriser som eksempel:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Post Inden for 272K Over 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cachelæsning $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den endelige pris beregnes stadig ud fra den konkrete gruppe, kontoens multiplikator og andre gebyrindstillinger.</p><p></p><p>Hvis der vises en x2-markering i brugsoversigten, betyder det, at denne anmodning har udløst trinvist gebyr for lang kontekst. Markeringen angiver primært, at input/cachelæsning er gået over på et højere prisniveau, og betyder ikke, at alle omkostninger for hele anmodningen blot er fordoblet. Output kan være underlagt en anden trinvist beregnet multiplikator.</p><p></p><p><strong> ## Sådan undgår du trinvist gebyr</strong></p><p>Hvis du ikke har brug for et kontekstvindue på 1M tokens, anbefales det at justere Codex' kontekstgrænse tilbage til højst 272K.</p><p></p><p>Åbn:</p><p> ~/.codex/config.toml</p><p></p><p>Den oprindelige 1M-konfiguration fra den tidligere artikel:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>ændres til:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Gem ændringerne, genstart Codex, og opret en ny session.</p><p></p><p>Hvis ændringen kun skal gælde midlertidigt for en enkelt session, kan du bruge:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Det anbefales også at:</p><p> - aktivere automatisk komprimering i tide;</p><p> - opdele lange opgaver i flere sessioner;</p><p> - begrænse store mængder værktøjsoutput, der returneres på én gang;</p><p> - opsummere og rydde op i ældre samtaleindhold regelmæssigt.</p><p></p><p>Hvis du faktisk har brug for et kontekstvindue på 1M tokens, kan du fortsætte med den oprindelige konfiguration, men tokens over 272K vil blive opkrævet efter OpenAIs højere prisniveau.</p><p></p><p>Se den oprindelige konfigurationsvejledning her: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Sådan aktiverer du et kontekstvindue på 1 million tokens i Codex til GPT-5.6 Sol </a></p><p></p><p>Tak for din forståelse og støtte.</p>
  • 0 Votes
    1 Posts
    40 Views
    A
    <p>Az OpenAI legújabb díjszabási szabályai szerint a GPT-5.6 Sol és más modellek lépcsőzetes árakat alkalmaznak az extra hosszú kontextust használó kérésekre.</p><p>Ha egyetlen kérés kontextusa meghaladja a 272K tokent, a bemenet, a gyorsítótárból történő olvasás és a kimenet magasabb díjsáv szerint kerülhet elszámolásra. Ez a szabály az OpenAI hivatalos árazásából ered, és nem az AI-ROUTER ideiglenes felára vagy hibás terhelése.</p><p></p><p>Példaként a GPT-5.6 Sol standard árai:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Tétel 272K alatt 272K felett</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Bemenet $5 / 1M token $10 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Gyorsítótárból $0.50 / 1M token $1 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Kimenet $30 / 1M token $45 / 1M token</code></pre><p></p><p>A végleges díj továbbra is a konkrét csoport, a fiókhoz tartozó szorzó és az egyéb számlázási beállítások alapján kerül kiszámításra.</p><p></p><p>A használati adatokban megjelenő x2 jelölés azt jelenti, hogy az adott kérés aktiválta az extra hosszú kontextusra vonatkozó lépcsőzetes díjszabást. Ez a jelölés elsősorban azt mutatja, hogy a bemenet és a gyorsítótárból történő olvasás magasabb díjsávba került; nem jelenti azt, hogy a teljes kérés minden költsége egyszerűen megduplázódik. A kimenetre eltérő lépcsőzetes szorzó vonatkozhat.</p><p></p><p><strong> ## Hogyan kerülhető el a lépcsőzetes díjszabás aktiválása</strong></p><p>Ha nincs szükség 1M tokenes kontextusablakra, javasoljuk, hogy a Codex kontextuskorlátját állítsa vissza legfeljebb 272K tokenre.</p><p></p><p>Nyissa meg:</p><p> ~/.codex/config.toml</p><p></p><p>Az eredeti cikkben szereplő 1M-es beállítás:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>Állítsa át erre:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Mentse a fájlt, majd indítsa újra a Codexet, és hozzon létre új munkamenetet.</p><p></p><p>Ha csak ideiglenesen, egyetlen munkamenetre szeretné alkalmazni a beállítást, használhatja ezt:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Emellett javasoljuk:</p><p> - időben kapcsolja be az automatikus tömörítést;</p><p> - ossza fel a hosszú feladatokat több munkamenetre;</p><p> - csökkentse az egyszerre visszaadott eszközkimenetek mennyiségét;</p><p> - rendszeresen foglalja össze és törölje a régebbi beszélgetési tartalmakat.</p><p></p><p>Ha valóban szüksége van 1M tokenes kontextusablakra, továbbra is használhatja az eredeti beállítást, azonban 272K token felett az OpenAI magasabb díjsáv szerinti árazása lesz érvényes.</p><p></p><p>Az eredeti konfigurációs útmutató itt található: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Az 1 millió tokenes kontextusablak engedélyezése a Codexben GPT-5.6 Solhoz </a></p><p></p><p>Köszönjük megértését és támogatását.</p>
  • 0 Votes
    1 Posts
    53 Views
    A
    <p>OpenAI의 최신 요금 정책에 따라 GPT-5.6 Sol 등의 모델은 초장문 컨텍스트 요청에 계단식 요금을 적용합니다.</p><p>단일 요청의 컨텍스트가 272K tokens를 초과하면 입력, 캐시 읽기 및 출력에 더 높은 계단식 요금이 적용될 수 있습니다. 이 규칙은 OpenAI의 공식 가격 정책에 따른 것이며, AI-ROUTER의 임시 추가 요금이나 비정상적인 과금이 아닙니다.</p><p></p><p>GPT-5.6 Sol의 표준 요금을 예로 들면 다음과 같습니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 항목 272K 이하 272K 초과</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 입력 $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 캐시 읽기 $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> 출력 $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>최종 비용은 구체적인 그룹, 계정 배율 및 기타 과금 설정에 따라 계산됩니다.</p><p></p><p>사용 기록에 x2 표시가 나타나는 것은 해당 요청에 장문 컨텍스트 계단식 요금이 적용되었음을 의미합니다. 이 표시는 주로 입력 및 캐시 읽기가 더 높은 요금 계단에 진입했음을 나타내며, 요청 전체의 모든 비용이 단순히 2배가 된다는 의미는 아닙니다. 출력에는 다른 계단식 배율이 적용될 수 있습니다.</p><p></p><p><strong> ## 계단식 요금 적용을 피하는 방법</strong></p><p>1M Token 컨텍스트 창이 필요하지 않다면 Codex의 컨텍스트 한도를 272K 이하로 조정하는 것이 좋습니다.</p><p></p><p>다음 파일을 엽니다.</p><p> ~/.codex/config.toml</p><p></p><p>기존 글의 1M 설정을 다음과 같이 변경합니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>다음과 같이 조정합니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>저장한 후 Codex를 다시 시작하고 새 세션을 만드세요.</p><p></p><p>특정 세션 하나에만 임시로 적용하려면 다음 명령을 사용할 수 있습니다.</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> 다음 사항도 권장합니다.</p><p> - 자동 압축을 적절히 활성화합니다.</p><p> - 초장문 작업을 여러 세션으로 나눕니다.</p><p> - 한 번에 반환되는 대량의 도구 출력을 줄입니다.</p><p> - 오래된 대화 내용을 정기적으로 요약하고 정리합니다.</p><p></p><p>1M Token 컨텍스트 창이 실제로 필요하다면 기존 설정을 계속 사용할 수 있습니다. 단, 272K를 초과하는 부분에는 OpenAI의 더 높은 계단식 요금이 적용됩니다.</p><p></p><p>기존 설정 안내는 다음을 참고하세요. <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Codex에서 GPT-5.6 Sol에 100만 Token 컨텍스트 창을 활성화하는 방법 </a></p><p></p><p>이해와 지원에 감사드립니다.</p>
  • 0 Votes
    1 Posts
    55 Views
    A
    <p>Enligt OpenAIs senaste prisregler använder modeller som GPT-5.6 Sol trappstegsbaserad prissättning för förfrågningar med extremt lång kontext.</p><p>När kontexten i en enskild förfrågan överstiger 272K tokens kan indata, läsning från cache och utdata beräknas enligt ett högre pristrappsteg. Regeln kommer från OpenAIs officiella prissättning och är inte en tillfällig prisökning eller felaktig debitering från AI-ROUTER.</p><p></p><p>Exempel med GPT-5.6 Sols standardpriser:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Post Inom 272K Över 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Indata $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cach läses $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Utdata $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>Den slutliga kostnaden beräknas fortfarande utifrån den specifika gruppen, kontots multiplikator och andra prisinställningar.</p><p></p><p>Om en x2-markering visas i användningshistoriken betyder det att förfrågan har aktiverat trappstegsbaserad prissättning för lång kontext. Markeringen betyder främst att indata eller läsning från cache har gått in i ett högre pristrappsteg. Det innebär inte att alla kostnader för hela förfrågan helt enkelt har fördubblats; utdata kan använda en annan trappstegsmultiplikator.</p><p></p><p><strong> ## Så undviker du trappstegsbaserad prissättning</strong></p><p>Om du inte behöver ett kontextfönster på 1M tokens rekommenderar vi att du justerar Codex kontextgräns till högst 272K.</p><p></p><p>Öppna:</p><p> ~/.codex/config.toml</p><p></p><p>Ändra den tidigare 1M-konfigurationen:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>till:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Spara ändringarna, starta om Codex och skapa en ny session.</p><p></p><p>Om du bara vill att inställningen ska gälla tillfälligt för en enskild session kan du använda:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Vi rekommenderar även att du:</p><p> - aktiverar automatisk komprimering i tid;</p><p> - delar upp mycket långa uppgifter i flera sessioner;</p><p> - minskar mängden verktygsutdata som returneras på en gång;</p><p> - regelbundet sammanfattar och rensar äldre konversationsinnehåll.</p><p></p><p>Om du faktiskt behöver ett kontextfönster på 1M tokens kan du fortsätta använda den ursprungliga konfigurationen, men tokens över 272K debiteras enligt OpenAIs högre trappstegspriser.</p><p></p><p>Den ursprungliga konfigurationsbeskrivningen finns här: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Så aktiverar du ett kontextfönster på 1 miljon tokens för GPT-5.6 Sol i Codex </a></p><p></p><p>Tack för din förståelse och ditt stöd.</p>
  • 0 Votes
    1 Posts
    32 Views
    A
    <p>בהתאם לכללי התמחור העדכניים של OpenAI, מודלים כמו GPT-5.6 Sol משתמשים בתמחור מדורג עבור בקשות עם הקשר ארוך במיוחד.</p><p>כאשר ההקשר של בקשה יחידה עולה על 272K טוקנים, הקלט, קריאת המטמון והפלט עשויים להיות מחויבים לפי מדרגת מחיר גבוהה יותר. כלל זה מבוסס על התמחור הרשמי של OpenAI, ואינו תוספת מחיר זמנית או חיוב חריג מצד AI-ROUTER.</p><p></p><p>לדוגמה, לפי המחיר הסטנדרטי של GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> פריט עד 272K מעל 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> קלט $5 / 1M טוקנים $10 / 1M טוקנים</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> קריאת מטמון $0.50 / 1M טוקנים $1 / 1M טוקנים</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> פלט $30 / 1M טוקנים $45 / 1M טוקנים</code></pre><p></p><p>העלות הסופית עדיין תחושב בהתאם לקבוצת התמחור הספציפית, למכפיל החשבון ולהגדרות תמחור נוספות.</p><p></p><p>הופעת הסימון x2 ברשומות השימוש מציינת שהבקשה הפעילה תמחור מדורג עבור הקשר ארוך. הסימון מציין בעיקר שהקלט וקריאת המטמון עברו למדרגת מחיר גבוהה יותר, ואינו אומר שכל עלויות הבקשה הוכפלו בפשטות; הפלט עשוי להשתמש במכפיל מדרגה שונה.</p><p></p><p><strong> ## כיצד להימנע מהפעלת תמחור מדורג</strong></p><p>אם אין צורך בחלון הקשר של 1M טוקנים, מומלץ להגדיר את מגבלת ההקשר של Codex מחדש ל-272K או פחות.</p><p></p><p>פתחו את הקובץ:</p><p> ~/.codex/config.toml</p><p></p><p>שנו את הגדרת ה-1M שהופיעה במאמר המקורי:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>להגדרות הבאות:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>שמרו את הקובץ, הפעילו מחדש את Codex ופתחו שיחה חדשה.</p><p></p><p>אם ברצונכם להחיל את ההגדרה באופן זמני על שיחה יחידה בלבד, תוכלו להשתמש בפקודה:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> כמו כן, מומלץ:</p><p> - להפעיל בזמן את הדחיסה האוטומטית;</p><p> - לפצל משימות ארוכות למספר שיחות;</p><p> - להפחית את כמות פלט כלי העזר המוחזרת בבת אחת;</p><p> - לסכם ולנקות באופן קבוע חלקים מוקדמים יותר של השיחה.</p><p></p><p>אם אכן נדרש חלון הקשר של 1M טוקנים, ניתן להמשיך להשתמש בהגדרות המקוריות, אך לאחר חריגה מ-272K החיוב יתבצע לפי מדרגות המחיר הגבוהות יותר של OpenAI.</p><p></p><p>להסבר על ההגדרות המקוריות, ראו: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">כיצד להפעיל חלון הקשר של מיליון טוקנים עבור GPT-5.6 Sol ב-Codex </a></p><p></p><p>תודה על ההבנה והתמיכה.</p>
  • 0 Votes
    1 Posts
    37 Views
    A
    <p>Volgens de nieuwste factureringsregels van OpenAI hanteren modellen zoals GPT-5.6 Sol getrapte prijzen voor verzoeken met extreem lange contexten.</p><p>Wanneer de context van één verzoek meer dan 272K tokens bevat, kunnen invoer, het lezen van de cache en uitvoer volgens een hogere tariefschijf worden berekend. Deze regel is afkomstig uit de officiële prijsstelling van OpenAI en is geen tijdelijke toeslag of onregelmatige afschrijving van AI-ROUTER.</p><p></p><p>Een voorbeeld op basis van de standaardprijzen voor GPT-5.6 Sol:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Onderdeel Binnen 272K Meer dan 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Invoer $5 / 1M tokens $10 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Cache lezen $0.50 / 1M tokens $1 / 1M tokens</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Uitvoer $30 / 1M tokens $45 / 1M tokens</code></pre><p></p><p>De uiteindelijke kosten worden nog steeds berekend op basis van de specifieke groep, accountvermenigvuldigingsfactor en andere factureringsinstellingen.</p><p></p><p>Wanneer er in de gebruiksgegevens een x2-markering verschijnt, betekent dit dat het verzoek de getrapte facturering voor lange contexten heeft geactiveerd. Deze markering geeft voornamelijk aan dat invoer en het lezen van de cache in een hogere tariefschijf vallen. Dit betekent niet dat alle kosten van het volledige verzoek eenvoudigweg worden verdubbeld; voor uitvoer kan een andere tariefvermenigvuldigingsfactor gelden.</p><p></p><p><strong> ## Hoe voorkom je getrapte facturering</strong></p><p>Als je geen contextvenster van 1M tokens nodig hebt, wordt aanbevolen om de contextlimiet van Codex terug te brengen tot maximaal 272K.</p><p></p><p>Open:</p><p> ~/.codex/config.toml</p><p></p><p>Wijzig de 1M-configuratie uit het oorspronkelijke artikel:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>in:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Sla het bestand op, start Codex opnieuw en maak een nieuwe sessie aan.</p><p></p><p>Als je dit slechts tijdelijk voor één sessie wilt toepassen, kun je het volgende gebruiken:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Daarnaast wordt aanbevolen:</p><p> - automatische compressie tijdig in te schakelen;</p><p> - extreem lange taken over meerdere sessies te verdelen;</p><p> - de hoeveelheid tooluitvoer die in één keer wordt teruggegeven te beperken;</p><p> - eerdere gespreksinhoud regelmatig samen te vatten en op te schonen.</p><p></p><p>Als je daadwerkelijk een contextvenster van 1M tokens nodig hebt, kun je de oorspronkelijke configuratie blijven gebruiken. Voor contexten boven 272K worden dan echter de hogere tariefschijven van OpenAI toegepast.</p><p></p><p>Raadpleeg voor de oorspronkelijke configuratie-instructies: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Hoe je in Codex een contextvenster van 1 miljoen tokens inschakelt voor GPT-5.6 Sol </a></p><p></p><p>Bedankt voor je begrip en steun.</p>