Penjelasan tentang Pengebilan Berperingkat untuk Konteks Ultra Panjang GPT-5.6 Sol
-
<p>Menurut peraturan pengebilan terkini OpenAI, model seperti GPT-5.6 Sol menggunakan harga berperingkat untuk permintaan konteks ultra panjang.</p><p>Apabila konteks satu permintaan melebihi 272K token, input, bacaan cache dan output mungkin dikira berdasarkan harga peringkat yang lebih tinggi. Peraturan ini berasal daripada harga rasmi OpenAI, bukannya caj tambahan sementara atau caj luar biasa oleh AI-ROUTER.</p><p></p><p>Menggunakan harga standard GPT-5.6 Sol sebagai contoh:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Item Dalam 272K Melebihi 272K</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ━━━━━━━━━━ ━━━━━━━━━━━━━━━━━━━ ━━━━━━━━━━━━━━━━━</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Input $5 / 1M token $10 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Bacaan cache $0.50 / 1M token $1 / 1M token</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> ────────── ─────────────────── ─────────────────</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> Output $30 / 1M token $45 / 1M token</code></pre><p></p><p>Jumlah akhir masih dikira berdasarkan kumpulan tertentu, gandaan akaun dan konfigurasi pengebilan lain.</p><p></p><p>Kemunculan tanda x2 dalam rekod penggunaan bermaksud permintaan tersebut telah mencetuskan pengebilan berperingkat untuk konteks panjang. Tanda ini terutamanya menunjukkan bahawa input/bacaan cache telah memasuki peringkat yang lebih tinggi, dan tidak bermaksud semua kos bagi keseluruhan permintaan meningkat dua kali ganda secara mudah; output mungkin menggunakan gandaan peringkat yang berbeza.</p><p></p><p><strong> ## Cara mengelakkan pengebilan berperingkat</strong></p><p>Jika anda tidak memerlukan tetingkap konteks 1M token, disyorkan agar had konteks Codex dilaraskan kembali kepada 272K atau kurang.</p><p></p><p>Buka:</p><p> ~/.codex/config.toml</p><p></p><p>Ubah konfigurasi 1M dalam artikel asal:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 1000000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 900000</code></pre><p> </p><p>kepada:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model = "gpt-5.6-sol"</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_context_window = 272000</code></pre><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code> model_auto_compact_token_limit = 250000</code></pre><p> </p><p>Simpan, kemudian mulakan semula Codex dan buat sesi baharu.</p><p></p><p>Jika anda hanya mahu tetapan ini berkuat kuasa buat sementara waktu untuk satu sesi, anda boleh menggunakan:</p><pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>codex -m gpt-5.6-sol -c model_context_window=272000 -c model_auto_compact_token_limit=250000</code></pre><p> Anda juga disyorkan untuk:</p><p> - mengaktifkan pemampatan automatik tepat pada masanya;</p><p> - membahagikan tugasan yang sangat panjang kepada beberapa sesi;</p><p> - mengurangkan jumlah output alat yang dikembalikan sekali gus;</p><p> - membuat ringkasan dan membersihkan kandungan perbualan yang lebih lama secara berkala.</p><p></p><p>Jika anda benar-benar memerlukan tetingkap konteks 1M token, anda boleh terus menggunakan konfigurasi asal, tetapi penggunaan melebihi 272K akan dikenakan harga peringkat tinggi OpenAI.</p><p></p><p>Untuk penerangan konfigurasi asal, rujuk: <a target="_blank" rel="noopener noreferrer nofollow" href="https://ai-router.dev/blog/post-g-677aa3e043912838-how-to-enable-a-1m-token-context-window-in-codex-for-gpt-5-6-sol">Cara mendayakan tetingkap konteks 1 juta token untuk GPT-5.6 Sol dalam Codex </a></p><p></p><p>Terima kasih atas pemahaman dan sokongan anda.</p>
Hello! It looks like you're interested in this conversation, but you don't have an account yet.
Getting fed up of having to scroll through the same posts each visit? When you register for an account, you'll always come back to exactly where you were before, and choose to be notified of new replies (either via email, or push notification). You'll also be able to save bookmarks and upvote posts to show your appreciation to other community members.
With your input, this post could be even better 💗
Register Login