Чому надсилання лише «Hi» усе одно може споживати тисячі токенів
-
<h2><strong>Вступ</strong></h2>
<p></p>
<p>Нещодавно деякі користувачі помітили незвичну ситуацію:</p>
<blockquote>
<p>«Я лише надіслав ‘Hi’, чому це спожило понад 10 000 токенів?»</p>
</blockquote>
<p>На перший погляд це може здаватися несподіваним. Повідомлення з двох символів мало б потребувати лише кілька токенів, чи не так?</p>
<p>Відповідь така: <strong>модель обробляє не лише ваше видиме повідомлення.</strong></p>
<p>Сучасні AI-асистенти, особливо агентні інструменти для програмування, такі як Codex, Claude Code та інші AI-інструменти, вбудовані в IDE, надсилають разом із вашим повідомленням значно більше інформації, щоб допомогти моделі зрозуміти завдання й надати кращу відповідь.</p>
<hr>
<p></p>
<h2>Ваше повідомлення — лише мала частина контексту</h2>
<p>Коли ви надсилаєте:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Hi</code></pre>
<p>фактичний запит, який надсилається до AI-моделі, може виглядати радше так:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Системні інструкції
+
Налаштування користувача
+
Налаштовані навички
+
Доступні інструменти
+
Інформація про проєкт
+
Контекст файлів
+
Попередня історія розмови
+
Ваше повідомлення: "Hi"</code></pre>
<p>Загальний розмір усіх цих компонентів і є фактичним контекстом, який обробляє модель.</p>
<p>Тому навіть дуже коротке повідомлення може споживати значну кількість токенів.</p>
<hr>
<h2>Що може збільшувати використання контексту?</h2>
<h3>1. Налаштовані навички</h3>
<p>Якщо у вас увімкнено власні навички або AI-можливості, їхні інструкції потрібно завантажити в контекст моделі.</p>
<p>Наприклад:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Інструкції навички A: 2 000 токенів
Інструкції навички B: 3 000 токенів
Інструкції навички
1 500 токенів</code></pre>
<p>Ще до того, як ви щось введете, ці інструкції вже можуть займати кілька тисяч токенів.</p>
<hr>
<h3>2. Інструменти та можливості агента</h3>
<p>AI-асистенти для програмування зазвичай надають такі інструменти, як:</p>
<ul>
<li><p>читання файлів</p></li>
<li><p>пошук у коді</p></li>
<li><p>виконання команд у терміналі</p></li>
<li><p>операції Git</p></li>
<li><p>доступ до браузера</p></li>
<li><p>зовнішні інтеграції</p></li>
</ul>
<p>Опис цих інструментів та інструкції з їх використання також займають місце в контексті.</p>
<hr>
<h3>3. Контекст проєкту та файлів</h3>
<p>Під час роботи всередині IDE або репозиторію коду AI-клієнт може автоматично включати:</p>
<ul>
<li><p>структуру проєкту</p></li>
<li><p>відкриті файли</p></li>
<li><p>фрагменти коду</p></li>
<li><p>залежності</p></li>
<li><p>конфігураційні файли</p></li>
</ul>
<p>Це допомагає AI зрозуміти ваш проєкт, але також збільшує використання контексту.</p>
<hr>
<h3>4. Попередня історія розмови</h3>
<p>Якщо ви продовжуєте наявну розмову, попередні повідомлення зазвичай знову включаються, щоб модель розуміла контекст.</p>
<p>Наприклад:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Попереднє обговорення: 12 000 токенівНове повідомлення:
Hi</code></pre>
<p>Новий запит усе одно може містити попередні 12 000 токенів.</p>
<hr>
<h2>Як перевірити мінімальне використання токенів</h2>
<p>Якщо ви хочете виміряти використання токенів для простого повідомлення, спробуйте таке:</p>
<ol>
<li><p>Створіть абсолютно нову розмову.</p></li>
<li><p>Вимкніть власні навички.</p></li>
<li><p>Не додавайте файли.</p></li>
<li><p>Не відкривайте робочий простір проєкту.</p></li>
<li><p>Надішліть лише:</p></li>
</ol>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Hi</code></pre>
<p>Це покаже приблизне мінімальне використання контексту.</p>
<hr>
<h2>Вікно контексту vs використання токенів</h2>
<p>Важливо розрізняти:</p>
<h3>Вікно контексту</h3>
<p>Максимальний обсяг інформації, який модель може обробити в одному запиті.</p>
<p>Приклад:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Вікно контексту 1M токенів</code></pre>
<p>це означає, що модель теоретично може обробити до 1 мільйона токенів.</p>
<h3>Використання токенів</h3>
<p>Фактична кількість токенів, включених до конкретного запиту.</p>
<p>Приклад:</p>
<pre class="rounded-lg bg-slate-950 px-4 py-3 text-slate-100"><code>Повідомлення користувача:
HiФактичний запит:
Системні інструкції + інструменти + історія + "Hi"Усього:
15 000 токенів</code></pre>
<p>Велике вікно контексту не означає, що кожен запит споживатиме лише обсяг вашого повідомлення.</p>
<hr>
<h2>Висновок</h2>
<p>Високе використання токенів через коротке повідомлення не обов’язково свідчить про проблему з моделлю чи API.</p>
<p>У середовищах AI-агентів загальний контекст включає багато прихованих компонентів, необхідних для інтелектуальної роботи. Просте «Hi» все одно може призвести до обробки тисяч токенів, якщо сесія містить навички, інструменти, інформацію про проєкт або попередню історію.</p>
<p>Ми рекомендуємо починати чисту сесію без додаткового контексту, коли ви тестуєте базове використання токенів.</p>
<p>Дякуємо за розуміння та постійну підтримку.</p>
Hello! It looks like you're interested in this conversation, but you don't have an account yet.
Getting fed up of having to scroll through the same posts each visit? When you register for an account, you'll always come back to exactly where you were before, and choose to be notified of new replies (either via email, or push notification). You'll also be able to save bookmarks and upvote posts to show your appreciation to other community members.
With your input, this post could be even better 💗
Register Login