Токени й ціна ШІ: як не розоритися на нейромережі
Чат здається безкоштовним - рівно до першого рахунку
Що таке токени, скільки коштує ШІ і як платити за нейромережу копійки: обираємо глибину відповіді, рахуємо токени, ловимо витоки бюджету та підбираємо модель під задачу.
Що таке токени простими словами
Уяви таксі, де платять не за поїздку, а за кожне слово - і твоє, і водія. Мовчиш усю дорогу? Майже задарма. Кинув «ліворуч біля магазину» - три копійки. Попросив розповісти всю його біографію - діставай гаманець побільше.
ШІ працює рівно так само. Ти платиш не «за питання». Ти платиш за обсяг тексту: за те, що згодував агенту, і за те, що він видав у відповідь. Цей текст ріжеться на крихітні шматочки - токени Токен - шматочок тексту, приблизно 3-4 символи або три чверті слова. Модель і читає, і пише токенами. Платиш і за вхідні (що ти дав), і за вихідні (що вона згенерувала) токени. . Більше тексту - більше токенів. Більше токенів - більше грошей і довше чекати. Ось і вся арифметика.
Навіщо вайбкодеру розуміти вартість ШІ
Ти вайбкодер. Чат спершу здається безкоштовним або майже. А потім прилітає рахунок - і ти сидиш, чухаєш потилицю: звідки стільки? Варто розібратися з токенами, і картина змінюється. Ти:
- перестаєш платити за повітря - довгі відповіді там, де вистачило б двох рядків;
- бачиш, куди витікають гроші, і затикаєш дірки;
- встигаєш зробити втричі більше за ті самі гроші;
- не здригаєшся від рахунку наприкінці місяця, бо сам ним керуєш.
Між «ШІ зжер увесь бюджет за тиждень» і «мені вистачає надовго» - усього три звички: обирати глибину відповіді, стежити за витратами і не кликати дорогу модель на дурницю. Далі по порядку.
Як рахується вартість токенів
Скільки токенів у звичайному тексті
Текст для моделі ріжеться на токени. Запамʼятай одну грубу оцінку - її вистачить на девʼять випадків із десяти:
І ось тут пастка. Ти платиш двічі. За вхід - усе, що дав агенту: питання, файли, історію листування. І за вихід - усю його відповідь. До того ж вихід зазвичай дорожчий за вхід. Тож гігантське полотно тексту у відповідь бʼє по гаманцю сильніше, ніж довге питання. Запамʼятай це - знадобиться.
Скільки коштують різні моделі ШІ
Не всі ШІ коштують однаково. Є економ, є бізнес-клас. Ось реальні ціни за мільйон токенів (дані з матеріалів ECC, 2025-2026):
| Модель | Вхід (за 1 млн токенів) | Вихід (за 1 млн токенів) | У скільки разів дорожче |
|---|---|---|---|
| Haiku 4.5 | 0,80 $ | 4,00 $ | 1x (найдешевша) |
| Sonnet 4.6 | 3,00 $ | 15,00 $ | ~4x |
| Opus 4.5 | 15,00 $ | 75,00 $ | ~19x |
Як платити за ШІ менше: три прийоми
Прийом 1. Обирай глибину відповіді
Найчастіше відповідь на три екрани тобі не потрібна. Потрібна суть. А агент за замовчуванням намагається бути ґрунтовним - і палить токени на вихід.
Хитрість проста: скажи заздалегідь, якої довжини відповідь хочеш. Це і є ідея скіла token-budget-advisor - обрати глибину до того, як агент почав писати. Секунда на старті, економія на фініші.
- Швидка перевірка факту чи «так/ні» - вистачить двох рядків.
- Ти вже в темі, потрібна лише команда чи рішення, без лекції.
- Робиш багато дрібних правок поспіль - кожне полотно тексту множиться на рахунок.
- Розбираєш нову тему з нуля - тут приклади й контекст економлять твій час.
- Просиш план чи архітектуру, де важливі альтернативи.
- Це навчальний розбір, який перечитаєш не раз.
Груба шкала глибини, якою користуються досвідчені вайбкодери:
- Коротко - пряма відповідь, без вступів. 2-4 речення.
- Середньо - відповідь плюс трохи контексту й один приклад.
- Детально - повна відповідь з альтернативами й нюансами.
Далі в цьому чаті відповідай у режимі «коротко»: лише суть, 2-4 речення, без вступів і без води. Якщо задача реально складна і короткої відповіді замало - спершу скажи мені про це одним рядком і спитай, чи потрібна детальна версія. Розгортай детально лише коли я попрошу.
Прийом 2. Стеж за витратами на ШІ
Не можна заощаджувати те, чого не бачиш. Скіл cost-tracking про одне: завести лічильник і регулярно в нього зазирати. Без лічильника ти їдеш із заплющеними очима.
Що корисно бачити:
- скільки пішло сьогодні і скільки було вчора;
- загальна сума за весь час;
- у якому проєкті витікає найбільше;
- який інструмент чи дія найдорожча;
- скільки в середньому коштує одна сесія.
Прийом 3. Підбирай модель під задачу
Це серце скіла cost-aware-llm-pipeline. Ідея в одному: не возити хліб гелікоптером. Просту задачу віддай дешевій моделі, складну - дорогій. Усе.
Грубе правило з матеріалів ECC. Тексту мало, задача рутинна - беремо дешеву модель (Haiku). Тексту багато або задача складна - багато частин, аналіз, архітектура - тоді вже дорогу (Sonnet чи Opus). На простій роботі дешева модель часто виходить у 3-4 рази дешевше - з тим самим результатом. Цифри приємні, погодься.
- Рутину (перейменувати, причесати текст, дрібна правка) - на дешеву модель.
- Складне (архітектура, хитрий баг, великий розбір) - на дорогу, і лише його.
- Довгу незмінну інструкцію кешуєш, щоб не платити за неї щоразу наново.
- Ставиш ліміт бюджету заздалегідь - і гальмуєш до того, як прилетить сюрприз.
- Женеш усе підряд на найдорожчій моделі «щоб уже точно».
- Вивалюєш весь проєкт у кожне повідомлення замість потрібного шматка.
- Повторюєш ту саму довгу вступну в кожному запиті.
- Не ставиш ліміт - дізнаєшся суму, лише коли вже пізно.
Як зливається бюджет: розбір на прикладі
Ти робиш сайт-візитку. Відкрив чат і з порога вставив весь проєкт - 30 файлів, «щоб агент був у курсі». Тепер кожне повідомлення тягне за собою все це полотно. Далі - більше: просиш детальні пояснення на кожен чих, ганяєш найпотужнішу модель, третій день сидиш в одному нескінченному чаті. Наприкінці тижня відкриваєш рахунок - і тихо сумуєш.
Що сталося насправді:
- Ти платив за 30 файлів у кожному повідомленні - а агенту потрібні були один-два.
- Ти замовляв полотна тексту на вихід, хоча вистачило б абзацу.
- Ти тримав дорогу модель на задачах, де впоралася б дешева.
- Ти не дивився в лічильник і проспав момент, коли витрати розігналися.
А тепер як зробив би вайбкодер, який розуміє, за що платить:
Допоможи зібрати сайт-візитку. Правила роботи, щоб не палити зайве:
- Не тримай весь проєкт у контексті. Знадобиться файл - попроси в мене конкретний, а не все підряд.
- Відповідай коротко за замовчуванням: суть і потрібний код. Довгі пояснення - лише якщо я прошу.
- Прості правки роби в економному режимі, дорогу модель пропонуй лише для реально складних задач і питай мене заздалегідь.
- Наприкінці кожного блоку роботи нагадай мені звіритися з витратами за сьогодні.
Часті помилки новачка в роботі з ШІ
- Вивалювати весь проєкт у кожне повідомлення. Платиш за це знову і знову. Давай потрібний шматок.
- Замовляти полотна тексту на вихід. Вихідні токени дорожчі за вхідні. Проси потрібну глибину.
- Ганяти все на найдорожчій моделі. Рутину віддай дешевій - вона в рази економніша.
- Сидіти в одному нескінченному чаті. Історія росте, і ти платиш за неї в кожному запиті. Чисти на межах задач.
- Повторювати ту саму довгу вступну. Кешуй її один раз.
- Не дивитися в лічильник. Без обліку витрати розганяються непомітно - поки не стане боляче.
TL;DR - если коротко
- Токен - шматочок тексту, приблизно 3-4 символи. Платиш і за те, що дав ШІ, і за те, що він відповів.
- Грубо: 1000 токенів ≈ 750 слів ≈ півтори сторінки. Великий файл = десятки тисяч токенів = живі гроші.
- Заздалегідь проси потрібну глибину: коротко, середньо, детально. Навіщо платити за полотно тексту, коли вистачить абзацу?
- Хочеш бачити витрати на ШІ - веди облік: скільки пішло сьогодні, у якому проєкті, на який інструмент.
- Не клич дорогу модель на дурницю. Дешева модель робить рутину в рази дешевше, і часто з тим самим результатом.
- Головний витік бюджету - вивалити весь проєкт у чат і гнати нескінченну розмову без чистки.