← блог
Як виміряти реальну вартість ШІ-інструментів для коду

Як виміряти реальну вартість ШІ-інструментів для коду

Практичний спосіб перетворити логи Claude Code і Codex на звіт за 30 днів, зрозуміти API-еквівалентну вартість і знайти дорогі звички.

автор Данило— переглядів

Кількість токенів виглядає об’єктивно, тому її легко зрозуміти неправильно. Графік може показувати мільйони токенів і вражаючу суму, але не відповідати на головне: скільки реально сплачено, яку роботу завершено і які звички створили марні витрати.

Практичний підхід — сприймати токени як сигнал навантаження, а не як рахунок. Локальні логи агентів добре показують тренди, але оцінка вартості завжди потребує контексту.

Почніть із логів, які вже існують

ccusage — опенсорсний CLI, який читає локальні дані coding-agent інструментів і групує їх за днями, місяцями або сесіями. З його JSON-команд легко зібрати звіт за 30 днів:

npx -y ccusage@latest claude daily --json
npx -y ccusage@latest codex daily --json

Невеликий scheduled-скрипт може об’єднати два файли за датою, заповнити пропущені дні нулями й залишити останні 30. Публічному звіту не потрібні промпти чи вихідний код — достатньо вузького запису:

{
  "date": "2026-07-21",
  "claude": { "tokens": 420000, "cost": 1.84 },
  "codex": { "tokens": 180000, "cost": 0.71 }
}

Це вигадані демонстраційні дані. Вони показують форму звіту, а не типове використання чи актуальні ціни.

API-еквівалент — не списання з картки

Одна загальна цифра може поєднувати свіжий input, читання кешу, output моделі й reasoning-токени. У цих категорій різні тарифи. Підписка працює інакше: використання може зменшувати спільний ліміт без окремого рахунку за кожен токен.

Тому чесніша назва локальної оцінки — «API-еквівалентна вартість». Вона відповідає на питання «скільки це могло б коштувати за зіставленими API-тарифами?», але не на «скільки грошей списали?»

Є ще одне обмеження. Формати логів, ідентифікатори моделей і мапи цін змінюються. Парсер використовує лише отримані поля та ціну, яку зміг знайти. Невідома модель чи відсутні дані кешу роблять старий день неповним. Два знаки після коми не прибирають цієї невизначеності.

Як правильно читати вигаданий звіт

Припустімо, розробник бачить таку картину за три дні:

День Усього токенів Частка кешу API-еквівалент
Понеділок 3,2 млн 78% $8,40
Вівторок 3,0 млн 81% $7,90
Середа 9,8 млн 22% $41,60

Корисне питання — не «як зробити середу меншою?». Спочатку треба з’ясувати, що відбулося. Якщо в середу агент успішно завершив міграцію на 200 файлів, стрибок міг бути вигідним. Якщо дві години повторював той самий хибний підхід — бракувало умови зупинки.

Частка кешу — підказка, а не оцінка. Низьке значення може означати, що повторно використовуваний контекст постійно змінювався, але для коротких непов’язаних задач це нормально.

Підписка й API відповідають на різні питання

Підписка робить місячну межу зрозумілішою для інтерактивної роботи. API дає чіткіший облік кожного запиту в автоматизації. Актуальна документація Anthropic розділяє режими прямо: вхід через план використовує включений ліміт, а API-ключ означає оплату за використання; /cost показує витрати API-сесії. Моделі й ліміти змінюються, тому краще перевіряти поточні правила Claude Code, а не копіювати стару таблицю цін.

З цієї ж причини довговічна стаття не повинна назавжди оголошувати одну модель «дешевою». Корисніше пояснити спосіб порівняння й дати посилання на джерело правди.

Сигнали, за якими варто стежити

Корисний графік показує зміни в поведінці:

Не варто оптимізуватися до найменшої кількості токенів. Точний бриф на 500 слів може запобігти повній переробці й бути дешевшим за одне нечітке речення.

Як зменшити марні витрати без втрати якості

Починайте нову сесію, коли змінюється робота. Просіть план перед широкими правками. Давайте агенту точну перевірку та умову зупинки. Складну задачу можна спланувати сильнішою моделлю, а механічне виконання — віддати швидшій і дешевшій, якщо інструмент це підтримує.

Переглядайте статистику щотижня, а не після кожного промпту. Тренд дає дію; одна велика сесія — не завжди. Спочатку пов’яжіть стрибок із завершеною роботою, а потім вирішуйте, чи був він марним.

Той самий принцип працює для всього процесу: результат і докази визначаються до виконання. Це детальніше розібрано в статті про практичний процес роботи з ШІ-агентами.

Що чесний графік має сказати прямо

Хороший звіт називає джерело, час генерації, часовий пояс, включені інструменти й значення слова «вартість». Він розрізняє реальні списання, API-еквівалентну оцінку та використання підписки. Якщо ціни моделі немає, треба показати прогалину, а не мовчки підставити нуль.

Відстеження токенів корисне тоді, коли замінює нечітке відчуття кращим питанням. Мета не в тому, щоб милуватися великим числом. Мета — зрозуміти, яка робота була цінною, який цикл виявився марним і що змінити наступного разу.