Расход токенов — за всё время

Claude Code · OpenAI Codex · Google Antigravity. Собрано из локальных логов 2026-07-27. Класс доказательности указан у каждой цифры.

Масштаб: три инструмента рядом

Только измеримые токены. Antigravity отсутствует на этой шкале намеренно — у него нет счётчика, и пририсовать ему столбик значило бы выдумать данные.

Итог по Codex складывается из четырёх слагаемых с разным классом доказательности, и смешивать их в одну «точную» цифру нельзя. Консервативно 119.06 млрд, верхняя граница 152.40 млрд — разница целиком в том, какой метод верен для данных второго компьютера (см. панель «Три метода подсчёта»). Против Claude Code это в 27–35 раз больше по объёму; с поправкой на длину периода — примерно 7–9× в сутки.

Claude Code во времени ИЗМЕРЕНО

Стек по типу токена. Переключатель меняет разрешение — от суток до минуты.

Кэш-чтение — всего объёма. Именно поэтому «сколько токенов» и «сколько денег» — очень разные вопросы: чтение кэша стоит в 10 раз дешевле свежего ввода.
Один день — 27 июля: 3 042 436 363 токена, это 70.3% всего расхода за 20 дней. Это сессия самого этого аудита. Механика та же, что и на Codex: в длинной сессии весь контекст пересылается заново на каждом ходу, и кэш-чтение растёт нелинейно. Столбик не выброс в данных — так выглядит один день глубокой работы против девятнадцати обычных.

Последние сутки против предыдущих ИЗМЕРЕНО

Накопительные итоги на конец каждой из двух дат и прирост между ними.

Активность по часам суток

Один оттенок, светлее → темнее. Сумма за все 20 дней.

По дням недели

Тот же период.

Claude Code по моделям ИЗМЕРЕНО

Локальный прокси на 127.0.0.1:8318 переписывал модель в запросе, поэтому это метка после прокси, а не то, что выбирал пользователь.

Cline / Roo-Code ИЗМЕРЕНО

97 задач, 4 430 API запросов. Локальный прокси grok-proxy v3.0 перенаправляет трафик с умной балансировкой ключей (Grok 4.5, Kimi, GLM).

Разбивка по моделям в Cline

Крупнейшие задачи Cline по объёму токенов

Перфокарта: день × час ИЗМЕРЕНО

Площадь точки пропорциональна объёму за этот час. Видно суточный ритм и то, какие ночи были рабочими.

Все сессии на временной оси ИЗМЕРЕНО

Каждая полоса — сессия: длина по реальному времени, толщина пропорциональна объёму, цвет — доминирующая модель. Сессии уложены в дорожки, поэтому видно параллельную работу.

Дорожки — это не потоки, а укладка для читаемости: если полосы лежат на разных дорожках в одно время, значит сессии шли одновременно.

Режимы стоимости: кэш против объёма ИЗМЕРЕНО

Каждый пузырь — сутки. По горизонтали объём, по вертикали доля кэша, площадь — стоимость по прайсу. Чем выше и правее, тем эффективнее день.

Пузыри в левом низу — дорогой режим: мало токенов, плохой кэш, но заметная стоимость. Пузыри справа сверху — дешёвый: много токенов при почти полном попадании в кэш.

Рост контекста внутри сессии

Линия — медиана, заливка — до p90. По номеру вызова в сессии.

Доля субагентов по дням

Процент объёма, пришедшийся на субагентов.

Размеры сессий, порядки величины

Сколько сессий попало в каждый десятичный порядок.

Размеры ответов модели

Распределение вывода на один ответ, в токенах.

Мозаика: день × модель ИЗМЕРЕНО

Ширина колонки пропорциональна объёму дня, высота сегмента — доле модели в этом дне. Две величины сразу: сколько и чем.

Codex во времени ИЗМЕРЕНО СВЕРЕНО

1050 файлов роллаутов, 10.1 ГБ, 1030 сессий. Накопительный счётчик total_token_usage монотонен, поэтому разница соседних значений даёт честный минутный ряд.

Это только выживший бэкап-корень и только апрель–май. Индекс сессий знает 2705 сессий, роллаутов на диске осталось 1030 — 1796 сессий удалены. Остальное покрытие пришло из двух других источников: отчёта от 2026-06-06 по корню danat (файлы с тех пор тоже удалены, осталось 786 из 1891) и нового измерения второго компьютера за 4–13 июня.

Codex: три корня ПО ОТЧЁТУ

Дедуплицированные итоги по каждому корню на 2026-06-06.

Codex по моделям ПО ОТЧЁТУ

Метод приростов, дедуплицированный.

Второй компьютер, профиль danat ИЗМЕРЕНО МЕТОД СПОРНЫЙ

Из 1891 файла, который видел старый отчёт по этому же корню, осталось . Уцелевшее покрывает 4–13 июня, то есть почти целиком тот период, который не измерялся никогда: прежний отчёт оборван 6 июня.
Период 4–6 июня есть и в старом отчёте, и в этом измерении. Поэтому в общий итог добавляется только часть records_after_2026_06_06 — иначе 18.5 млрд были бы посчитаны дважды.

Три метода подсчёта — контрольный опыт на моих сырых файлах

Один и тот же набор 1050 файлов, посчитанный тремя способами. Расхождение в пределах 0.04% — значит на чистых данных методы эквивалентны, и спор о методе решается не мнением, а измерением.

Почему методы вообще могут расходиться: в одном файле роллаута иногда идут две накопительные цепочки сразу — параллельные потоки пишут в один файл, а признака потока в записи нет. Реальный фрагмент: 3 065 004 → 1 326 125 → 3 225 875 → 1 480 311 → 3 396 892 → 1 635 308. Метод максимума теряет вторую цепочку, метод приростов на каждом чередовании фабрикует ложный инкремент. Метод chain-split разносит события по цепочкам и суммирует их финалы.
На данных второго компьютера расхождение методов — 4.19× (62.29 против 14.88 млрд). Это не объясняется чередованием: при сопоставимом числе сбросов (163 против моих 164) там на один сброс приходится 290 887 601 токена против моих 135 642 — разница в 2145 раз, при среднем размере сессии 19.4 млн. Плюс заявленные tokens_dropped_by_dedupe = 165 124 336 663 при всего 3 дублирующихся сессиях внутренне невозможны. Поэтому в итог взята консервативная цифра по максимумам, а для точного ответа нужен пересчёт методом chain-split.

Ловушка двойного счёта — почему 138.9 млрд неверны

Старый леджер вынес в заголовок 138.9 млрд. Это сумма «финалов по сессиям» по трём корням, а одни и те же сессии лежат и в живом каталоге, и в бэкапе.

Antigravity ПРОКСИ, НЕ ТОКЕНЫ

Типы шагов

Упоры в квоту (429) по дням

Токены Antigravity не восстановимы локально. Прокси-метрика систематически занижает расход: транскрипт хранит каждое сообщение один раз, а API получает весь контекст заново на каждом ходу. На Codex, где счётчики есть, кэшированный ввод составил 96.15% — то есть основная масса расхода как раз в той части, которой в транскрипте нет.

Четыре периода доступа — и кэш как множитель цены ИЗМЕРЕНО

Доступ к Claude менялся несколько раз. Границы периодов видны в данных по эффективности кэша, набору моделей и версии CLI. Ниже — доля контекста, взятая из кэша, по дням.

8–13 июля кэш стабильно 91–95% и в наборе есть gpt-5.5 — мультимодельный роутер. 14–25 июля кэш обваливается до 2.6–23%. 26 июля впервые появляются opus-5, fable-5, sonnet-5 и вторая версия CLI 2.1.219. 27 июля кэш 99.9% — это proxy.js с UPSTREAM = api.anthropic.com.
Период 14–25 июля дал 7.5% объёма, но 25% денег. Период 27 июля75% объёма и 53% денег. Вдесятеро больший объём стоил вдвое дороже, а не в десять раз — вся разница в кэше. Переплата из-за неработающего кэширования $1 682, это 34% всей суммы. Эффективность кэша важнее объёма.
До 8 июля транскриптов нет вовсе, хотя firstStartTime — 2026-06-05. Около месяца работы не залогировано и не измеримо.

Claude Code: разбор по моделям ИЗМЕРЕНО

Главное в этой таблице — колонка «кэш-попадание». У opus-5 медиана свежего ввода 2 токена, у opus-4-83 579. Отсюда: opus-4-8 дал втрое меньше токенов, но свежий ввод стоил $1 426,91 против $9,81 — в 145 раз дороже, и итог почти сравнялся. Причина — 111 коротких сессий против 26 длинных: короткая не успевает нагреть кэш.

Рост контекста внутри сессии

Средний контекст на вызов в зависимости от номера вызова. Это и есть механизм расхода: платят не за то, что модель пишет, а за пересылку истории.

Концентрация расхода

Доля всего объёма, приходящаяся на N крупнейших сессий из 148.

На что ушли токены ИЗМЕРЕНО

Поимённо, по названиям сессий из записей ai-title. Токены дедуплицированы. Снимок на момент прогона анализатора — сессия аудита ещё дописывалась.

По Codex — 2705 тредов, и слово audit в 1142 названиях, то есть в 42% всех тредов. Плюс смежные: inspect 67, gaps 65, locate 45, scan 38. Это крупнейшая опознаваемая статья расхода — и она по определению перечитывает уже прочитанное. Codex почти целиком ушёл в HECTON-8: c:\hades 90.47 млрд, c:\hades\Hecton8 17.74 млрд.
Характер названий — «непрерывное улучшение», «автономная разработка», «автономный рефакторинг», «продолжить operation immune system». Это не диалоги, а длительные самоуправляемые прогоны, что согласуется с профилем расхода: половина ответов приходится на вызовы после 225-го в сессии.

Antigravity: что Google опубликовал сам ВНЕШНИЕ ДАННЫЕ

Единственная официальная метрика — недельные активные пользователи. Токенов Google не публикует намеренно: квота считается в «выполненной работе» (compute effort), а не в токенах.

Вердикт «счётчика нет» подтверждён независимо: на форуме Google AI Developers разработчик сообщил, что не может получить input / cached / output токены для чатов через Hooks — данных нет в transcript.jsonl. То есть счётчика нет by design, а не потерян на этой машине.
История квот объясняет 6 134 упора: 250 запросов в день на запуске в ноябре 2025 → 20 в день к декабрю (−92%) → в марте 2026 Pro переведён с 5-часового обновления на недельное с блокировками до 168 часов. Google дважды утроил лимиты после бэклэша. Ротация 19 аккаунтов была реакцией на это.

На фоне индустрии ВНЕШНИЕ ДАННЫЕ

Публичные объёмы — самоотчёты вендоров, не аудированные. Сравнение показывает порядок величины, а не точность.

Деньги — эквивалент по прайсу, не счёт

Тарифы Anthropic сверены с живой документацией 2026-07-27; тарифы OpenAI взяты из каталога того же отчёта (источник developers.openai.com, проверен 2026-06-06).

2792 из 2804 сессий Codex шли с plan_type: "free", ещё 10 — "team". Это подписка, а значит эти доллары почти наверняка никогда не выставлялись счётом. Цифра отвечает на вопрос «сколько бы стоил такой объём по публичному прайсу», а не «сколько заплачено».
По Claude Code сумма — нижняя граница. Прокси Desktop\proxy.js бесконечно повторял запросы при 429/5xx каждые 2 с; эти повторы жгли токены вверху, но в транскрипт не попали.

Откуда взялся доступ: планы, аккаунты, ключи ИЗМЕРЕНО

Ответ на вопрос «как такой объём был возможен»: за токены почти никогда не платили по счётчику. Только то, что зафиксировано в локальных файлах.

Фактические траты за всё время — около 1000 рублей (со слов владельца), целиком на аккаунты и подписки для 19 Google-аккаунтов. По Codex и Claude Code — ноль. Против этого стоит $92 132 эквивалента по публичному прайсу. И отсюда инверсия: единственный провайдер, которому заплатили, — единственный, который расход не показывает. Два, которым не заплатили ничего, ведут учёт до токена. Он же самый хрупкий: 2 аккаунта из 19 уже expired, 6 134 упора в квоту.
Почему бесплатный тариф Codex выдержал 119 млрд: с 29 апреля недельное окно лимита стало перезапускаться практически на каждом запросе — до 10 403 разных границ окна за одни сутки 17 мая при неизменном лаге 6.99 суток, из-за чего used_percent залип на floor-значении 3.0% на полмиллиона событий. До 29 апреля лимит был настоящим: 100% выбивались в 20 днях из 26. Конец резкий — 9 июня обвал в 94 раза, последнее событие 13 июня. Причину по локальным файлам установить нельзя. Число аккаунтов по Codex — не наблюдаемая величина: в формате роллаута поля аккаунта нет вообще.
В proxy.js один ключ, а не пул, несмотря на комментарий «ENTERPRISE KEY POOL». Ротации в коде нет — есть 13 повторов и 4 обработки кода 429. Именно эти повторы жгут токены, которые в транскрипт не попадают, поэтому измеренное по Claude Code — нижняя граница.
Комплаенс-риск зафиксирован в данных, а не предполагается: 19 Google-аккаунтов, сортировка по остатку квоты (account_sort: quota-overall), балансировка нагрузки и device_profile_json + device_history_json на каждом аккаунте. Это ротация аккаунтов с управлением отпечатком устройства. Схема нарушает условия провайдеров и приводит к блокировкам — 2 аккаунта уже в статусе expired, и зафиксировано 6 134 упора в квоту.
Граница охвата. Всё измеренное — расход с машин владельца. Со слов владельца, в середине мая конфигурационный файл с токенами входа был роздан десяти людям, и суммарно они израсходовали «примерно столько же, может чуть больше». Их расход шёл через те же учётные данные, но с их дисков, и в локальных данных отсутствует физически. Оценка суммарного расхода через эти учётки — ~250–275 млрд токенов, но это слова владельца, а не измерение. Хронология важна: заморозка счётчика 29 апреля, раздача — середина мая, то есть раздача не была её причиной. Зато она правдоподобно объясняет, почему «чудо» закончилось 9 июня: одиннадцать человек под одними credentials заметнее одного.
Все суммы в долларах в этом отчёте — эквивалент по публичному прайсу, а не траты. Происхождение ключа Anthropic неизвестно: три из четырёх периодов доступа шли через посредников, поэтому перед ротацией стоит установить, чей он.

Что осталось неизмеренным