Токенометр

Считает расход токенов и денег за сессию, день и месяц для моделей Claude, OpenAI, Gemini и открытых моделей и ставит рядом три независимых рейтинга качества. Каждый запрос к API пересылает всю накопленную историю, поэтому длинная сессия дорожает быстрее, чем растёт число запросов. Вставьте свой usage, и поля заполнятся сами.

Настройки расчёта
Сценарий

Посчитать по моему usage

Понимает usage Anthropic, OpenAI и Gemini. Из записей выводятся размер префикса, новый вход за запрос, ответ, число запросов и доля попаданий в кеш.

Токены за один запрос

Оценка размышления по уровню усилия, точных цен у уровней нет:

Объём
Кеш промптов
90 %

Наценка за запись в кеш есть только у Anthropic: 1,25 на 5 минут и 2 на час. OpenAI, Gemini и OpenRouter пишут по цене входа. Множители правятся в прайсе.

Режимы
Модели для сравнения

Цены редактируются во вкладке «Прайс», там же добавляются свои модели.

Стоимость каждого запроса в сессии

За месяц по моделям

Разбор по моделям

Токены за одну сессию, деньги за сессию, за решённую задачу, за день и за месяц

Цена против качества

Стоимость за месяц по горизонтали (логарифм), индекс Epoch по вертикали

Три независимых рейтинга. Arena: текстовая арена arena.ai, оценка Elo по 8,1 млн голосов людей, снимок 2026-09-13. Artificial Analysis: Intelligence Index, сводный балл по десяти тестам, сентябрь 2026. Epoch: Epoch Capabilities Index, единая шкала по 86 тестам, выгрузка 2026-09-25. Прочерк: модель в рейтинге не найдена. Для моделей с уровнями усилия взят лучший вариант.

Рейтинги отмеченных моделей

Сортировка по индексу Epoch; выбор моделей в настройках слева

Прайс

Долларов за 1 млн токенов. Fast и Батч это множители, пусто значит «недоступно». Ваши правки хранятся в этом браузере и имеют приоритет над общей базой.

Как считается и откуда цены

Сессия моделируется запрос за запросом. На запросе i префикс состоит из системного промпта, описаний инструментов и всей истории предыдущих запросов (входы плюс ответы модели). Блоки размышления в историю не попадают, но оплачиваются как выходные токены в момент генерации.

префиксi = система + инструменты + Σj<i(входj + ответj)
контекстi = префиксi + входi

без кеша:  вход = контекстi × цена входа
с кешем:   чтение = префиксi × доля попаданий × цена чтения
          запись = (префиксi × (1 − доля) + входi) × цена входа × множитель записи
выход = (ответi + размышление) × цена выхода

батч: всё × множитель батча модели · ускоренный режим: всё × множитель fast модели
надбавка за длинный контекст: только у моделей с отметкой, на запросах, где контекстi > 200 000
за решённую задачу = за сессию ÷ (1 − доля неудач)

Как разбирается usage

Из каждой записи берутся вход без кеша, запись в кеш, чтение кеша, выход и размышление (Anthropic: input_tokens, cache_creation_input_tokens, cache_read_input_tokens, output_tokens; OpenAI: prompt_tokens, cached_tokens, completion_tokens, reasoning_tokens; Gemini: promptTokenCount, cachedContentTokenCount, candidatesTokenCount, thoughtsTokenCount). Контекст записи это сумма трёх входных частей. Записи группируются по сессии: число записей даёт число запросов, рост контекста от первой записи к последней за вычетом среднего ответа даёт новый вход за запрос, остаток первого контекста уходит в системный промпт (инструменты от него не отделить). Доля попаданий считается по префиксу: новый вход каждого запроса из знаменателя убирается, потому что он всегда пишется в кеш.

Откуда цены

  • Anthropic: прайс Claude API из справочника от 2026-06-24. Чтение кеша у Claude Fable 5.1 стоит 0,025 от входа, у остальных 0,1. Fast mode в 2 раза только у Opus 5, Opus 5.5 и Opus 4.8.
  • OpenAI: страница цен API, снято 2026-09-25. Кеш автоматический, запись бесплатна. Столбец «Fast» это цена priority processing относительно стандартной. У моделей Pro кеша нет, цена чтения равна цене входа. Для GPT-5.5 и GPT-5.4 указана цена для контекста до 272 тыс., надбавка выше не учтена.
  • Google Gemini: прайс Gemini API, снято 2026-09-25, платный тариф. Цены Gemini 3.x действуют до 2026-12-31 и удваиваются с 2027-01-01. Хранение кеша по часам не учтено.
  • Открытые модели: цены агрегатора OpenRouter на 2026-09-25; у конкретного провайдера или на своём сервере они другие. Тройки выбраны по обзорам за сентябрь 2026 (Thunder Compute, Dreaming Press, Morph).
  • Общая база: прайс раз в неделю обновляется из API OpenRouter и сохраняется в базе этой страницы, дата показана во вкладке «Прайс». Правки в вашем браузере имеют приоритет.

Откуда рейтинги

  • Arena: текстовый лидерборд arena.ai, снимок 2026-09-13, 402 модели, 8,1 млн голосов. Elo с погрешностью 3–12 пунктов; у моделей с уровнями усилия взят лучший вариант.
  • Artificial Analysis: Intelligence Index, сентябрь 2026; часть значений сверена по агрегатору modelgrep.com, который публикует тот же индекс.
  • Epoch: Epoch Capabilities Index, файл eci_scores.csv, выгружен 2026-09-25; для семейств с несколькими снимками взята самая свежая версия.

Оговорки

  1. Минимальный кешируемый префикс у Anthropic 512–4096 токенов, у OpenAI 1024. Если система с инструментами короче, реальный кеш не сработает.
  2. «Чтение кеша на 1 выходной токен» это метрика из замера 2026-08-04 по 1406 файлам сессий Claude Code: у Opus было 283 при доле чтения кеша 86 % в общем расходе. Цель ниже 150.
  3. Рейтинги измеряют разное: Arena это предпочтения людей в чате, Artificial Analysis и Epoch это тесты. Для агентной работы с инструментами смотрите на цену за решённую задачу, а не только на балл.
  4. Стоимость подписок расчёт не описывает, только эквивалент по API. Bedrock, Vertex AI и Azure тарифицируются отдельно.

Все поля редактируются, результат пересчитывается сразу. Готовые сценарии дают отправную точку, а не норму.