Калькулятор токенов LLM: подсчет BPE-токенов и стоимости API (GPT-4o, Claude, Llama)
Калькулятор токенов и стоимости API больших языковых моделей (LLM) — инструмент для AI-инженеров, промпт-инженеров и разработчиков, работающих с API OpenAI (GPT-4o, o1), Anthropic (Claude 3.5 Sonnet), Google (Gemini) и открытыми моделями Llama 3.
Инструмент выполняет токенизацию текста по алгоритмам Byte-Pair Encoding (BPE / tiktoken), рассчитывает точное количество входных и выходных токенов, предупреждает о приближении к лимитам контекстного окна и вычисляет стоимость генерации в рублях и долларах. Токенизация выполняется на 100% приватно в браузере.
Архитектура и математическая формула
Токенизация BPE: Текст -> Байтовые пары (Byte-Pair Encoding) -> Массив числовых ID токенов
Стоимость запроса = (Prompt Tokens × Цена входного токена) + (Completion Tokens × Цена выходного токена).
Лучшие практики и ключевые рекомендации
- Учитывайте повышенный расход токенов на кириллические тексты: Исторически токенизаторы оптимизированы под английский язык. В русском тексте одно слово часто дробится на 2-4 токена, что увеличивает стоимость API-запросов на 100-200% по сравнению с английским.
- Оптимизируйте системный промпт (System Prompt) для экономии бюджета: Системный промпт передается на каждом шаге чата повторно. Сокращение вводных инструкций на 300 токенов экономит тысячи долларов на миллионах запросов пользователей.
- Используйте кэширование контекста (Prompt Caching): Современные провайдеры (Anthropic, OpenAI) предлагают скидку до 75-90% на повторные входные токены при использовании кэширования статического контекста.
- Контролируйте лимиты контекстного окна (Context Window): Превышение лимита контекста приводит к ошибке `context_length_exceeded` или забыванию моделью ранних инструкций из-за принудительной обрезки истории.