Частые вопросы о токенах и стоимости LLM
Что такое токен?
Токен — это фрагмент текста, который модель использует для чтения и генерации. Это может быть слово, часть слова, знак препинания или символ.
Чем токены отличаются от слов?
Слова видит человек, а токены видит модель. Одно длинное слово может занять несколько токенов, а пунктуация и код часто добавляют отдельные токены.
Почему разные модели считают токены по-разному?
У провайдеров разные токенизаторы, правила для chat-сообщений, multimodal input, инструментов и кэша. Поэтому сервис показывает статус точности для каждой модели.
Насколько точен расчёт?
OpenAI считается локально tiktoken-совместимым способом, остальные провайдеры получают быструю оценку. Точный подсчёт провайдера требует явного согласия.
Отправляется ли текст на сервер?
По умолчанию нет. Расчёт, история и разбор файлов выполняются в браузере. Текст отправляется провайдеру только при включении точного расчёта.
Какие модели поддерживаются?
Стартовый справочник включает OpenAI, Anthropic Claude, Google Gemini, Gemma, Qwen, Ollama, DeepSeek, Yandex AI Studio / YandexGPT, GigaChat и T-Pro.
Можно ли считать PDF и DOCX?
Да, загрузчик принимает PDF, DOCX, TXT, CSV, JSON, XLSX и PPTX. Для сложных PDF результат может быть оценочным из-за структуры документа.
Почему стоимость может отличаться от биллинга провайдера?
Фактический биллинг может учитывать системные токены, tool calls, multimodal input, cached tokens, региональные модификаторы и batch-режимы.
Как часто обновляются цены?
Справочник моделей хранит дату проверки и источник цены. Изменения цен проходят ручную проверку перед публикацией.
Можно ли считать стоимость cached input?
Да. Для моделей с кэшированием доступны cached input, cache write 5m, cache write 1h, cache read и DeepSeek cache hit ratio.
Можно ли сравнить несколько моделей?
Да. Режим сравнения показывает стоимость, контекст, точность, fit-score и самую дешёвую подходящую модель.