[ FAQ ]

Частые вопросы о токенах и стоимости LLM

Что такое токен?

Токен — это фрагмент текста, который модель использует для чтения и генерации. Это может быть слово, часть слова, знак препинания или символ.

Чем токены отличаются от слов?

Слова видит человек, а токены видит модель. Одно длинное слово может занять несколько токенов, а пунктуация и код часто добавляют отдельные токены.

Почему разные модели считают токены по-разному?

У провайдеров разные токенизаторы, правила для chat-сообщений, multimodal input, инструментов и кэша. Поэтому сервис показывает статус точности для каждой модели.

Насколько точен расчёт?

OpenAI считается локально tiktoken-совместимым способом, остальные провайдеры получают быструю оценку. Точный подсчёт провайдера требует явного согласия.

Отправляется ли текст на сервер?

По умолчанию нет. Расчёт, история и разбор файлов выполняются в браузере. Текст отправляется провайдеру только при включении точного расчёта.

Какие модели поддерживаются?

Стартовый справочник включает OpenAI, Anthropic Claude, Google Gemini, Gemma, Qwen, Ollama, DeepSeek, Yandex AI Studio / YandexGPT, GigaChat и T-Pro.

Можно ли считать PDF и DOCX?

Да, загрузчик принимает PDF, DOCX, TXT, CSV, JSON, XLSX и PPTX. Для сложных PDF результат может быть оценочным из-за структуры документа.

Почему стоимость может отличаться от биллинга провайдера?

Фактический биллинг может учитывать системные токены, tool calls, multimodal input, cached tokens, региональные модификаторы и batch-режимы.

Как часто обновляются цены?

Справочник моделей хранит дату проверки и источник цены. Изменения цен проходят ручную проверку перед публикацией.

Можно ли считать стоимость cached input?

Да. Для моделей с кэшированием доступны cached input, cache write 5m, cache write 1h, cache read и DeepSeek cache hit ratio.

Можно ли сравнить несколько моделей?

Да. Режим сравнения показывает стоимость, контекст, точность, fit-score и самую дешёвую подходящую модель.