[ стоимость ]

Как считается стоимость LLM-запросов

Базовая формула: tokens / 1 000 000 * pricePerMillion * requestCount. Для кэша, tiered pricing и batch-режимов добавляются модификаторы.

Открыть калькулятор

Input и output

Input tokens оплачивают текст, который вы отправляете в модель. Output tokens оплачивают ответ модели. Обычно output дороже input.

Cached input

Если провайдер поддерживает кэш, часть input может тарифицироваться дешевле или через отдельные cache write/cache read ставки.

Почему billing может отличаться

Фактический счёт провайдера может включать системные токены, tool calls, multimodal input, региональные коэффициенты и округления.