Почему это важно
Стоимость запроса, лимит контекстного окна и скорость ответа обычно зависят от количества input и output tokens.
Модель читает не слова, а токены: части слов, числа, пунктуацию, emoji и структурные символы.
Открыть калькуляторСтоимость запроса, лимит контекстного окна и скорость ответа обычно зависят от количества input и output tokens.
Русские и английские слова, код, JSON, Markdown и emoji дробятся по-разному. Поэтому две строки одинаковой длины могут иметь разную цену.
Вставьте текст, выберите провайдера и модель, задайте expected output tokens и проверьте стоимость, контекст и предупреждения.