Как тарифицируются модели
Механика биллинга для моделей LLM, изображений, видео и аудио — токеновые цены, оплата за генерацию и оценка стоимости
Эта страница объясняет, как тарифицируется каждый тип моделей и в какой именно момент списываются средства с баланса. Актуальные тарифы см. на странице цен или на странице деталей каждой модели. Пошаговые расчёты для типичных моделей см. в разделе Примеры биллинга.
LLM-модели (по токенам)
LLM-модели тарифицируются за миллион токенов, с отдельными тарифами для входных (промпт) и выходных (completion) токенов:
Дополнительные правила ценообразования, применимые к некоторым моделям:
- Кэшированные входные токены — модели с поддержкой кэширования промптов тарифицируют повторяющиеся (кэшированные) входные токены по сниженному тарифу кэша, что может существенно снизить затраты при длинных системных промптах и многоходовых диалогах.
- Мультимодальный ввод — токены входных изображений или аудио могут иметь собственные тарифы.
- Уровни длинного контекста — некоторые модели применяют повышенные тарифы, когда вход превышает пороговый размер (например, свыше 32K входных токенов). Уровни указаны на странице деталей модели.
- Оплата за запрос — небольшое число моделей взимает фиксированную цену за запрос вместо оплаты за токены.
Как происходит списание для LLM:
- Средства списываются после завершения запроса, на основе фактического использования токенов, указанного в поле
usageответа. Потоковые и непотоковые запросы тарифицируются одинаково. - Запросы, завершившиеся ошибкой провайдера, не тарифицируются.
- Списания проводятся асинхронно и появляются в истории использования вскоре после запроса.
Модели изображений (за генерацию)
Генерация изображений тарифицируется за сгенерированное изображение. Цена за единицу зависит от модели, а также может зависеть от разрешения и других параметров запроса. Запрос нескольких изображений соответственно умножает цену.
- Полная сумма резервируется на балансе при отправке задачи и списывается при её успешном завершении. Если задача завершилась ошибкой, зарезервированная сумма автоматически возвращается — см. Возвраты и неудачные задачи.
- Для батч-эндпоинтов: если модель вернула меньше изображений, чем запрошено, вы платите только за фактически полученные изображения.
- Некоторые модели изображений (например, семейство GPT Image) тарифицируются по токенам, как LLM, — тарифы на входные и выходные токены изображений указаны на странице модели.
Инструменты изображений (масштабирование, удаление фона, замена лица и т.д.) тарифицируются так же, за операцию.
Видеомодели (за генерацию)
Большинство видеомоделей тарифицируются по посекундному тарифу, зависящему от разрешения результата:
Некоторые модели добавляют небольшие дополнительные платежи за дополнительные входные данные, например референсные изображения. Посекундные тарифы для каждого уровня разрешения указаны на странице деталей модели. Как и для задач изображений, сумма резервируется при отправке, списывается при успехе и автоматически возвращается, если задача завершилась ошибкой.
Видеомодели с токеновой тарификацией
Некоторые новые видеомодели (например, семейство Seedance 2.x) тарифицируются по объёму фактически сгенерированного видео, измеряемому в выходных видео-токенах:
- Токеновый тариф — цена модели за миллион видео-токенов. Модели, принимающие референсное видео на входе, могут применять сниженный тариф к запросам, содержащим такое видео.
- Множитель разрешения масштабирует стоимость для более высоких уровней результата (например, 2K, 4K или варианты со сверхразрешением) относительно базового уровня.
- Поскольку итоговая стоимость зависит от сгенерированного результата, точная сумма вычисляется по завершении задачи. При отправке на балансе создаётся небольшая временная блокировка, которая снимается сразу после тарификации задачи.
- Неудачные задачи не тарифицируются.
Аудиомодели (за генерацию)
Генерация аудио тарифицируется за генерацию. Единица тарификации зависит от модели (например, длительность результата или количество символов) и указана на странице деталей модели.
Оценка стоимости до генерации
Используйте эндпоинт calculate, чтобы узнать точную цену запроса на изображение, видео или аудио до его отправки. Он принимает то же тело запроса, что и соответствующий эндпоинт генерации, при этом не создаёт задачу и не списывает средства:
curl -X POST "https://api.atlascloud.ai/api/v1/model/calculate" \
-H "Authorization: Bearer your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "bytedance/seedance-2.0/text-to-video",
"prompt": "A hummingbird hovering over a flower, macro shot",
"resolution": "1080p",
"duration": 5
}'Объект data в ответе содержит:
| Поле | Описание |
|---|---|
price | Сумма, которая будет списана, с учётом скидки вашего аккаунта |
origin_price | Прайс-цена до скидки |
discount | Процент от прайс-цены, который вы платите (100 = без скидки, 70 = скидка 30%) |
estimated | Присутствует и равно true для моделей с токеновой тарификацией — цена является оценкой на основе запрошенного разрешения и длительности |
estimated_tokens | Для моделей с токеновой тарификацией — оценка количества выходных видео-токенов |
Модели с токеновой тарификацией возвращают оценку
Для видеомоделей с токеновой тарификацией /calculate возвращает оценку, рассчитанную из запрошенного разрешения, длительности и (для запросов reference-to-video) длительности ваших входных видео. Итоговая сумма вычисляется по фактически сгенерированному результату и может немного отличаться.
Скидки
Согласованные скидки аккаунта и акции по моделям применяются автоматически — вам не нужно передавать купон при запросе. Эндпоинт /calculate всегда возвращает вашу фактическую цену. По вопросам объёмных цен обращайтесь на [email protected].
Last updated on
Обзор биллинга
Как работают цены и оплата в Atlas Cloud — оплата по мере использования для всех API моделей
Примеры биллинга
Разобранные примеры расчёта цен для типичных моделей LLM, видео, изображений и аудио — токеновая тарификация LLM, видео с токеновой тарификацией, посекундное видео, оплата за изображение, изображения с токеновой тарификацией и аудио с тарификацией по символам