Обязательства по ёмкости Priority Tier больше не доступны для покупки. Организации с существующим обязательством могут продолжать использовать Priority Tier до даты окончания их контракта, и эта страница остаётся доступной для них в качестве справочного материала. Если вам нужна гарантированная ёмкость, свяжитесь с отделом продаж.
Anthropic предлагает три уровня обслуживания:
Уровень standard является уровнем обслуживания по умолчанию для всех запросов API. API приоритизирует эти запросы наряду со всеми другими запросами с доступностью по мере возможности.
API приоритизирует запросы этого уровня над всеми другими запросами. Такая приоритизация помогает минимизировать ошибки «server overloaded» даже в пиковые периоды.
Для получения дополнительной информации см. Существующие обязательства Priority Tier.
При обработке запроса Anthropic решает назначить запрос на Priority Tier в следующих сценариях:
Anthropic учитывает использование в счёт ёмкости Priority Tier следующим образом:
Входные токены
inference_geo: "us") на моделях Claude 4.6 и более поздних входные токены считаются как 1,1 токена за токенВыходные токены
inference_geo: "us") на моделях Claude 4.6 и более поздних выходные токены считаются как 1,1 токена за токенВ противном случае запросы выполняются на уровне standard.
Эти коэффициенты списания отражают относительную стоимость каждого типа токенов. Например, инференс только в США оценивается с коэффициентом 1,1x на моделях Claude 4.6 и более поздних, поэтому каждый токен, потреблённый с inference_geo: "us", списывает 1,1 токена из вашей ёмкости Priority Tier.
Запросы, назначенные на Priority Tier, расходуют как ёмкость Priority Tier, так и обычные ограничения скорости. Если обслуживание запроса превысит ограничения скорости, запрос будет отклонён.
Вы можете контролировать, какие уровни обслуживания могут использоваться для запроса, установив параметр service_tier:
client = anthropic.Anthropic()
message = client.messages.create(
model="claude-opus-4-8",
max_tokens=1024,
messages=[{"role": "user", "content": "Hello, Claude!"}],
service_tier="auto", # Automatically use Priority Tier when available, fallback to standard
)
print(message.usage.service_tier)Параметр service_tier принимает следующие значения:
"auto" (по умолчанию) — использует ёмкость Priority Tier, если она доступна, с переключением на вашу другую ёмкость в противном случае"standard_only" — использовать только ёмкость уровня standard; полезно, если вы не хотите использовать вашу ёмкость Priority TierОбъект usage в ответе также включает уровень обслуживания, назначенный запросу:
{
"usage": {
"input_tokens": 410,
"cache_creation_input_tokens": 0,
"cache_read_input_tokens": 0,
"output_tokens": 585,
"service_tier": "priority"
}
}Это позволяет вам определить, какой уровень обслуживания был назначен запросу.
При запросе service_tier="auto" с моделью, имеющей обязательство Priority Tier, эти заголовки ответа предоставляют полезную информацию:
anthropic-priority-input-tokens-limit: 10000
anthropic-priority-input-tokens-remaining: 9618
anthropic-priority-input-tokens-reset: 2025-01-12T23:11:59Z
anthropic-priority-output-tokens-limit: 10000
anthropic-priority-output-tokens-remaining: 6000
anthropic-priority-output-tokens-reset: 2025-01-12T23:12:21ZВы можете использовать наличие этих заголовков, чтобы определить, был ли ваш запрос пригоден для Priority Tier, даже если он превысил лимит.
Обязательство Priority Tier состоит из:
Priority Tier нацелен на 99,5% времени безотказной работы с приоритетными вычислительными ресурсами. Запросы сверх вашей зафиксированной ёмкости автоматически переключаются на уровень standard.
Priority Tier поддерживается на всех доступных моделях Claude, кроме Claude Mythos 5, Claude Mythos Preview, Claude Opus 5 и Claude Sonnet 5.
Ознакомьтесь с обзором моделей для получения дополнительной информации о доступных моделях.
Was this page helpful?