# Расход и лимиты

Сколько AI-ресурсов израсходовано, какая часть месячной квоты компании уже потрачена и в какие часы квота расходуется медленнее.

Статистика считается **по API-ключу**: токены, стоимость и разбивка по моделям за выбранный период. Квота — **по порталу**: общий месячный лимит компании, единый для всех её ключей. Выгодные часы — расписание скидок, которое замедляет расход этой квоты в определённые часы недели.

Скоуп: `vibe:ai`

## Операции

- [Статистика использования](./consumption/usage.md) — `GET /v1/ai/usage`
- [AI-квота компании](./consumption/quota.md) — `GET /v1/ai/quota`
- [Расписание выгодных часов](./consumption/off-peak.md) — `GET /v1/off-peak`

## Типовой сценарий

1. Проверьте остаток квоты перед массовой обработкой: [`GET /v1/ai/quota`](./consumption/quota.md). Поля `pctUsed` и `exhausted` позволяют предупредить пользователя до отказа `402`.
2. Узнайте, когда квота расходуется медленнее: [`GET /v1/off-peak`](./consumption/off-peak.md), и перенесите задачи, которые терпят отсрочку, в дешёвые окна.
3. После обработки сверьте расход по ключу: [`GET /v1/ai/usage`](./consumption/usage.md).

## Смотрите также

- [AI Router](/docs/ai)
- [Список моделей](/docs/ai/models/list)
- [Лимиты запросов](/docs/ai/chat/rate-limits)
