POST /v1/messages/count_tokens считает вход для Claude с серверным промптом и без него. Используется токенизатор модели для подготовленного запроса. Результат — число input_tokens.
bash
curl https://api.guardrelay.ai/v1/messages/count_tokens \
-H "x-api-key: $GUARD_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-sonnet-5",
"messages": [{"role": "user", "content": "Сколько здесь токенов?"}]
}'json
{ "input_tokens": 56 }POST /v1/messages/count_tokens работает для моделей Claude и Kimi и возвращает число входных токенов. Запрос с id Composer или Grok получает 404: этот endpoint их не знает.
- Kimi. Бесплатный подсчёт доступен на
/v1/messages/count_tokensдля всех четырёх id. Он не заменяет резерв генерации: задавайте явныйmax_tokens, иначе выходная часть резерва считается по 32 000 токенов. - Composer и Grok. Предварительного подсчёта нет. Фактический расход приходит в
usageответа, а окно контекста у Composer 200K и у Grok 500K.
Все четыре Kimi id поддерживают бесплатный POST /v1/messages/count_tokens. Передайте модель и сообщения; ответ содержит input_tokens. Расход генерации отдельно приходит в usage оплачиваемого ответа.
bash
curl -s -X POST https://api.guardrelay.ai/v1/messages/count_tokens \
-H "Authorization: Bearer $GUARD_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "k3",
"messages": [{"role": "user", "content": "Сколько здесь токенов?"}]
}'json
{ "input_tokens": 14 }