- Claude Messages без серверного промпта: сохраняет перечисленные в документации нативные Anthropic Messages structures — thinking signatures, tool blocks, documents/citations, server-tool results и usage.
- серверный промпт: сохраняет запрошенную публичную модель и даёт endpoint-aware совместимость, описанную в матрице; недоступная функция получает явную ошибку.
- Fable 5 и 5.1: отдельные публичные модели в Messages, Chat Completions, Responses и count_tokens без фактически применённого серверного промпта. Если подходящий промпт должен примениться, запрос отклоняется до списания; старый id Fable 5 не переключается на 5.1.
- Ошибки сервиса: временная недоступность возвращается как нейтральный
503/504; повторяйте запрос с exponential backoff и учитывайтеRetry-After, если он присутствует.
bash
curl -s https://api.guardrelay.ai/v1/messages \
-H "x-api-key: $GUARD_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{"model":"claude-opus-5","max_tokens":16,"messages":[{"role":"user","content":"ping"}]}'Для всех семейств публичный id запроса определяет имя модели в ответе и базовый тариф. Неизвестный id возвращает 404; используйте точный id из каталога.
- Kimi. Четыре точных id без свободных написаний. Если наверху ответила не та модель, запрос не отдаётся, резерв возвращается целиком и вы не платите ничего: приходит
502 kimi_model_mismatch. - Composer и Grok. Десять точных id. Уровень усилий и режим Fast входят в id, поэтому выбор модели это одновременно выбор уровня и тарифа; отдельными полями они не управляются.
- Клиентские функции у них работают на всех трёх поверхностях: разбор на странице Client tools.
- Что не поддерживается у Composer/Grok: MCP, документы, нативные citations, structured outputs и count_tokens. Sampling и cache_control внутри блока принимаются без эффекта; ими нельзя управлять генерацией или кэшем.
Проверить это можно самому: поле model в ответе повторяет тот id, который вы отправили.
bash
curl -s -X POST https://api.guardrelay.ai/v1/chat/completions \
-H "Authorization: Bearer $GUARD_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"k3","max_tokens":16,"messages":[{"role":"user","content":"ping"}]}'- Модель. Публичный id, который вы прислали, тот же приходит в ответе и по нему же считается списание. Подмену на другую модель Guard не пропускает.
- Чужая модель. Если наверху ответила не та модель, запрос закрывается кодом
502 kimi_model_mismatch, резерв возвращается целиком, строка расхода не пишется. За такой запрос вы не платите ничего. - Поток. Имя модели сверяется на первом же кадре, до того как ответ дойдёт до вас.
- Ставка. Списание идёт по официальной ставке запрошенной модели. Подтверждённое текущее участие в PRIVATE даёт скидку 25% после учёта кэша.
- Поверхности. Kimi обслуживается на всех трёх: обычный
POST /v1/chat/completions, протокол Anthropic Messages и протокол Responses. Гарантия по модели на каждой из них одна и та же.
bash
curl -s -X POST https://api.guardrelay.ai/v1/chat/completions \
-H "Authorization: Bearer $GUARD_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"cursor-grok-4.6-medium","max_tokens":16,"messages":[{"role":"user","content":"ping"}]}'bash
curl -s -X POST https://api.guardrelay.ai/v1/chat/completions \
-H "Authorization: Bearer $GUARD_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"composer-2.5","max_tokens":16,"messages":[{"role":"user","content":"ping"}]}'