Перейти к содержанию
Справочник APIМодель и контракт API

Модель и контракт API

Что Guard гарантирует клиенту без раскрытия внутренней маршрутизации.

Протокол модели

Публичные гарантии

  • Claude Messages без серверного промпта: сохраняет перечисленные в документации нативные Anthropic Messages structures — thinking signatures, tool blocks, documents/citations, server-tool results и usage.
  • серверный промпт: сохраняет запрошенную публичную модель и даёт endpoint-aware совместимость, описанную в матрице; недоступная функция получает явную ошибку.
  • Fable 5 и 5.1: отдельные публичные модели в Messages, Chat Completions, Responses и count_tokens без фактически применённого серверного промпта. Если подходящий промпт должен примениться, запрос отклоняется до списания; старый id Fable 5 не переключается на 5.1.
  • Ошибки сервиса: временная недоступность возвращается как нейтральный 503/504; повторяйте запрос с exponential backoff и учитывайте Retry-After, если он присутствует.
bash
curl -s https://api.guardrelay.ai/v1/messages \
  -H "x-api-key: $GUARD_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{"model":"claude-opus-5","max_tokens":16,"messages":[{"role":"user","content":"ping"}]}'

Kimi, Composer и Grok

Для всех семейств публичный id запроса определяет имя модели в ответе и базовый тариф. Неизвестный id возвращает 404; используйте точный id из каталога.

  • Kimi. Четыре точных id без свободных написаний. Если наверху ответила не та модель, запрос не отдаётся, резерв возвращается целиком и вы не платите ничего: приходит 502 kimi_model_mismatch.
  • Composer и Grok. Десять точных id. Уровень усилий и режим Fast входят в id, поэтому выбор модели это одновременно выбор уровня и тарифа; отдельными полями они не управляются.
  • Клиентские функции у них работают на всех трёх поверхностях: разбор на странице Client tools.
  • Что не поддерживается у Composer/Grok: MCP, документы, нативные citations, structured outputs и count_tokens. Sampling и cache_control внутри блока принимаются без эффекта; ими нельзя управлять генерацией или кэшем.

Проверить это можно самому: поле model в ответе повторяет тот id, который вы отправили.

bash
curl -s -X POST https://api.guardrelay.ai/v1/chat/completions \
  -H "Authorization: Bearer $GUARD_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"k3","max_tokens":16,"messages":[{"role":"user","content":"ping"}]}'

Что Guard гарантирует по Kimi

  • Модель. Публичный id, который вы прислали, тот же приходит в ответе и по нему же считается списание. Подмену на другую модель Guard не пропускает.
  • Чужая модель. Если наверху ответила не та модель, запрос закрывается кодом 502 kimi_model_mismatch, резерв возвращается целиком, строка расхода не пишется. За такой запрос вы не платите ничего.
  • Поток. Имя модели сверяется на первом же кадре, до того как ответ дойдёт до вас.
  • Ставка. Списание идёт по официальной ставке запрошенной модели. Подтверждённое текущее участие в PRIVATE даёт скидку 25% после учёта кэша.
  • Поверхности. Kimi обслуживается на всех трёх: обычный POST /v1/chat/completions, протокол Anthropic Messages и протокол Responses. Гарантия по модели на каждой из них одна и та же.
bash
curl -s -X POST https://api.guardrelay.ai/v1/chat/completions \
  -H "Authorization: Bearer $GUARD_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"cursor-grok-4.6-medium","max_tokens":16,"messages":[{"role":"user","content":"ping"}]}'
bash
curl -s -X POST https://api.guardrelay.ai/v1/chat/completions \
  -H "Authorization: Bearer $GUARD_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"composer-2.5","max_tokens":16,"messages":[{"role":"user","content":"ping"}]}'

Разделы документации

На этой странице