Перейти к содержанию
СтартGLM API

GLM API

Две модели GLM 5.3, три нативных API, кеш, веб-поиск и точный биллинг.

GLM использует тот же ключ gd-… и общий баланс Guard. Публичный каталог содержит ровно две модели: GLM 5.3 (glm-5.3) и GLM 5.3 Flash (glm-5.3-flash); модель по умолчанию в инструкциях: glm-5.3.

МодельВводСтатус форматов
glm-5.3ТекстТекстовый контракт
glm-5.3-flashТекст, изображения, PDF; MP4 в ChatPNG и PDF прочитаны во всех трёх протоколах; MP4-видео подтверждено только в Chat; native TXT, DOCX и XLSX не подтверждены

Три API и два адреса

APIОбщий адресАдрес семейства
MessagesPOST /v1/messagesPOST /glm/v1/messages
Chat CompletionsPOST /v1/chat/completionsPOST /glm/v1/chat/completions
ResponsesPOST /v1/responsesPOST /glm/v1/responses
bash
curl https://api.guardrelay.ai/glm/v1/messages \
  -H "Authorization: Bearer $GUARD_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{"model":"glm-5.3","max_tokens":128,"messages":[{"role":"user","content":"Reply with OK"}]}'
bash
curl https://api.guardrelay.ai/glm/v1/chat/completions \
  -H "Authorization: Bearer $GUARD_API_KEY" \
  -H "content-type: application/json" \
  -d '{"model":"glm-5.3","messages":[{"role":"user","content":"Reply with OK"}],"stream":true}'
bash
curl https://api.guardrelay.ai/glm/v1/responses \
  -H "Authorization: Bearer $GUARD_API_KEY" \
  -H "content-type: application/json" \
  -d '{"model":"glm-5.3","input":"Reply with OK","max_output_tokens":128,"store":false}'

Тарифы

МодельВвод / 1 млнЧтение кеша / 1 млнВывод / 1 млнВеб-поиск
glm-5.3$1.40$0.26$4.40$0.10 за подтверждённый вызов
glm-5.3-flash$0.15$0.03$0.50$0.10 за подтверждённый вызов

Множитель равен 1, включая PRIVATE. Применённый серверный промпт входит в фактический оплачиваемый вход. Messages сообщает input без cache read, а Chat и Responses включают cache в общий input; Guard нормализует эти формы и не вычитает кеш дважды.

Бесплатный подсчёт токенов

bash
curl https://api.guardrelay.ai/glm/v1/messages/count_tokens \
  -H "Authorization: Bearer $GUARD_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "content-type: application/json" \
  -d '{"model":"glm-5.3","messages":[{"role":"user","content":"Count this text"}]}'

Responses и серверный промпт

  • Responses сохраняет store: true по умолчанию и сохраняет явно переданный store: false.
  • previous_response_id продолжает ответ только с тем же Guard key и provider account. Если этот account недоступен, Guard возвращает явную ошибку до резерва и не переносит состояние на другой account.
  • Серверный промпт GLM выключен по умолчанию. Для применения нужны отдельное право доступа, включённый переключатель и активная серверная редакция. Подмена модели также выключена по умолчанию и возможна только внутри GLM при фактически применённом промпте.

Разделы документации

На этой странице