Aller au contenu

GLM 5.3 Flash — Shield

glm.5.3-flash-shield

Une route confidentielle multimodale pour le texte, les images, les outils et les sorties structurées, avec streaming.

CHF 0.365 par million de tokens d’entrée et CHF 1.215 par million de tokens de sortie. Cache non applicable.

GLM 5.3 Flash — Shield

Une route confidentielle multimodale pour le texte, les images, les outils et les sorties structurées, avec streaming.

  • Shield associe un environnement d’exécution protégé à un reçu signé par Sealarca. Ce reçu documente l’échange observé par notre passerelle.
  • Les hashes portent sur les corps JSON et les flux SSE entre la passerelle Sealarca et le proxy de chiffrement, avant les conversions de réponse. Ils ne désignent pas les octets HTTP originaux du client. Les digests des manifestes sont des observations du déploiement, sans liaison matérielle indépendante avec la réponse.
  • Envoyer la conversation dans chaque requête. store=true, background, previous_response_id, conversation et cache_salt sont refusés. Les outils exécutés côté serveur ne sont pas disponibles.
  • reasoning_effort accepte low, high ou max. Le réglage par défaut est low ; le raisonnement ne peut pas être désactivé. Les tokens de raisonnement sont facturés comme tokens de sortie, y compris si le flux est interrompu avant l’affichage d’une réponse.
  • Contexte maximal du modèle : 1 048 576 tokens. Plafond de sortie configuré par Sealarca : 131 072 tokens par requête. Les quotas et limites effectives de la route peuvent réduire ce plafond. Responses est converti vers Chat Completions. Route en aperçu.
  • Les reçus signés et métadonnées sont conservés 90 jours. Aucun prompt, réponse ou image n’est conservé dans les reçus ou les journaux. Le cache partagé est désactivé.
POST /v1/responsesbash
curl https://api.sealarca.ch/v1/responses \
  -H "Authorization: Bearer $SEALARCA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "glm.5.3-flash-shield",
  "input": "Reply with OK.",
  "reasoning": {
    "effort": "low"
  },
  "store": false,
  "max_output_tokens": 256
}'
POST /v1/chat/completionsbash
curl https://api.sealarca.ch/v1/chat/completions \
  -H "Authorization: Bearer $SEALARCA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "glm.5.3-flash-shield",
  "messages": [
    {
      "role": "user",
      "content": "Reply with OK."
    }
  ],
  "reasoning_effort": "low",
  "max_tokens": 256,
  "stream": true
}'
POST /v1/messagesbash
curl https://api.sealarca.ch/v1/messages \
  -H "Authorization: Bearer $SEALARCA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "glm.5.3-flash-shield",
  "max_tokens": 256,
  "messages": [
    {
      "role": "user",
      "content": "Reply with OK."
    }
  ]
}'

Lire X-Sealarca-Receipt-ID et X-Sealarca-Receipt-URL sur la réponse. Le reçu devient disponible après finalisation et livraison ; un 404 peut être temporaire. Les états complete, interrupted et failed décrivent l’échange observé.

Shield receiptbash
# X-Sealarca-Receipt-ID / X-Sealarca-Receipt-URL / X-Sealarca-Proof-Profile
curl https://api.sealarca.ch/v1/vault/proofs/$RECEIPT_ID/bundle \
  -H "Authorization: Bearer $SEALARCA_API_KEY"
# JWKS: https://api.sealarca.ch/v1/vault/proofs/signing-keys
Consulter les modèles et les tarifs