Vai al contenuto

GLM 5.3 Flash — Shield

glm.5.3-flash-shield

Una rotta confidenziale multimodale per testo, immagini, strumenti e output strutturati, con streaming.

CHF 0.365 per milione di token di input e CHF 1.215 per milione di token di output. Prezzo cache non applicabile.

GLM 5.3 Flash — Shield

Una rotta confidenziale multimodale per testo, immagini, strumenti e output strutturati, con streaming.

  • Shield associa un ambiente di esecuzione protetto a una ricevuta firmata da Sealarca. Questa ricevuta documenta lo scambio osservato dal nostro gateway.
  • Gli hash riguardano i corpi JSON e i flussi SSE tra il gateway Sealarca e il proxy di cifratura, prima delle conversioni della risposta. Non identificano i byte HTTP originali del client. I digest dei manifest sono osservazioni dell’ambiente senza un legame hardware indipendente con la risposta.
  • Inviare la conversazione in ogni richiesta. store=true, background, previous_response_id, conversation e cache_salt vengono rifiutati. Gli strumenti eseguiti sul server non sono disponibili.
  • reasoning_effort accetta low, high o max. Il valore predefinito è low; il ragionamento non può essere disattivato. I token di ragionamento sono fatturati come token di output, anche quando il flusso viene interrotto prima che sia visualizzata una risposta.
  • Contesto del modello: fino a 1 048 576 token. Limite di output configurato da Sealarca: 131 072 token per richiesta. Le quote e i limiti effettivi della rotta possono ridurre questo limite. Responses viene convertito in Chat Completions. Rotta in anteprima.
  • Ricevute firmate e metadati sono conservati per 90 giorni. Ricevute e log non contengono prompt, risposte o immagini. La cache condivisa è disattivata.
POST /v1/responsesbash
curl https://api.sealarca.ch/v1/responses \
  -H "Authorization: Bearer $SEALARCA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "glm.5.3-flash-shield",
  "input": "Reply with OK.",
  "reasoning": {
    "effort": "low"
  },
  "store": false,
  "max_output_tokens": 256
}'
POST /v1/chat/completionsbash
curl https://api.sealarca.ch/v1/chat/completions \
  -H "Authorization: Bearer $SEALARCA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "glm.5.3-flash-shield",
  "messages": [
    {
      "role": "user",
      "content": "Reply with OK."
    }
  ],
  "reasoning_effort": "low",
  "max_tokens": 256,
  "stream": true
}'
POST /v1/messagesbash
curl https://api.sealarca.ch/v1/messages \
  -H "Authorization: Bearer $SEALARCA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "glm.5.3-flash-shield",
  "max_tokens": 256,
  "messages": [
    {
      "role": "user",
      "content": "Reply with OK."
    }
  ]
}'

Leggere X-Sealarca-Receipt-ID e X-Sealarca-Receipt-URL dalla risposta. La ricevuta è disponibile dopo finalizzazione e consegna; un 404 può essere temporaneo. complete, interrupted e failed descrivono lo scambio osservato.

Shield receiptbash
# X-Sealarca-Receipt-ID / X-Sealarca-Receipt-URL / X-Sealarca-Proof-Profile
curl https://api.sealarca.ch/v1/vault/proofs/$RECEIPT_ID/bundle \
  -H "Authorization: Bearer $SEALARCA_API_KEY"
# JWKS: https://api.sealarca.ch/v1/vault/proofs/signing-keys
Consultare modelli e prezzi