GLM 5.3 Flash — Shield
glm.5.3-flash-shield
Una rotta confidenziale multimodale per testo, immagini, strumenti e output strutturati, con streaming.
CHF 0.365 per milione di token di input e CHF 1.215 per milione di token di output. Prezzo cache non applicabile.
GLM 5.3 Flash — Shield
Una rotta confidenziale multimodale per testo, immagini, strumenti e output strutturati, con streaming.
- Shield associa un ambiente di esecuzione protetto a una ricevuta firmata da Sealarca. Questa ricevuta documenta lo scambio osservato dal nostro gateway.
- Gli hash riguardano i corpi JSON e i flussi SSE tra il gateway Sealarca e il proxy di cifratura, prima delle conversioni della risposta. Non identificano i byte HTTP originali del client. I digest dei manifest sono osservazioni dell’ambiente senza un legame hardware indipendente con la risposta.
- Inviare la conversazione in ogni richiesta. store=true, background, previous_response_id, conversation e cache_salt vengono rifiutati. Gli strumenti eseguiti sul server non sono disponibili.
- reasoning_effort accetta low, high o max. Il valore predefinito è low; il ragionamento non può essere disattivato. I token di ragionamento sono fatturati come token di output, anche quando il flusso viene interrotto prima che sia visualizzata una risposta.
- Contesto del modello: fino a 1 048 576 token. Limite di output configurato da Sealarca: 131 072 token per richiesta. Le quote e i limiti effettivi della rotta possono ridurre questo limite. Responses viene convertito in Chat Completions. Rotta in anteprima.
- Ricevute firmate e metadati sono conservati per 90 giorni. Ricevute e log non contengono prompt, risposte o immagini. La cache condivisa è disattivata.
POST /v1/responsesbash
curl https://api.sealarca.ch/v1/responses \
-H "Authorization: Bearer $SEALARCA_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm.5.3-flash-shield",
"input": "Reply with OK.",
"reasoning": {
"effort": "low"
},
"store": false,
"max_output_tokens": 256
}'POST /v1/chat/completionsbash
curl https://api.sealarca.ch/v1/chat/completions \
-H "Authorization: Bearer $SEALARCA_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm.5.3-flash-shield",
"messages": [
{
"role": "user",
"content": "Reply with OK."
}
],
"reasoning_effort": "low",
"max_tokens": 256,
"stream": true
}'POST /v1/messagesbash
curl https://api.sealarca.ch/v1/messages \
-H "Authorization: Bearer $SEALARCA_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm.5.3-flash-shield",
"max_tokens": 256,
"messages": [
{
"role": "user",
"content": "Reply with OK."
}
]
}'Leggere X-Sealarca-Receipt-ID e X-Sealarca-Receipt-URL dalla risposta. La ricevuta è disponibile dopo finalizzazione e consegna; un 404 può essere temporaneo. complete, interrupted e failed descrivono lo scambio osservato.
Shield receiptbash
# X-Sealarca-Receipt-ID / X-Sealarca-Receipt-URL / X-Sealarca-Proof-Profile
curl https://api.sealarca.ch/v1/vault/proofs/$RECEIPT_ID/bundle \
-H "Authorization: Bearer $SEALARCA_API_KEY"
# JWKS: https://api.sealarca.ch/v1/vault/proofs/signing-keys