Zum Inhalt springen

GLM 5.3 Flash — Shield

glm.5.3-flash-shield

Eine vertrauliche multimodale Route für Text, Bilder, Tools und strukturierte Ausgaben mit Streaming.

CHF 0.365 pro Million Eingabe-Tokens und CHF 1.215 pro Million Ausgabe-Tokens. Cachepreise sind nicht anwendbar.

GLM 5.3 Flash — Shield

Eine vertrauliche multimodale Route für Text, Bilder, Tools und strukturierte Ausgaben mit Streaming.

  • Shield verbindet eine geschützte Ausführungsumgebung mit einem von Sealarca signierten Beleg. Dieser dokumentiert den von unserem Gateway beobachteten Austausch.
  • Hashes beziehen sich auf JSON-Daten und SSE-Streams zwischen dem Sealarca-Gateway und dem Verschlüsselungsproxy vor der Antwortkonvertierung, nicht auf die ursprünglichen HTTP-Bytes des Clients. Manifest-Digests sind Umgebungsbeobachtungen ohne unabhängige Hardwarebindung an die Antwort.
  • Die Unterhaltung muss in jeder Anfrage enthalten sein. store=true, background, previous_response_id, conversation und cache_salt werden abgelehnt. Serverseitig ausgeführte Tools sind nicht verfügbar.
  • reasoning_effort akzeptiert low, high oder max. Standard ist low; Reasoning kann nicht deaktiviert werden. Reasoning-Tokens werden als Ausgabe-Tokens abgerechnet, auch wenn der Stream vor der Anzeige einer Antwort unterbrochen wird.
  • Modellkontext: bis zu 1 048 576 Tokens. Von Sealarca konfiguriertes Ausgabelimit: 131 072 Tokens pro Anfrage. Kontingente und tatsächliche Routenlimits können dieses Limit reduzieren. Responses wird in Chat Completions konvertiert. Vorschau-Route.
  • Signierte Belege und Metadaten werden 90 Tage aufbewahrt. Belege und Logs enthalten keine Prompts, Antworten oder Bilder. Gemeinsames Caching ist deaktiviert.
POST /v1/responsesbash
curl https://api.sealarca.ch/v1/responses \
  -H "Authorization: Bearer $SEALARCA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "glm.5.3-flash-shield",
  "input": "Reply with OK.",
  "reasoning": {
    "effort": "low"
  },
  "store": false,
  "max_output_tokens": 256
}'
POST /v1/chat/completionsbash
curl https://api.sealarca.ch/v1/chat/completions \
  -H "Authorization: Bearer $SEALARCA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "glm.5.3-flash-shield",
  "messages": [
    {
      "role": "user",
      "content": "Reply with OK."
    }
  ],
  "reasoning_effort": "low",
  "max_tokens": 256,
  "stream": true
}'
POST /v1/messagesbash
curl https://api.sealarca.ch/v1/messages \
  -H "Authorization: Bearer $SEALARCA_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "glm.5.3-flash-shield",
  "max_tokens": 256,
  "messages": [
    {
      "role": "user",
      "content": "Reply with OK."
    }
  ]
}'

X-Sealarca-Receipt-ID und X-Sealarca-Receipt-URL aus der Antwort lesen. Der Beleg ist nach Abschluss und Übermittlung verfügbar; ein 404 kann vorübergehend sein. complete, interrupted und failed beschreiben den beobachteten Austausch.

Shield receiptbash
# X-Sealarca-Receipt-ID / X-Sealarca-Receipt-URL / X-Sealarca-Proof-Profile
curl https://api.sealarca.ch/v1/vault/proofs/$RECEIPT_ID/bundle \
  -H "Authorization: Bearer $SEALARCA_API_KEY"
# JWKS: https://api.sealarca.ch/v1/vault/proofs/signing-keys
Modelle und Preise ansehen