GATEWAY IA AZIENDALE · CONTROLLO DELLA GOVERNANCE · SELF-HOSTED

Con il moltiplicarsi dei modelli, gli agenti che iniziano ad agire e l’IA collegata a sempre più sistemi aziendali, la governance non è più facoltativa. ShieldON offre la massima trasparenza per mantenere rischi, costi e accessi sotto controllo mentre l’IA cresce.

app.shieldon.ai/workspaces/ws_4a9f…/overview

Console dimostrativa: panoramica delle metriche e tabella delle richieste recenti. Dati statici solo a scopo illustrativo.

Architettura

Ogni app e agente da un lato. Ogni modello dall’altro. ShieldON in mezzo.

App, agenti e strumenti dell’azienda raggiungono i modelli cloud e locali attraverso ShieldON. I dati sensibili vengono oscurati prima che escano, ogni richiesta va al modello più adatto, ogni chiamata finisce nel registro e il tuo agente IA può modificare la policy.

All’interno del confine aziendale, app, agenti, strumenti e assistenti chiamano i modelli cloud e locali attraverso il Gateway IA ShieldON, e le risposte tornano per la stessa via. I controlli di sicurezza oscurano i dati sensibili prima che una richiesta esca; il routing invia le richieste semplici ai modelli locali e quelle complesse ai modelli di frontiera, con fallback; ogni richiesta viene registrata con chiave, rotta e token; l’utilizzo genera suggerimenti per risparmiare token; e l’agente IA dell’azienda stessa legge l’utilizzo, imposta la policy e pubblica una release tramite l’API.

INTEGRAZIONI LLM

Collega un fornitore una volta. Cambia, combina e gestisci i guasti senza modificare il codice applicativo.

OpenAI, Anthropic, Gemini, Bedrock, Alibaba Cloud Bailian, DeepSeek e altri trenta fornitori dietro un unico endpoint compatibile con OpenAI. Le chiavi dei fornitori sono cifrate in ShieldON e condivise solo con i workspace scelti. Le applicazioni vedono esclusivamente una chiave ShieldON. Chat, Responses, Embeddings, Images e Audio sono supportati in base al modello.

Mappa delle operazioni

Mappa illustrativa delle operazioni

OperazioneStreamingStrumentiUtilizzo
shieldon-chat
Chat Completions
Supportato
Supportato
Supportato
Responses
Supportato
Supportato
Supportato
Messages
Supportato
Supportato
Supportato
shieldon-embed
Embeddings
Non supportato
Non supportato
Supportato
  • OpenAI
  • Azure OpenAI
  • Microsoft Foundry
  • GitHub Models
  • Anthropic
  • Google Gemini / Vertex AI
  • AWS Bedrock
  • Alibaba Cloud Bailian
  • Zhipu AI
  • DeepSeek
  • Moonshot AI
  • MiniMax
  • Groq
  • Together AI
  • Fireworks AI
  • OpenRouter
  • xAI
  • Perplexity
  • Cerebras
  • DeepInfra
  • Nebius
  • SambaNova
  • SiliconFlow
  • Novita AI
  • Jina AI
  • Voyage AI
  • Cloudflare Workers AI
  • Hugging Face
  • Ollama
  • vLLM
  • LocalAI
  • Databricks
  • Compatibile con OpenAI generico

01 · CHI CHIAMA L’API?

Identifica applicazione, team e ambiente dietro ogni chiamata, prima che raggiunga un modello.

Ogni applicazione riceve una chiave API del gateway con regole su modelli consentiti, contesto obbligatorio e reti autorizzate. Puoi ruotarla senza interruzioni. La chiave del fornitore non lascia mai ShieldON.

Risposte illustrative del gateway

    Console dimostrativa: viene creata la chiave billing-assistant con quattro variabili di metadati e accesso limitato a 203.0.113.0/24. Una richiesta da un altro indirizzo viene rifiutata.

    Crea chiave API del gateway

    Assegna un nome alla chiave e decidi quali chiamate può effettuare. L’applicazione riceve un segreto dedicato; le credenziali del fornitore restano sotto il tuo controllo.

    Ogni richiesta deve identificarsi

    Stabilisci quali informazioni ogni chiamata deve dichiarare: applicazione, ambiente, team, progetto, cliente, utente, funzionalità o sessione. ShieldON rifiuta le chiamate incomplete. Gli stessi campi serviranno poi ad attribuire i costi.

    Solo dalle reti previste

    Limita una chiave ai tuoi intervalli di rete. Le chiamate provenienti da altrove vengono rifiutate prima di raggiungere un modello.

    Organizzazioni e workspace separano reparti, prodotti e ambienti, ciascuno con membri e ruoli propri.

    02 · QUALI INFORMAZIONI VENGONO INVIATE AL LLM?

    Numeri di carte, documenti e chiavi API si fermano al confine. I prompt non vengono mai salvati per impostazione predefinita.

    Un confine di sicurezza comune a tutte le applicazioni. ShieldON esamina input e output, rileva dati personali e credenziali e segnala o blocca la chiamata secondo i tuoi criteri. Registra soltanto la decisione, mai il contenuto rilevato. Per impostazione predefinita non conserva prompt, output o embedding.

    • Dati personali: indirizzi email, numeri di telefono, documenti d’identità, carte di pagamento, numeri di previdenza sociale statunitensi
    • Segreti: chiavi private, token di sessione, credenziali cloud e SaaS, password incollate nei prompt
    • Regole personalizzate: parole chiave, espressioni regolari, elenchi di chiamate a strumenti consentite o il tuo servizio di policy tramite webhook protetto
    • Inizia in modalità Monitor per verificare cosa verrebbe rilevato. Passa a Block quando sei sicuro.

    Console dimostrativa: il profilo di protezione blocca una richiesta con un numero di carta; una seconda richiesta passa. Il registro attività conserva solo il codice del motivo.

    Bloccata prima di raggiungere il fornitore. ShieldON rifiuta la richiesta senza riscriverla silenziosamente e registra solo il motivo, mai il valore rilevato.

    PRIVACY PER IMPOSTAZIONE PREDEFINITA

    • Testo del prompt
    • Output del modello
    • Argomenti degli strumenti
    • Corpi dei webhook
    • Vettori di embedding
    RegistratoMetadati operativi · utilizzo · eventi di audit · routing · errori

    Devi conservare brevemente dei contenuti per risolvere un problema? Serve una policy esplicita concordata separatamente: cifratura a riposo e audit di ogni consultazione.

    Console dimostrativa: Dettagli richiesta req_48e5aa — Modello logico shieldon-chat, ID fornitore openai-prod, Stato Succeeded, Latenza 812 ms. Payload acquisiti: L’acquisizione dei contenuti era disattivata oppure nessun payload è stato conservato per questa richiesta.

    ESEMPIO DI REGISTRAZIONE CONTABILE

    Campi del registro di utilizzo e costi con sole aggiunte; non è una schermata della console.
    request_id
    req_48e5aa
    actual_route
    @openai-prod/gpt-4.1
    input_tokens
    1,016
    output_tokens
    188
    cached_input_tokens
    0
    route_attempts
    1
    retries
    0
    metadata.application
    support-bot
    metadata.environment
    production
    credits
    0.42

    03 · COME VA CONTROLLATO IL COMPORTAMENTO?

    Cambia fornitore, limita la spesa e ripristina in pochi minuti. Senza modifiche al codice o hotfix.

    Le applicazioni chiamano un nome di modello stabile; tu scegli cosa c’è dietro. Usa un fornitore, un’alternativa in caso di guasto, una distribuzione ponderata o regole di selezione. Limiti e budget vengono applicati prima di chiamare il fornitore. Ogni modifica entra in funzione come release verificata, ripristinabile con un clic.

    Console dimostrativa: il fallback gestisce un errore 429; un limite blocca a 600 RPM; un budget blocca le chiamate al limite e viene rettificato; una release viene pubblicata e ripristinata.

    Tentativi di routing illustrativi · req_9b21c4

    • tentativo 1 · @openai-prod/gpt-4.1

      Un fallback invisibile a chi chiama

      Se il fornitore principale limita la frequenza o non risponde in tempo, ShieldON riprova e passa alla destinazione successiva che hai approvato. L’applicazione riceve una risposta riuscita e un solo ID richiesta, senza gestione aggiuntiva degli errori o nuove distribuzioni.

      Prova il failover con i tuoi fornitori e modelli prima di farvi affidamento.

      Limiti per modello, con un piano per gli imprevisti

      Limita richieste, token e chiamate simultanee per modello. Se il sistema di limitazione non è disponibile, hai già stabilito se privilegiare sicurezza o disponibilità.

      Budget di crediti che fermano davvero le chiamate

      Imposta budget giornalieri, settimanali o mensili per workspace o chiave applicativa, nel tuo fuso orario. All’esaurimento, blocca le chiamate o genera un avviso: decidi tu. Ogni ricarica viene registrata, impedendo aumenti silenziosi del limite.

      Ogni modifica verificata. Ogni release reversibile.

      Convalida la bozza, confrontala con la versione attiva, approva e pubblica. Se qualcosa non va, torna all’ultima release funzionante con un clic. Il gateway esegue esclusivamente release pubblicate.

      04 · COME PUÒ MIGLIORARE IL SISTEMA NEL TEMPO?

      Ogni chiamata ha un responsabile. Ogni costo è attribuito. Ogni modifica ha un autore.

      ShieldON conserva due registri: utilizzo e costi di ogni richiesta, e audit di ogni modifica al piano di controllo. Oggi mostrano quali applicazioni, team o clienti generano la spesa mensile. Domani saranno la base del ciclo di miglioramento con approvazione umana previsto nella roadmap.

      Attribuisci i costi ad applicazioni, team o clienti, senza fogli di calcolo.

      Ogni richiesta include il contesto richiesto: applicazione, ambiente, team, progetto, cliente, utente, funzionalità e sessione. ShieldON lo registra insieme a token, modello effettivo, ripetizioni ed errori per analizzare i costi secondo le esigenze finanziarie. I prezzi di immagini e audio non sono ancora completamente normalizzati tra fornitori.

      • application
      • environment
      • team
      • project
      • customer
      • user
      • feature
      • session_id
      curl "https://gateway.example.com/v1/chat/completions" \  -H "Authorization: Bearer $SHIELDON_GATEWAY_API_KEY" \  -H "Content-Type: application/json" \  -d '{    "model": "shieldon-chat",    "messages": [{"role":"user","content":"Hello"}],    "metadata": {      "application": "support-bot",      "environment": "production"    }  }'

      ESEMPIO DI REGISTRAZIONE CONTABILE

      Campi del registro di utilizzo e costi con sole aggiunte; non è una schermata della console.
      request_id
      req_48e5aa
      actual_route
      @openai-prod/gpt-4.1
      input_tokens
      1,016
      output_tokens
      188
      cached_input_tokens
      0
      route_attempts
      1
      retries
      0
      metadata.application
      support-bot
      metadata.environment
      production
      credits
      0.42

      Questa riga contiene tutto ciò che ShieldON ha conservato: chi, quanto, quale percorso e quale costo. Nessun prompt.

      Un registro delle modifiche che nessuno può alterare.

      Chi ha creato, modificato, pubblicato, ripristinato o ruotato cosa, quando e da dove. Ogni voce è permanente: l’analisi degli incidenti parte dai fatti.

      1. Osserva l’utilizzo
      2. Individua schemi
      3. Proponi miglioramenti
      4. Convalida e valuta
      5. ApprovaApprovazione umana necessaria
      6. Pubblica
      7. Misura i risultati

      Console dimostrativa: i metadati della richiesta sono registrati nel registro di utilizzo; l’audit elenca pubblicazioni, rotazioni, ripristini e aggiornamenti.

      PERCORSO DELLE RICHIESTE

      Ogni chiamata segue lo stesso percorso. Ogni passaggio offre un punto di controllo.

      Autenticazione, verifica del mittente, caricamento delle policy pubblicate, controllo dell’input, scelta della rotta, verifica di limiti e budget, chiamata al fornitore, fallback se necessario, controllo dell’output, misurazione dei costi e audit. Nessuna fase viene saltata. I capitoli precedenti seguono questo ordine.

      1. Ingresso
      2. ID richiesta
        Capitolo 04, Come migliora il sistema?
      3. Autenticazione con chiave API del gateway
        Capitolo 01, Chi chiama l’API?
      4. Autorizzazione organizzazione/workspace
        Capitolo 01, Chi chiama l’API?
      5. Snapshot dei criteri pubblicati
        Capitolo 03, Come viene controllato il comportamento?
      6. Adattatore API
      7. Controlli di sicurezza (input)
        Capitolo 02, Quali dati vengono inviati?
      8. Router→ @openai-prod/gpt-4.1
        Capitolo 03, Come viene controllato il comportamento?
      9. Verifica preliminare: frequenza/token/concorrenza/budget
        Capitolo 03, Come viene controllato il comportamento?
      10. Adattatore del fornitore
      11. Ripetizione/fallback429 → @bailian/qwen-max
        Capitolo 03, Come viene controllato il comportamento?
      12. Normalizzazione dello stream
      13. Controlli di sicurezza (output)
        Capitolo 02, Quali dati vengono inviati?
      14. Misurazione di utilizzo e costi
        Capitolo 04, Come migliora il sistema?
      15. Log utilizzo asincroni / audit
        Capitolo 04, Come migliora il sistema?
      16. Risposta

      A CHI È RIVOLTO

      Per i team responsabili dell’IA in produzione.

      Team di piattaforma

      • Tutti i fornitori dietro un endpoint. Cambia routing e failover senza ridistribuire le applicazioni.
      • Collega un fornitore una volta e condividilo con i team che ne hanno bisogno.

      Nella console: Integrazioni LLM · Configurazioni · Limiti

      Sicurezza e conformità

      • Un confine di sicurezza per ogni app: rileva dati personali e segreti, monitora prima e blocca quando sei pronto.
      • Nessun contenuto conservato per impostazione predefinita. Ogni modifica e accesso ai dati sensibili lascia una traccia permanente.

      Nella console: Controlli di sicurezza · Registro di audit

      FinOps

      • Scopri quale applicazione, team, cliente o funzionalità genera la spesa.
      • Budget che fermano realmente il traffico e ricariche sempre tracciate.

      Nella console: Budget · Analisi · Log

      Responsabili delle applicazioni

      • Un endpoint, una chiave, un nome di modello. Le applicazioni non gestiscono più credenziali dei fornitori.
      • Compatibile con OpenAI: collega SDK e agenti esistenti a ShieldON cambiando URL di base e chiave.

      Nella console: Configurazione rapida · Chiavi API del gateway

      Operatori

      • Ogni modifica viene verificata prima dell’attivazione. Un clic ripristina l’ultima release funzionante.
      • Funziona su un host Linux con Docker Compose, nel tuo ambiente.

      Nella console: Versioni e release

      UN PILOTA NEL TUO AMBIENTE

      Dalla chiave del fornitore alla prima chiamata governata in cinque passaggi, su un host Linux.

      La configurazione rapida ti guida in una pagina: collega un fornitore, crea una chiave applicativa, pubblica, esegui una vera chiamata di prova e integra. Poi fornisci ai team un unico endpoint.

      Nella console

      Configurazione rapida

      1. Collega fornitoreSalva chiave e modelli del fornitore
      2. Crea chiave del gatewayCrea l’identità per le chiamate ai modelli
      3. PubblicaConvalida e attiva la configurazione
      4. TestaVerifica una chiamata al modello tramite il gateway attivo
      5. IntegraVisualizza chiamate ai modelli e opzioni di integrazione delle chiavi API

      Usi Workbench, Codex o Claude Code? Installa la Skill ShieldON: configura la CLI e ti guida nell’accesso.

      Chiamata al modello
      curl "https://gateway.example.com/v1/chat/completions" \  -H "Authorization: Bearer $SHIELDON_GATEWAY_API_KEY" \  -H "Content-Type: application/json" \  -d '{"model":"shieldon-chat","messages":[{"role":"user","content":"Hello"}],"metadata":{"application":"support-bot","environment":"production"}}'

      Le applicazioni usano esclusivamente questa chiave. La chiave del fornitore resta in ShieldON.

      Un host Linux · Docker Compose. Nginx connects to Gateway (Go), Piano di controllo (Go), Console web + Documentazione. Gateway (Go) connects to PostgreSQL, Redis. Piano di controllo (Go) connects to PostgreSQL, Redis, Archiviazione compatibile S3 (facoltativa).

      Tutto gira nel tuo ambiente: un punto d’accesso, pochi container, PostgreSQL e Redis standard e archiviazione a oggetti facoltativa. Immagini multiarchitettura e pacchetto d’installazione offline inclusi.

      OLTRE IL MODELLO

      Governa anche le capacità degli agenti, oltre ai modelli che chiamano.

      Codex, Claude Code, OpenClaw e gli agenti dei tuoi team avranno bisogno di un gateway comune. Vogliamo governare tutto ciò che usano: Skill, strumenti, server MCP, flussi CLI e API. Sempre con quattro domande: è sicuro, quanto costa, possiamo osservarlo e migliora nel tempo?

      1. 1. Fondamenti di governance

        Conosci ciò che hai: un modello d’identità e un inventario di agenti, Skill, strumenti, server MCP e API, con responsabili, classificazione dei dati e audit.

      2. 2. Criteri e controllo

        Definisci le regole: criteri di sicurezza e controlli di spesa per tutti gli agenti, con approvazioni, restrizioni delle capacità e gestione delle release.

      3. 3. Miglioramento continuo

        Migliora in modo intenzionale: raccomandazioni su prompt, policy, Skill e casi d’uso derivate dall’utilizzo reale, valutate e distribuite sotto controllo.

      4. 4. Livello operativo aziendale

        Gestisci l’IA come il resto dell’azienda: scopri e registra gli agenti shadow IT, integra altri runtime, amplia le opzioni di distribuzione e sviluppa le funzioni più richieste dai clienti.

      Sicurezza

      Controlla cosa attraversa il confine di modelli e strumenti, mantieni segreti e dati personali all’interno e richiedi approvazione per le azioni ad alto rischio.

      Finanza / FinOps

      Attribuisci ogni costo a persona, team, app, agente, Skill, strumento, modello e fornitore. Applica i budget e rileva presto le anomalie.

      Visibilità / Osservabilità

      Una traccia continua dalla persona al risultato: agente, Skill, strumenti, server MCP, API, modelli e policy applicate.

      RSI

      L’utilizzo reale suggerisce prompt, policy e casi d’uso migliori. Ogni proposta è versionata, valutata e approvata da una persona.

      Gestione delle Skill

      Un registro delle Skill eseguite dagli agenti, ciascuna con responsabile, versione, scopo, livello di rischio e pubblico autorizzato. Pubblicate tramite lo stesso processo di release verificato.

      Gestione di strumenti e MCP

      Conosci ogni strumento e server MCP, i dati a cui accede e le destinazioni raggiungibili. Autorizza, blocca e assegna budget, mantenendo la catena completa da identità, agente, Skill, strumento e modello fino al risultato.

      Gestione di CLI e API

      Applica a sessioni CLI, processi automatici e API interne gli stessi controlli di identità, policy, misurazione, audit e release delle chiamate ai modelli.

      Controlli di sicurezza, finanza e visibilità

      Classifica i dati al confine e controlla le azioni rischiose; attribuisci la spesa fino ad agente, Skill e strumento e applica i budget; mantieni una traccia dalla persona al risultato; verifica, versiona, pubblica, monitora e ripristina ogni modifica delle policy.

      IdentitàAgenteSkillStrumentoChiamata MCPAPIModelloRisultato
      Avvia un progetto pilota controllato sulla tua infrastruttura. ShieldON è pronto e ti accompagniamo nella configurazione.

      Self-hosted · Docker Compose · Documentazione inclusa · Accedi su app.shieldon.ai