GATEWAY DE IA EMPRESARIAL · CONTROLO DE GOVERNANÇA · AUTOALOJADO
A sua empresa precisa de IA. A sua IA precisa do ShieldON.
À medida que os modelos se multiplicam, os agentes começam a agir e a IA se liga a mais sistemas empresariais, a governança deixa de ser opcional. O ShieldON proporciona total transparência para manter os riscos, os custos e os acessos sob controlo à medida que a IA cresce.
Consola de demonstração: visão geral das métricas e tabela dos pedidos recentes. Dados estáticos apenas para apresentação.
Arquitetura
Cada aplicação e cada agente de um lado. Cada modelo do outro. O ShieldON no meio.
As aplicações, os agentes e as ferramentas dentro da empresa acedem a modelos na cloud e a modelos locais através do ShieldON. Os dados sensíveis são ocultados antes de saírem, cada pedido segue para o modelo mais adequado, cada chamada fica no registo e o seu próprio agente de IA pode alterar a política.
Dentro da fronteira da empresa, aplicações, agentes, ferramentas e assistentes chamam modelos na cloud e modelos locais através do Gateway de IA ShieldON, e as respostas regressam pelo mesmo caminho. Os controlos de segurança ocultam os dados sensíveis antes de um pedido sair; o encaminhamento envia os pedidos simples para modelos locais e os complexos para os modelos mais avançados, com alternativas em caso de falha; cada pedido é registado com a sua chave, rota e tokens; a utilização gera sugestões de poupança de tokens; e o agente de IA da própria empresa lê a utilização, define a política e publica uma versão através da API.
INTEGRAÇÕES LLM
Ligue um fornecedor uma vez. Alterne, combine e responda a falhas sem modificar o código da aplicação.
OpenAI, Anthropic, Gemini, Bedrock, Alibaba Cloud Bailian, DeepSeek e mais trinta fornecedores atrás do mesmo endpoint compatível com OpenAI. As chaves são guardadas cifradas no ShieldON e partilhadas apenas com os espaços escolhidos. As aplicações veem somente uma chave ShieldON. Chat, Responses, Embeddings, Images e Audio são suportados conforme o modelo.
- OpenAI
- Azure OpenAI
- Microsoft Foundry
- GitHub Models
- Anthropic
- Google Gemini / Vertex AI
- AWS Bedrock
- Alibaba Cloud Bailian
- Zhipu AI
- DeepSeek
- Moonshot AI
- MiniMax
- Groq
- Together AI
- Fireworks AI
- OpenRouter
- xAI
- Perplexity
- Cerebras
- DeepInfra
- Nebius
- SambaNova
- SiliconFlow
- Novita AI
- Jina AI
- Voyage AI
- Cloudflare Workers AI
- Hugging Face
- Ollama
- vLLM
- LocalAI
- Databricks
- Compatível com OpenAI genérico
- OpenAI
- Azure OpenAI
- Microsoft Foundry
- GitHub Models
- Anthropic
- Google Gemini / Vertex AI
- AWS Bedrock
- Alibaba Cloud Bailian
- Zhipu AI
- DeepSeek
- Moonshot AI
- MiniMax
- Groq
- Together AI
- Fireworks AI
- OpenRouter
- xAI
- Perplexity
- Cerebras
- DeepInfra
- Nebius
- SambaNova
- SiliconFlow
- Novita AI
- Jina AI
- Voyage AI
- Cloudflare Workers AI
- Hugging Face
- Ollama
- vLLM
- LocalAI
- Databricks
- Compatível com OpenAI genérico
01 · QUEM CHAMA A API?
Identifique a aplicação, a equipa e o ambiente de cada chamada antes de chegar a um modelo.
Cada aplicação recebe uma chave API do gateway com regras para modelos permitidos, contexto obrigatório e redes autorizadas. Pode rodá-la sem interrupções. A chave do fornecedor nunca sai do ShieldON.
Exemplos de respostas do gateway
Consola de demonstração: a chave billing-assistant recebe quatro variáveis de metadados e acesso limitado a 203.0.113.0/24. Um pedido de outro endereço é rejeitado.
Criar chave API do gateway
Dê um nome à chave e defina o que pode chamar. A aplicação recebe um segredo próprio; as credenciais do fornecedor permanecem sob o seu controlo.
Faça com que cada pedido se identifique
Defina o que cada chamada deve declarar: aplicação, ambiente, equipa, projeto, cliente, utilizador, funcionalidade ou sessão. O ShieldON rejeita chamadas incompletas. Os mesmos campos permitem atribuir custos posteriormente.
Apenas a partir das redes previstas
Restrinja a chave aos seus intervalos de rede. Chamadas de outras redes são rejeitadas antes de chegarem a um modelo.
Organizações e espaços de trabalho separam departamentos, produtos e ambientes, cada um com membros e funções próprios.
02 · QUE INFORMAÇÕES SÃO ENVIADAS AO LLM?
Números de cartões, documentos de identificação e chaves API ficam na fronteira. Os prompts nunca são guardados por predefinição.
Uma fronteira de segurança para todas as aplicações. O ShieldON verifica entradas e saídas, deteta dados pessoais e credenciais e sinaliza ou bloqueia a chamada conforme a sua política. Regista apenas a decisão, nunca o conteúdo detetado. Por predefinição, não guarda prompts, saídas ou embeddings.
- Dados pessoais: endereços de email, telefones, documentos de identificação, cartões de pagamento e números da segurança social dos EUA
- Segredos: chaves privadas, tokens de sessão, credenciais de cloud e SaaS, palavras-passe coladas em prompts
- Regras próprias: palavras-chave, expressões regulares, listas de chamadas a ferramentas permitidas ou o seu serviço de políticas através de webhook protegido
- Comece em modo Monitor para verificar o que seria detetado. Passe a Block quando estiver confiante.
Consola de demonstração: o perfil de proteção bloqueia um pedido com um cartão de pagamento; um segundo passa. O registo de atividade guarda apenas o código do motivo.
Bloqueado antes de chegar ao fornecedor. O ShieldON rejeita o pedido em vez de o reescrever silenciosamente e regista apenas o motivo, nunca o valor detetado.
PRIVACIDADE POR PREDEFINIÇÃO
- Texto do prompt
- Saída do modelo
- Argumentos de ferramentas
- Corpos dos webhooks
- Vetores de embeddings
Precisa de guardar conteúdo temporariamente para diagnosticar um problema? É necessária uma política explícita acordada separadamente: cifragem em repouso e auditoria de cada consulta.
Consola de demonstração: Detalhes do pedido req_48e5aa — Modelo lógico shieldon-chat, ID do fornecedor openai-prod, Estado Succeeded, Latência 812 ms. Conteúdo capturado: A captura de conteúdo estava desativada ou não foi conservado conteúdo deste pedido.
03 · COMO DEVE SER CONTROLADO O COMPORTAMENTO?
Mude de fornecedor, limite despesas e reverta em minutos. Sem alterar código ou aplicar correções urgentes.
As aplicações chamam um nome de modelo estável; decide o que está por trás: um fornecedor, uma alternativa em caso de falha, distribuição ponderada ou seleção por regras. Limites e orçamentos são aplicados antes de chamar o fornecedor. Cada alteração é ativada como uma versão revista e reversível com um clique.
Consola de demonstração: uma rota alternativa resolve um 429; uma política bloqueia a 600 RPM; um orçamento bloqueia no limite e é ajustado; uma versão é publicada e revertida.
Exemplo de tentativas de rota · req_9b21c4
- tentativa 1 · @openai-prod/gpt-4.1
Uma alternativa invisível para quem chama
Se o fornecedor principal limitar a frequência ou exceder o tempo de resposta, o ShieldON tenta novamente e passa ao destino aprovado seguinte. A aplicação recebe uma resposta bem-sucedida e um único identificador de pedido, sem tratamento adicional de erros ou nova implementação.
Teste a alternância em caso de falha com os seus fornecedores e modelos antes de depender dela.
Limites por modelo, com um plano para falhas
Limite pedidos, tokens e chamadas simultâneas por modelo. Se o limitador estiver indisponível, já terá decidido se dá prioridade à segurança ou à disponibilidade.
Orçamentos de créditos que realmente param chamadas
Defina orçamentos diários, semanais ou mensais por espaço ou chave de aplicação, no seu fuso horário. Quando se esgotam, pare as chamadas ou emita um aviso: a escolha é sua. Cada reforço é registado, impedindo aumentos silenciosos do limite.
Cada alteração revista. Cada versão reversível.
Valide o rascunho, compare exatamente o que irá mudar, aprove e publique. Se surgir um problema, regresse à última versão funcional com um clique. O gateway executa apenas versões publicadas.
04 · COMO PODE O SISTEMA MELHORAR AO LONGO DO TEMPO?
Cada chamada tem um responsável. Cada custo tem uma origem. Cada alteração tem um autor.
O ShieldON mantém dois registos: utilização e custo de cada pedido, e auditoria de cada alteração ao plano de controlo. Hoje mostram que aplicação, equipa ou cliente gera a despesa mensal. Também sustentam o ciclo de melhoria com aprovação humana previsto no nosso plano de desenvolvimento.
Atribua custos por aplicação, equipa ou cliente, sem folhas de cálculo.
Cada pedido inclui o contexto exigido: aplicação, ambiente, equipa, projeto, cliente, utilizador, funcionalidade e sessão. O ShieldON regista também tokens, modelo efetivamente usado, novas tentativas e erros, permitindo decompor custos conforme as necessidades financeiras. Os preços de imagem e áudio ainda não estão totalmente normalizados entre fornecedores.
- application
- environment
- team
- project
- customer
- user
- feature
- session_id
curl "https://gateway.example.com/v1/chat/completions" \ -H "Authorization: Bearer $SHIELDON_GATEWAY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "shieldon-chat", "messages": [{"role":"user","content":"Hello"}], "metadata": { "application": "support-bot", "environment": "production" } }'Esta linha contém tudo o que o ShieldON guardou: quem, quanto, que rota e que custo. Nenhum prompt.
Um registo de alterações que ninguém pode editar.
Quem criou, alterou, publicou, reverteu ou rodou o quê, quando e de onde. Cada entrada é permanente; a análise de incidentes começa com factos.
- Observar a utilização
- Identificar padrões
- Propor melhorias
- Validar e avaliar
- AprovarAprovação humana necessária
- Publicar
- Medir resultados
Consola de demonstração: os metadados do pedido ficam no registo de utilização; a auditoria mostra publicações, rotações, reversões e atualizações.
PERCURSO DOS PEDIDOS
Cada chamada segue o mesmo caminho. Cada passo permite definir uma política.
Autenticar, verificar remetente, carregar políticas publicadas, inspecionar entrada, escolher rota, verificar limites e orçamento, chamar fornecedor, usar alternativa se necessário, inspecionar saída, medir custos e registar auditoria. Nenhuma etapa é omitida. Os capítulos anteriores seguem esta ordem.
- Entrada
- ID do pedidoCapítulo 04, Como melhora o sistema?
- Autenticação da chave API do gatewayCapítulo 01, Quem chama a API?
- Autorização da organização/espaçoCapítulo 01, Quem chama a API?
- Snapshot das políticas publicadasCapítulo 03, Como é controlado o comportamento?
- Adaptador API
- Controlos de segurança (entrada)Capítulo 02, Que dados são enviados?
- Encaminhador→ @openai-prod/gpt-4.1Capítulo 03, Como é controlado o comportamento?
- Pré-verificação: taxa/tokens/concorrência/orçamentoCapítulo 03, Como é controlado o comportamento?
- Adaptador do fornecedor
- Nova tentativa/alternativa429 → @bailian/qwen-maxCapítulo 03, Como é controlado o comportamento?
- Normalização do fluxo
- Controlos de segurança (saída)Capítulo 02, Que dados são enviados?
- Medição de utilização e custosCapítulo 04, Como melhora o sistema?
- Registos assíncronos de utilização / auditoriaCapítulo 04, Como melhora o sistema?
- Resposta
A QUEM SE DESTINA
Para as equipas responsáveis pela IA em produção.
UM PROJETO-PILOTO NO SEU AMBIENTE
Da chave do fornecedor à primeira chamada governada em cinco passos, num servidor Linux.
A configuração rápida orienta-o numa página: ligar fornecedor, criar chave da aplicação, publicar, efetuar uma chamada de teste real e integrar. Depois, disponibilize um único endpoint às equipas.
curl "https://gateway.example.com/v1/chat/completions" \ -H "Authorization: Bearer $SHIELDON_GATEWAY_API_KEY" \ -H "Content-Type: application/json" \ -d '{"model":"shieldon-chat","messages":[{"role":"user","content":"Hello"}],"metadata":{"application":"support-bot","environment":"production"}}'As aplicações utilizam apenas esta chave. A chave do fornecedor permanece dentro do ShieldON.
Um servidor Linux · Docker Compose. Nginx connects to Gateway (Go), Plano de controlo (Go), Consola web + Documentação. Gateway (Go) connects to PostgreSQL, Redis. Plano de controlo (Go) connects to PostgreSQL, Redis, Armazenamento compatível com S3 (opcional).
Tudo funciona no seu ambiente: um ponto de acesso, poucos contentores, PostgreSQL e Redis padrão e armazenamento de objetos opcional. Inclui imagens para várias arquiteturas e um pacote de instalação offline.
PARA ALÉM DO MODELO
Governe também as capacidades dos agentes, além dos modelos que chamam.
Codex, Claude Code, OpenClaw e os agentes das suas equipas acabarão por precisar de um gateway comum. Queremos governar tudo o que utilizam: Skills, ferramentas, servidores MCP, fluxos CLI e APIs. Com as mesmas quatro perguntas: é seguro, quanto custa, conseguimos observar e melhora com o tempo?
1. Base de governança
Conheça os seus recursos: um modelo de identidade e um inventário de agentes, Skills, ferramentas, servidores MCP e APIs, com responsáveis, classificação de dados e auditoria.
2. Políticas e controlo
Defina regras: políticas de segurança e controlos de despesa para todos os agentes, com aprovações, restrições de capacidades e gestão de versões.
3. Melhoria contínua
Melhore com intenção: recomendações sobre prompts, políticas, Skills e casos de utilização, derivadas de uso real, avaliadas e introduzidas sob controlo.
4. Camada operacional empresarial
Gira a IA como o resto da empresa: descubra e registe agentes fora do controlo das TI, integre mais ambientes de execução, amplie opções de implementação e responda às necessidades prioritárias dos clientes.
Segurança
Saiba o que atravessa a fronteira dos modelos e ferramentas, mantenha segredos e dados pessoais no interior e exija aprovação para ações de alto risco.
Finanças / FinOps
Atribua cada custo a pessoa, equipa, aplicação, agente, Skill, ferramenta, modelo e fornecedor. Aplique orçamentos e detete anomalias cedo.
Visibilidade / Observabilidade
Um percurso contínuo da pessoa ao resultado: agente, Skill, ferramentas, servidores MCP, APIs, modelos e políticas aplicadas.
RSI
A utilização real sugere melhores prompts, políticas e casos de utilização. Cada proposta é versionada, avaliada e aprovada por uma pessoa.
Autoalojado · Docker Compose · Documentação incluída · Acesso em app.shieldon.ai