BRAMA AI DLA FIRM · CENTRALNY NADZÓR · WE WŁASNYM ŚRODOWISKU
Twoja firma potrzebuje AI. Twoja AI potrzebuje ShieldON.
Modele się mnożą, agenci zaczynają działać, a AI łączy się z kolejnymi systemami biznesowymi. Nadzór przestaje być opcjonalny. ShieldON zapewnia pełną przejrzystość, aby ryzyko, koszty i dostęp pozostawały pod kontrolą wraz z rozwojem AI.
Konsola demonstracyjna: przegląd metryk oraz tabela ostatnich żądań. Statyczne dane wyłącznie do prezentacji.
Architektura
Każda aplikacja i każdy agent po jednej stronie. Każdy model po drugiej. Pomiędzy nimi ShieldON.
Aplikacje, agenci i narzędzia wewnątrz firmy łączą się z modelami w chmurze i modelami lokalnymi przez ShieldON. Dane wrażliwe są ukrywane, zanim opuszczą firmę, każde żądanie trafia do modelu, który do niego pasuje, każde wywołanie jest zapisywane w rejestrze, a Twój własny agent AI może zmieniać politykę.
Aplikacje, agenci, narzędzia i asystenci wewnątrz granicy firmy wywołują modele w chmurze i modele lokalne przez bramę AI ShieldON, a odpowiedzi wracają tą samą drogą. Reguły bezpieczeństwa ukrywają dane wrażliwe, zanim żądanie opuści firmę; routing kieruje proste żądania do modeli lokalnych, a złożone do najbardziej zaawansowanych modeli, z przełączeniem awaryjnym; każde żądanie jest zapisywane wraz z kluczem, trasą i tokenami; na podstawie użycia powstają sugestie oszczędności tokenów; a własny agent AI firmy odczytuje użycie, ustala politykę i publikuje wydanie przez API.
INTEGRACJE LLM
Połącz dostawcę raz. Przełączaj, łącz i obsługuj awarie bez zmiany kodu aplikacji.
OpenAI, Anthropic, Gemini, Bedrock, Alibaba Cloud Bailian, DeepSeek i trzydziestu kolejnych dostawców za jednym punktem dostępu zgodnym z OpenAI. Klucze dostawców są szyfrowane w ShieldON i udostępniane tylko wybranym obszarom roboczym. Aplikacje widzą wyłącznie klucz ShieldON. Obsługa Chat, Responses, Embeddings, Images i Audio zależy od modelu.
- OpenAI
- Azure OpenAI
- Microsoft Foundry
- GitHub Models
- Anthropic
- Google Gemini / Vertex AI
- AWS Bedrock
- Alibaba Cloud Bailian
- Zhipu AI
- DeepSeek
- Moonshot AI
- MiniMax
- Groq
- Together AI
- Fireworks AI
- OpenRouter
- xAI
- Perplexity
- Cerebras
- DeepInfra
- Nebius
- SambaNova
- SiliconFlow
- Novita AI
- Jina AI
- Voyage AI
- Cloudflare Workers AI
- Hugging Face
- Ollama
- vLLM
- LocalAI
- Databricks
- Ogólna zgodność z OpenAI
- OpenAI
- Azure OpenAI
- Microsoft Foundry
- GitHub Models
- Anthropic
- Google Gemini / Vertex AI
- AWS Bedrock
- Alibaba Cloud Bailian
- Zhipu AI
- DeepSeek
- Moonshot AI
- MiniMax
- Groq
- Together AI
- Fireworks AI
- OpenRouter
- xAI
- Perplexity
- Cerebras
- DeepInfra
- Nebius
- SambaNova
- SiliconFlow
- Novita AI
- Jina AI
- Voyage AI
- Cloudflare Workers AI
- Hugging Face
- Ollama
- vLLM
- LocalAI
- Databricks
- Ogólna zgodność z OpenAI
01 · KTO WYWOŁUJE API?
Poznaj aplikację, zespół i środowisko każdego wywołania, zanim dotrze do modelu.
Każda aplikacja otrzymuje własny klucz API bramy z zasadami dotyczącymi dozwolonych modeli, wymaganego kontekstu i sieci. Rotuj go bez przestojów. Klucz dostawcy nigdy nie opuszcza ShieldON.
Przykładowe odpowiedzi bramy
Konsola demonstracyjna: klucz billing-assistant otrzymuje cztery zmienne metadanych i ograniczenie do 203.0.113.0/24. Żądanie z innego adresu zostaje odrzucone.
Utwórz klucz API bramy
Nazwij klucz i określ, co może wywoływać. Aplikacja otrzymuje osobny sekret; dane uwierzytelniające dostawcy pozostają pod Twoją kontrolą.
Każde żądanie musi się zidentyfikować
Określ wymagane informacje: aplikacja, środowisko, zespół, projekt, klient, użytkownik, funkcja lub sesja. ShieldON odrzuca niepełne wywołania. Te same pola służą później do przypisywania kosztów.
Tylko z oczekiwanych sieci
Ogranicz klucz do własnych zakresów sieciowych. Wywołania z innych sieci zostaną odrzucone przed dotarciem do modelu.
Organizacje i obszary robocze oddzielają działy, produkty i środowiska. Każdy ma własnych członków i role.
02 · JAKIE INFORMACJE TRAFIAJĄ DO LLM?
Numery kart, dokumentów i klucze API zatrzymują się na granicy. Prompty domyślnie nigdy nie są zapisywane.
Jedna granica bezpieczeństwa dla wszystkich aplikacji. ShieldON sprawdza wejście i wyjście, wykrywa dane osobowe i uwierzytelniające, a następnie oznacza lub blokuje wywołanie zgodnie z polityką. Zapisuje tylko decyzję, nigdy wykrytą treść. Domyślnie nie przechowuje promptów, wyników ani embeddingów.
- Dane osobowe: adresy e-mail, telefony, numery dokumentów, kart płatniczych i amerykańskie numery ubezpieczenia społecznego
- Sekrety: klucze prywatne, tokeny sesji, dane uwierzytelniające chmury i SaaS, hasła wklejone do promptów
- Własne reguły: słowa kluczowe, wyrażenia regularne, listy dozwolonych wywołań narzędzi lub własna usługa polityk przez zabezpieczony webhook
- Zacznij od trybu Monitor, aby sprawdzić wykrywanie. Gdy nabierzesz pewności, przejdź do trybu Block.
Konsola demonstracyjna: profil ochrony blokuje żądanie z numerem karty płatniczej, a drugie przepuszcza. Rejestr aktywności zapisuje tylko kod przyczyny.
Blokada przed dotarciem do dostawcy. ShieldON odrzuca żądanie zamiast potajemnie je przepisywać. Zapisuje wyłącznie powód, nigdy wykrytą wartość.
PRYWATNOŚĆ DOMYŚLNIE
- Tekst promptu
- Wynik modelu
- Argumenty narzędzi
- Treść webhooków
- Wektory embeddingów
Potrzebujesz na krótko zachować treść do diagnostyki? Wymaga to wyraźnej, odrębnie uzgodnionej polityki: szyfrowania przechowywanych danych i audytu każdego odczytu.
Konsola demonstracyjna: Szczegóły żądania req_48e5aa — Model logiczny shieldon-chat, Identyfikator dostawcy openai-prod, Stan Succeeded, Opóźnienie 812 ms. Przechwycone dane: Przechwytywanie treści było wyłączone lub dla tego żądania nie zachowano danych.
03 · JAK NALEŻY KONTROLOWAĆ ZACHOWANIE?
Zmieniaj dostawców, ograniczaj koszty i wycofuj zmiany w kilka minut. Bez zmiany kodu i pilnych poprawek.
Aplikacje wywołują stałą nazwę modelu; Ty wybierasz, co za nią stoi: jednego dostawcę, dostawcę awaryjnego, podział według wag lub reguły wyboru. Limity i budżety są sprawdzane przed wywołaniem dostawcy. Każda zmiana trafia do działania jako sprawdzone wydanie, które można wycofać jednym kliknięciem.
Konsola demonstracyjna: trasa awaryjna obsługuje 429; polityka blokuje przy 600 RPM; budżet blokuje po wyczerpaniu i jest korygowany; wydanie zostaje opublikowane i wycofane.
Przykładowe próby routingu · req_9b21c4
- próba 1 · @openai-prod/gpt-4.1
Przełączenie awaryjne niewidoczne dla aplikacji
Gdy główny dostawca ogranicza częstotliwość lub przekracza czas odpowiedzi, ShieldON ponawia wywołanie i przechodzi do kolejnego zatwierdzonego celu. Aplikacja otrzymuje poprawną odpowiedź i jeden identyfikator żądania, bez dodatkowej obsługi błędów i ponownego wdrożenia.
Przetestuj przełączanie awaryjne z własnymi dostawcami i modelami, zanim na nim polegniesz.
Limity na model, z planem na awarie
Ogranicz żądania, tokeny i równoczesne wywołania dla każdego modelu. Jeśli kontrola limitów będzie niedostępna, priorytet bezpieczeństwa lub dostępności będzie już ustalony.
Budżety kredytów, które naprawdę zatrzymują wywołania
Ustal budżet na dzień, tydzień lub miesiąc dla obszaru roboczego albo klucza aplikacji, we własnej strefie czasowej. Po wyczerpaniu zatrzymaj wywołania lub wyświetl ostrzeżenie. Każde doładowanie jest rejestrowane, więc nikt nie podniesie limitu po cichu.
Każda zmiana sprawdzona. Każde wydanie odwracalne.
Zweryfikuj szkic, porównaj go z aktywną wersją, zatwierdź i opublikuj. Jeśli pojawi się problem, jednym kliknięciem wróć do ostatniego poprawnego wydania. Brama używa wyłącznie opublikowanych wydań.
04 · JAK SYSTEM MOŻE DOSKONALIĆ SIĘ Z CZASEM?
Każde wywołanie ma właściciela. Każdy koszt ma źródło. Każda zmiana ma autora.
ShieldON prowadzi dwa rejestry: użycie i koszt każdego żądania oraz audyt zmian warstwy sterowania. Już dziś pokazują, która aplikacja, zespół lub klient generuje miesięczne wydatki. Stanowią też podstawę planowanego cyklu doskonalenia zatwierdzanego przez człowieka.
Przypisuj koszty aplikacjom, zespołom i klientom bez arkuszy kalkulacyjnych.
Każde żądanie zawiera wymagany kontekst: aplikację, środowisko, zespół, projekt, klienta, użytkownika, funkcję i sesję. ShieldON zapisuje go wraz z tokenami, faktycznym modelem, ponowieniami i błędami, umożliwiając dowolny podział kosztów. Ceny obrazów i dźwięku nie są jeszcze w pełni ujednolicone między dostawcami.
- application
- environment
- team
- project
- customer
- user
- feature
- session_id
curl "https://gateway.example.com/v1/chat/completions" \ -H "Authorization: Bearer $SHIELDON_GATEWAY_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "shieldon-chat", "messages": [{"role":"user","content":"Hello"}], "metadata": { "application": "support-bot", "environment": "production" } }'Ten wiersz zawiera wszystko, co zachował ShieldON: kto, ile, jaka trasa i koszt. Bez promptu.
Dziennik zmian, którego nikt nie może edytować.
Kto co utworzył, zmienił, opublikował, wycofał lub zrotował, kiedy i skąd. Każdy wpis jest trwały, więc analiza incydentu zaczyna się od faktów.
- Obserwuj użycie
- Rozpoznaj wzorce
- Zaproponuj usprawnienia
- Zweryfikuj i oceń
- ZatwierdźWymagana akceptacja człowieka
- Opublikuj
- Zmierz wyniki
Konsola demonstracyjna: metadane żądania trafiają do rejestru użycia; audyt pokazuje publikacje, rotacje, przywrócenia i aktualizacje.
PRZEBIEG ŻĄDANIA
Każde wywołanie przechodzi tę samą drogę. Na każdym etapie możesz ustalić politykę.
Uwierzytelnienie, sprawdzenie nadawcy, wczytanie opublikowanych polityk, kontrola wejścia, wybór trasy, sprawdzenie limitów i budżetu, wywołanie dostawcy, ewentualne przełączenie, kontrola wyjścia, pomiar kosztów i audyt. Żaden etap nie jest pomijany. Wcześniejsze rozdziały odpowiadają tej kolejności.
- Wejście
- Identyfikator żądaniaRozdział 04, Jak system się doskonali?
- Uwierzytelnianie kluczem API bramyRozdział 01, Kto wywołuje API?
- Autoryzacja organizacji/obszaru roboczegoRozdział 01, Kto wywołuje API?
- Migawka opublikowanych politykRozdział 03, Jak kontrolowane jest zachowanie?
- Adapter API
- Reguły bezpieczeństwa (wejście)Rozdział 02, Jakie dane są wysyłane?
- Router→ @openai-prod/gpt-4.1Rozdział 03, Jak kontrolowane jest zachowanie?
- Kontrola wstępna: tempo/tokeny/współbieżność/budżetRozdział 03, Jak kontrolowane jest zachowanie?
- Adapter dostawcy
- Ponowienie/przełączenie awaryjne429 → @bailian/qwen-maxRozdział 03, Jak kontrolowane jest zachowanie?
- Normalizacja strumienia
- Reguły bezpieczeństwa (wyjście)Rozdział 02, Jakie dane są wysyłane?
- Pomiar użycia i kosztówRozdział 04, Jak system się doskonali?
- Asynchroniczne logi użycia / audytRozdział 04, Jak system się doskonali?
- Odpowiedź
DLA KOGO
Dla zespołów odpowiedzialnych za AI w środowisku produkcyjnym.
PILOTAŻ W TWOIM ŚRODOWISKU
Od klucza dostawcy do pierwszego nadzorowanego wywołania w pięciu krokach, na jednym hoście Linux.
Szybka konfiguracja prowadzi na jednej stronie: połącz dostawcę, utwórz klucz aplikacji, opublikuj, wykonaj rzeczywiste wywołanie testowe i zintegruj. Następnie przekaż zespołom jeden punkt dostępu.
curl "https://gateway.example.com/v1/chat/completions" \ -H "Authorization: Bearer $SHIELDON_GATEWAY_API_KEY" \ -H "Content-Type: application/json" \ -d '{"model":"shieldon-chat","messages":[{"role":"user","content":"Hello"}],"metadata":{"application":"support-bot","environment":"production"}}'Aplikacje używają wyłącznie tego klucza. Klucz dostawcy pozostaje wewnątrz ShieldON.
Jeden host Linux · Docker Compose. Nginx connects to Brama (Go), Warstwa sterowania (Go), Konsola WWW + Dokumentacja. Brama (Go) connects to PostgreSQL, Redis. Warstwa sterowania (Go) connects to PostgreSQL, Redis, Pamięć zgodna z S3 (opcjonalna).
Wszystko działa w Twoim środowisku: jeden punkt wejścia, kilka kontenerów, standardowe PostgreSQL i Redis oraz opcjonalny magazyn obiektów. Dostarczane jako obrazy dla wielu architektur z pakietem instalacyjnym offline.
POZA SAMYM MODELEM
Zarządzaj również możliwościami agentów, a nie tylko wywoływanymi modelami.
Codex, Claude Code, OpenClaw i agenci Twoich zespołów docelowo będą potrzebować wspólnej bramy. Chcemy objąć nadzorem wszystko, czego używają: Skills, narzędzia, serwery MCP, procesy CLI i API. Według czterech pytań: czy to bezpieczne, ile kosztuje, czy to widzimy i czy z czasem staje się lepsze?
1. Podstawa nadzoru
Poznaj zasoby: jeden model tożsamości i inwentarz agentów, Skills, narzędzi, serwerów MCP i API, z właścicielami, klasyfikacją danych i audytem.
2. Polityki i kontrola
Ustal zasady: polityki bezpieczeństwa i kontroli wydatków dla wszystkich agentów, z akceptacjami, ograniczeniami możliwości i zarządzaniem wydaniami.
3. Ciągłe doskonalenie
Doskonal świadomie: rekomendacje promptów, polityk, Skills i zastosowań wynikające z realnego użycia, oceniane i wdrażane pod kontrolą.
4. Warstwa operacyjna przedsiębiorstwa
Zarządzaj AI jak resztą firmy: odkrywaj i rejestruj agentów spoza nadzoru IT, integruj kolejne środowiska wykonawcze, rozszerzaj opcje wdrożenia i odpowiadaj na kluczowe potrzeby klientów.
Bezpieczeństwo
Wiedz, co przekracza granice modeli i narzędzi. Zatrzymuj sekrety i dane osobowe wewnątrz oraz wymagaj zgody na działania wysokiego ryzyka.
Finanse / FinOps
Przypisuj każdy koszt osobie, zespołowi, aplikacji, agentowi, Skill, narzędziu, modelowi i dostawcy. Egzekwuj budżety i wcześnie wykrywaj anomalie.
Widoczność / Obserwowalność
Jeden ciągły ślad od człowieka do wyniku: agent, Skill, narzędzia, serwery MCP, API, modele i zastosowane polityki.
RSI
Rzeczywiste użycie podpowiada lepsze prompty, polityki i zastosowania. Każda sugestia jest wersjonowana, oceniana i zatwierdzana przez człowieka.
We własnym środowisku · Docker Compose · Dokumentacja w zestawie · Logowanie: app.shieldon.ai