La gateway IA
et la protection des agents.
Deux choses, faites à fond. Une gateway par laquelle passe chaque appel de modèle. Et la protection des agents : ce qu'un agent peut appeler, et qui valide.
Le jour où l'IA cesse de répondre et se met à agir.
Jusqu'ici, le pire était une mauvaise réponse. Un agent, lui, requête une base, envoie un mail, déclenche un paiement. Helios décide ce qu'il a le droit de faire.
Un ticket, une page web ou un PDF piégé, que votre agent va lire. Le prompt est propre ; la sortie de l'outil ne l'est pas.
Un agent support qui accède à la base RH. Le périmètre dérive à chaque serveur MCP branché, sans que personne ne le décide.
Un agent en boucle consomme un budget trimestriel en une nuit. Ni votre APM ni votre WAF ne le voient.
De l'autonomie, oui.
Sans chèque en blanc.
Chaque appel d'outil est évalué avant exécution : qui le demande, sur quel serveur, pour quelle conséquence.
- ✓ Inventaire MCP : chaque outil déclaré, signé et révocable en un clic.
- ✓ Périmètre par agent : l'agent support lit Zendesk, et rien d'autre.
- ✓ Retours d'outils inspectés : traités comme une entrée hostile.
- ✓ Validation humaine : sur l'irréversible, l'agent prépare, un humain signe.
- ✓ Plafonds par run : tokens, étapes, durée. Au-delà, arrêt et alerte SIEM.
Deux produits, pas un catalogue.
Une gateway pour tout ce qui appelle un modèle, une protection pour tout ce qui agit. Le reste, vos outils le font déjà.
La gateway
Un seul point de passage : tout ce qui entre est inspecté, tout ce qui sort est journalisé.
Une seule API pour Mistral, Anthropic, Azure, Bedrock, vLLM, Ollama… avec routing, fallback et cache. Chaque modèle est scanné avant d'entrer au catalogue.
50+ règles en ligne : PII, IBAN, secrets, jailbreak, injection. Sur le prompt comme sur les retours d'outils.
Traces, latence et coût par équipe ou par cas d'usage, sans collecte externe.
La protection des agents
Un agent appelle des outils et écrit dans vos systèmes. C'est ce périmètre que nous contraignons.
Inventaire, signature, sandbox réseau et révocation centralisée des serveurs MCP exposés à vos agents.
La trace complète de chaque run, avec plafonds d'étapes, de durée et de coût. Arrêt immédiat au dépassement.
Virement, suppression, envoi externe : l'agent prépare, un humain nommé valide. Double signature possible.
Chaque agent a son identité et ses secrets à durée courte, jamais la clé d'un salarié. Révocable instantanément.
Les questions qu’on nous pose en comité d’architecture.
Ce que fait la gateway quand elle tombe, ce qu’elle coûte quand elle tient, et qui l’opère.
Fail-closed par défaut.
Si la gateway ne peut pas arbitrer ou journaliser un appel, l’appel ne part pas. Une équipe peut passer son périmètre en fail-open ; c’est alors signalé tant que dure la bascule.
Seule exception, non réglable : les actions irréversibles restent fail-closed, toujours.
Trois postes, et un chiffre que nous ne publierons pas.
Trois sources de surcoût : la politique, les guardrails en ligne, l’écriture du journal. Le streaming n’est pas mis en tampon, et un appel servi par le cache est plus rapide qu’en direct.
Pas de millisecondes sur cette page : nous mesurons le surcoût sur votre trafic pendant l’évaluation, et ce chiffre-là est contractualisable.
Trois, et vous choisissez qui opère.
- SaaS souverain Nous opérons, en Europe, et en France pour les périmètres régulés.
- Cloud privé dédié Nous opérons une instance rien qu'à vous, dans la région de votre choix.
- Votre infrastructure Vous opérez une stack conteneurisée. Nous n'y avons aucun accès, et rien ne nous remonte.
Tout ce que vos équipes mettent réellement en production.
Du premier assistant au premier agent autonome : un seul point de contrôle.
Le ChatGPT interne que la direction réclame et que le RSSI refuse : PII masquées, modèles choisis par population, une facture par équipe.
Le corpus n'est pas recopié hors de votre VPC. Chaque réponse est tracée jusqu'aux documents qui l'ont produite.
Contrats, factures, sinistres : à ce volume, le coût unitaire décide. Cache, et routing vers le modèle le moins cher qui tient la qualité.
Du volume et des données personnelles : masquage systématique, rétention courte, journal opposable.
Claude Code, Cursor ou Copilot sur vos dépôts : une clé qui expire par développeur, les dépôts sensibles hors périmètre.
Ici, l'IA ne répond plus, elle agit : périmètre par agent, validation humaine sur l'irréversible.
Une seule intégration.
Tous vos modèles, tous vos outils, toutes vos règles.
Helios parle l'API OpenAI standard. Branchez votre code une fois, puis passez de Mistral à Claude ou à un vLLM on-premise sans changer une ligne.
- ✓ Compatible OpenAI : remplacez
api.openai.comparapi.helios-security.aiet c'est terminé. - ✓ Modèles unifiés : Mistral, Anthropic, Azure, AWS Bedrock, vLLM, Ollama, Qwen, DeepSeek.
- ✓ Outils MCP déclarés : l'agent ne voit que le périmètre que vous lui accordez.
Documentation complète remise au lancement de l'évaluation.
# 3 lignes pour passer votre stack, agents compris, sous Helios import os import helios from openai import OpenAI client = OpenAI( base_url="https://api.helios-security.ai/v1", api_key=os.environ["HELIOS_KEY"], default_headers={"x-helios-policy": "finance-strict"}, ) response = client.chat.completions.create( model="mistral-large-latest", # ou claude, gpt-4o… messages=[{"role": "user", "content": prompt}], tools=helios.mcp("zendesk-ro", "crm-lecture"), metadata={"agent_id": "support-fr-02"}, ) # → Helios : PII, policy, arbitrage des outils, route, audit
Reprenez la main sur votre dépense IA.
Qui consomme quel modèle, quel agent appelle quel outil, pour quel coût. Le DSI et le DPO partagent enfin la même vue.
Plafond souple ou strict, alerte à 80 %, blocage au dépassement.
Les juniors n'accèdent pas aux modèles à 3 €/Mtok.
Chaque appel et chaque action signés, exportables vers Splunk, Elastic ou Sekoia.
Finance, RH, Juridique, R&D : chacun ses guardrails et ses modèles.
Où tournent vos données, et qui peut les lire.
Nous n'avons pas d'accès opérateur à vos données. Un accès n'existe qu'en réponse à incident, avec votre accord explicite, et il est lui-même journalisé.
Europe, et France pour les périmètres régulés, journaux d’audit compris. En SaaS souverain, en cloud privé dédié ou sur votre infrastructure.
Ni télémétrie produit, ni collecte d'usage, ni entraînement sur vos prompts, dans les trois modes de déploiement.
Chaque appel et chaque action d'agent, en écriture seule, horodatés et exportables vers votre SIEM.
Un modèle local (vLLM, Ollama) garde vos prompts chez vous. Un modèle distant les reçoit forcément ; seuls les fournisseurs que vous configurez sont appelés.
Pas de logo de certification sur cette page : Helios Security n'est certifié ni ISO 27001, ni HDS, ni SecNumCloud à ce jour. La qualification SecNumCloud porte sur nos environnements d'hébergement, pas sur nous. RGPD, EU AI Act, DORA et NIS2 guident l'architecture : ce sont des choix de conception, pas des attestations de tiers.
Vous avez déjà eu cette conversation. J’étais de l’autre côté de la table.
Dix ans d’avant-vente en cybersécurité, chez les éditeurs qui équipent déjà votre SOC : Sophos, Trend Micro, VMware Carbon Black, Varonis.
Votre processus d’achat et vos objections d’architecture, je les ai entendus avant de les écrire dans un produit.
Vérifier sur LinkedIn →Vous payez la gateway, pas vos tokens.
Aucun pourcentage sur votre consommation : notre facture ne monte pas avec votre usage. Le prix dépend du périmètre et de l'hébergement, et se fixe après un cadrage.
Un cas d'usage, sur votre trafic, pendant quelques semaines.
- Gateway sur un périmètre
- Guardrails standard
- Journal d'audit complet
- Mesure de latence sur votre trafic
- Accompagnement ingénieur
Le pilier 1 en production : tout ce qui appelle un modèle passe par là.
- Modèles & volumes sans plafond
- Guardrails · PII · prompt-injection
- SSO/SAML · RBAC · budgets
- Observabilité & coûts par équipe
- Fail-closed réglable par périmètre
- Export SIEM
Les deux piliers, pour des agents qui écrivent dans vos systèmes métier.
- Tout le périmètre Gateway
- Contrôle MCP & identité d'agent
- Approbation d'actions & double signature
- Trace de run & kill-switch
- Cloud privé dédié ou votre infrastructure
- Astreinte et engagement de service négociés
Mettez-nous sur le chemin d’un seul cas d’usage.
Un périmètre, votre trafic réel, quelques semaines. Vous repartez avec la latence mesurée chez vous et un journal lisible par votre RSSI, que vous signiez ou non.