Fonctionnalités
Tout ce que la passerelle fait pour vous
Un point d'accès unique vers tous vos modèles, avec une couche de sécurité activée par défaut, pas en option.
📡
Fonctionnalité clé
Un point d'accès, tous vos modèles
Vos équipes, scripts et agents parlent à une seule adresse compatible OpenAI. Derrière cette porte unique se trouvent vos modèles locaux (Ollama) et, si vous l'autorisez, des modèles cloud soigneusement choisis. Changer de modèle ? C'est une ligne dans la configuration ; aucun client ne s'en aperçoit.
🧭
Routage intelligent
Chaque requête va automatiquement au meilleur modèle : les questions de code vers votre modèle de code, la rédaction vers votre modèle de rédaction, le contenu sensible toujours en local.
- Tags explicites dans la requête elle-même ([[fast]], [[strong]], vos propres tags)
- Routes regex, modifiables dans l'UI & rechargées en direct
- Similarité sémantique via embeddings locaux
🎭
Pare-feu PII & masquage
Cartes de crédit, e-mails, téléphones, clés, mots de passe, IP publiques : tous détectés et masqués, dans le prompt comme dans les journaux.
- Motifs rusés : cartes avec espaces/tirets, Amex, clés API
- Détecteur de mots-clés pour contextes médical, bancaire et d'identité
- Les prompts système ne sont jamais modifiés
🚫
Blocage des injections
Les tentatives de jailbreak et les astuces « ignore all instructions » sont détectées et tenues hors du cloud, automatiquement, sans effort de votre part.
🔁
Bascule auto-réparatrice
Un modèle faiblit ou tombe ? La passerelle bascule automatiquement vers votre chaîne de secours, avec nouvelles tentatives et temporisations. Votre application ne s'en aperçoit pas.
- Chaînes de secours par modèle, définies par vous
- 2 tentatives par modèle, temporisation après erreurs répétées
📋
Journalisation d'audit complète
Journal en écriture seule de chaque appel : entrée & sortie masquées, modèle routé, raison du routage, latence et consommation de tokens, le tout corrélable via l'identifiant de requête.
🚨
SIEM intégré
Un moteur de détection qui surveille en direct les journaux LLM et d'authentification. Définissez vos propres cas d'usage avec un DSL de correspondance simple ; les alertes partent vers l'UI et vers votre webhook.
- Prêt à l'emploi : données sensibles vers le cloud (critique), rafales de connexion, modèles lents…
- Déclencheurs à seuil et événement unique, avec déduplication par temporisation
🔐
Authentification sans compromis
Authentification sans dépendance, construite dans les règles : hachage scrypt, sessions HMAC, 2FA TOTP en option, clés de service pour les agents, et verrouillage avec backoff exponentiel.
📊
Votre propre tableau de bord
Moniteur en direct, bac à sable pour tester les routes avant déploiement, tableau de bord de consommation, éditeur de règles avec test de classification : aucun service externe, tourne simplement chez vous.