Transparence de l’IA — Guarrix
Comment les systèmes de détection de Guarrix sont conçus pour fonctionner, et ce pour quoi ils ne sont pas conçus.
Guarrix est conçu comme une couche de détection automatisée qui inspecte les requêtes avant qu’elles n’atteignent votre fournisseur de LLM, et inspecte les réponses avant qu’elles n’atteignent vos utilisateurs. Guarrix est conçu pour identifier les données à caractère personnel, les tentatives d’injection d’invite et les schémas de jailbreak, puis appliquer l’action que vous configurez — rédaction, masquage ou blocage — ainsi que toute règle personnalisée que vous définissez pour votre locataire.
Guarrix ne prend aucune décision concernant des personnes. Guarrix ne profile pas les utilisateurs finaux, ne génère pas de contenu, et n’est pas conçu pour produire une décision automatisée ayant un effet juridique ou similairement significatif sur une personne. Guarrix ne s’entraîne pas sur le contenu de vos invites ou réponses — le contenu n’est jamais stocké.
Guarrix lui-même fonctionne comme une couche de détection et de filtrage pour votre compte, et non comme un système prenant des décisions autonomes affectant des personnes — Guarrix n’est pas, en soi, un système d’IA à haut risque au sens de l’annexe III du règlement européen sur l’IA. Le fait que votre propre utilisation du LLM choisi soit à haut risque dépend de la manière dont vous l’utilisez ; cette classification vous appartient, et non à Guarrix.
L’article 50 du règlement européen sur l’IA exige que les personnes soient informées lorsqu’elles interagissent avec un système d’IA, et que tout contenu généré ou manipulé par l’IA soit signalé comme tel. Guarrix ne génère pas de contenu affiché aux utilisateurs finaux — Guarrix inspecte et filtre un contenu déjà produit par votre propre application et votre fournisseur de LLM. Si votre propre produit utilise l’IA pour interagir directement avec des utilisateurs finaux, l’obligation d’information de l’article 50 envers ces utilisateurs finaux vous incombe, et non à Guarrix.
Le moteur de détection propre à Guarrix est encore en développement et n’est pas encore utilisé en production — cette page sera mise à jour avec les modèles de détection et fournisseurs précis une fois le service en ligne. Guarrix ne choisit pas quel fournisseur de LLM traite le trafic de vos clients ; vous configurez votre propre fournisseur (OpenAI, Anthropic, Mistral ou tout point de terminaison compatible OpenAI). Lorsque Guarrix utilise lui-même un grand modèle de langage en interne, il utilise Mistral, hébergé dans l’UE, pour les mêmes raisons de résidence des données que le reste de la plateforme Guarrix.
Guarrix est un système probabiliste. Des faux positifs (contenu signalé à tort) et des faux négatifs (contenu laissé passer à tort) sont possibles. La précision de la détection dépend des types d’entités et des règles configurés pour votre locataire. Guarrix n’est ni conçu ni validé pour un usage dans des domaines critiques pour la sécurité tels que le diagnostic médical, les décisions juridiques, ou tout contexte où une détection manquée pourrait causer un préjudice grave.
Les questions sur la conception des systèmes d’IA de Guarrix, ou les réclamations concernant le comportement de détection, peuvent être envoyées à hello@guarrix.com. Consultez notre politique de confidentialité pour savoir comment exercer vos droits RGPD, et nos conditions générales pour savoir comment les litiges sont traités.