AI-transparantie — Guarrix
Hoe de detectiesystemen van Guarrix zijn ontworpen om te werken, en wat ze niet zijn ontworpen om te doen.
Guarrix is ontworpen als een geautomatiseerde detectielaag die verzoeken controleert voordat ze uw LLM-provider bereiken, en antwoorden controleert voordat ze uw gebruikers bereiken. Guarrix is ontworpen om persoonsgegevens, prompt-injectiepogingen en jailbreak-patronen te herkennen, en om de actie toe te passen die u instelt — redigeren, maskeren of blokkeren — plus eventuele aangepaste regels die u voor uw tenant definieert.
Guarrix neemt geen beslissingen over personen. Guarrix profileert geen eindgebruikers, genereert geen inhoud en is niet ontworpen om geautomatiseerde besluiten te nemen met een juridisch of vergelijkbaar ingrijpend effect op een persoon. Guarrix traint niet op de inhoud van uw prompts of antwoorden — inhoud wordt nooit opgeslagen.
Guarrix zelf functioneert als een detectie- en filterlaag namens u, niet als een systeem dat autonome beslissingen neemt die personen raken — Guarrix is op zichzelf geen hoogrisico-AI-systeem onder Bijlage III van de EU AI-verordening. Of uw eigen gebruik van uw gekozen LLM hoogrisico is, hangt af van hoe u het gebruikt; die classificatie maakt u zelf, niet Guarrix.
Artikel 50 van de EU AI-verordening bepaalt dat mensen moeten worden geïnformeerd wanneer zij interactie hebben met een AI-systeem, en dat door AI gegenereerde of gemanipuleerde inhoud als zodanig moet worden gemarkeerd. Guarrix genereert geen inhoud die aan eindgebruikers wordt getoond — Guarrix controleert en filtert inhoud die al is geproduceerd door uw eigen applicatie en LLM-provider. Als uw eigen product AI gebruikt om rechtstreeks met eindgebruikers te communiceren, is de informatieverplichting van artikel 50 aan die eindgebruikers aan u om na te komen, niet aan Guarrix.
De eigen detectie-engine van Guarrix is nog in ontwikkeling en nog niet in productie — deze pagina wordt bijgewerkt met de specifieke detectiemodellen en providers zodra de dienst live is. Guarrix kiest niet welke LLM-provider het verkeer van uw klanten verwerkt; u configureert uw eigen provider (OpenAI, Anthropic, Mistral of elk OpenAI-compatibel eindpunt). Waar Guarrix zelf intern gebruikmaakt van een groot taalmodel, gebruikt Guarrix Mistral, gehost in de EU, om dezelfde reden van datalocatie als de rest van het Guarrix-platform.
Guarrix is een probabilistisch systeem. Fout-positieven (ten onrechte gemarkeerde inhoud) en fout-negatieven (ten onrechte doorgelaten inhoud) zijn mogelijk. De nauwkeurigheid van detectie hangt af van de entiteitstypen en regels die voor uw tenant zijn geconfigureerd. Guarrix is niet ontworpen of gevalideerd voor gebruik in veiligheidskritieke domeinen zoals medische diagnose, juridische beslissingen of andere contexten waarin een gemiste detectie ernstige schade kan veroorzaken.
Vragen over hoe de AI-systemen van Guarrix zijn ontworpen, of klachten over het detectiegedrag, kunt u sturen naar hello@guarrix.com. Zie ons privacybeleid voor het uitoefenen van uw AVG-rechten, en onze algemene voorwaarden voor hoe geschillen worden afgehandeld.