Qorami.AI
Accueil › Précision

Quelle est la précision de Qorami ?

Un garde-fou que vous ne pouvez pas mesurer est un garde-fou auquel vous ne pouvez pas faire confiance. C’est pourquoi nous publions les chiffres — sur un benchmark labellisé, de manière reproductible et en étant honnêtes sur les limites.

0
manqués dangereux — aucun e-mail risqué n’a reçu la décision "autoriser"
100%
de concordance avec les labels des opérateurs (92/92)
92
e-mails labellisés · 5 langues · 4 profils de risque

Résultats par classe

ClassePrécisionRappelE-mails
Autorise (envoyer)100%100%32
A confirmer (revue humaine)100%100%27
Bloque100%100%33
Le chiffre le plus important : 0 manqué dangereux. Tout e-mail qui devrait être bloqué ou révisé l’est — aucun n’est jamais envoyé en silence. Le jeu d’évaluation charge délibérément des cas difficiles et dangereux (fuites de clés API et mots de passe en clair dans cinq langues, tentatives d’injection de prompt / de détournement d’agent, fuites de cartes de paiement et de numéros de sécurité sociale) car ce sont précisément ceux qui ne doivent jamais passer. Qorami échoue vers une validation humaine, pas vers un envoi.

Ce que cela mesure (et ne mesure pas)

Reproduisez-le

Le benchmark et le script de score sont fournis dans le dépôt. Lancez :

npm run eval

Chaque modification de détection réexécute ce jeu de test, afin que la précision ne puisse évoluer que sous surveillance.

Voir l'API de décision →