Les traductions sont fournies par des outils de traduction automatique. En cas de conflit entre le contenu d'une traduction et celui de la version originale en anglais, la version anglaise prévaudra.
Définitions des scores
Score de gravité (pour les filtres de contenu et la détection rapide des attaques)
Grâce aux filtres de contenu et à la détection rapide des attaques, l'API renvoie un score de gravité, qui est une valeur numérique comprise dans la plage [0, 1] qui correspond le mieux aux critères du contrôle de sécurité. Ces scores sont discrets, les valeurs possibles étant 0, 0,2, 0,4, 0,6, 0,8 et 1,0.
Un score de 1 (maximum) correspond à la meilleure correspondance, indiquant la plus proche de la définition du contrôle de sécurité. Un score de 0 (minimum) correspond à la correspondance la plus faible, ce qui indique que le contenu est bénin.
Le score de sévérité est une propriété du contenu lui-même, et non la certitude du modèle sous-jacent quant à sa classification. Il répond à la question : « Dans quelle mesure ce contenu correspond-il aux critères du contrôle de sécurité ? » Il ne répond pas : « Dans quelle mesure le modèle sous-jacent est-il sûr ? » Le tableau suivant détaille cette définition.
| Sauvegarder | Granularité | Signification d'un score de sévérité |
|---|---|---|
| Filtre de contenu | Par catégorie (HAINE, VIOLENCE, INSULTES, SEXUALITÉ, INCONDUITE) | Dans quelle mesure le contenu correspond-il au contenu préjudiciable de chaque catégorie ? |
| Attaque rapide | Par vecteur d'attaque (JAILBREAK, PROMPT_INJECTION, PROMPT_LEAKAK) | Dans quelle mesure le contenu correspond-il à chaque vecteur d'attaque ? |
La partition en elle-même ne bloque aucun contenu. Vous utilisez le score comme seuil pour contrôler le degré de restriction de votre application.
Score de confiance (pour les filtres d'informations sensibles)
Avec les filtres d'informations sensibles, l'API renvoie un score de confiance qui indique dans quelle mesure le modèle est certain qu'une entité PII est présente. Ce score est pertinent pour la détection des informations personnelles et reflète la confiance du modèle quant à la présence des entités PII que vous avez sélectionnées lorsque vous avez appelé l'API.