Die vorliegende Übersetzung wurde maschinell erstellt. Im Falle eines Konflikts oder eines Widerspruchs zwischen dieser übersetzten Fassung und der englischen Fassung (einschließlich infolge von Verzögerungen bei der Übersetzung) ist die englische Fassung maßgeblich.
Punktedefinitionen
Schweregrad (für Inhaltsfilter und sofortige Erkennung von Angriffen)
Bei Inhaltsfiltern und sofortiger Angriffserkennung gibt die API einen Schweregrad zurück. Dabei handelt es sich um einen numerischen Wert im Bereich [0, 1], der den Kriterien der Sicherheitsprüfung am stärksten entspricht. Diese Werte sind diskret, wobei die möglichen Werte 0, 0,2, 0,4, 0,6, 0,8 und 1,0 sind.
Eine Punktzahl von 1 (Maximum) ist die stärkste Übereinstimmung und gibt an, dass sie der Definition der Sicherheitsüberprüfung am nächsten kommt. Eine Punktzahl von 0 (Minimum) ist die schwächste Übereinstimmung, was bedeutet, dass der Inhalt harmlos ist.
Der Schweregrad ist eine Eigenschaft des Inhalts selbst und nicht die Gewissheit, mit der das zugrundeliegende Modell seine Einstufung bestimmt. Es beantwortet die Frage: „Wie stark entspricht dieser Inhalt den Kriterien für die Sicherheitsüberprüfung?“ Es beantwortet nicht die Frage „Wie sicher ist das zugrunde liegende Modell?“ In der folgenden Tabelle wird diese Definition näher erläutert.
| Schutz | Granularity | Bedeutung eines Schweregrads |
|---|---|---|
| Inhaltsfilter | Pro Kategorie (HASS, GEWALT, BELEIDIGUNGEN, SEXUELLES VERHALTEN, FEHLVERHALTEN) | Wie stark stimmt der Inhalt mit den schädlichen Inhalten der einzelnen Kategorien überein? |
| Sofortiger Angriff | Pro Angriffsvektor (JAILBREAK, PROMPT_INJECTION, PROMPT_LEAKAGE) | Wie stark entspricht der Inhalt den einzelnen Angriffsvektoren? |
Der Punktestand allein blockiert keine Inhalte. Sie verwenden die Punktzahl als Schwellenwert, um zu kontrollieren, wie restriktiv Ihre Anwendung agiert.
Konfidenzwert (für Filter mit vertraulichen Informationen)
Bei Filtern vertraulicher Informationen gibt die API einen Konfidenzwert zurück, der angibt, wie sicher das Modell ist, dass eine PII-Entität vorhanden ist. Dieser Wert ist für die Erkennung personenbezogener Daten relevant und spiegelt die Zuverlässigkeit des Modells in Bezug auf das Vorhandensein von PII-Entitäten wider, die Sie beim Aufruf der API ausgewählt haben.