Grundlegende Anfrage
Stellen Sie sicher, dass die Basisanfragen für Chat-Abschlüsse stabil zurückgegeben werden können.
pangolin prüft die Form der Chat-Abschlüsse, Toolaufrufe, Streaming-Konsistenz und Nutzungsfingerabdrücke für GPT-Prätendenten.
OpenAI verfügt über keine fälschungssichere Server-Signatur im Claude-Stil, daher konzentriert sich diese Seite auf Protokolle mit hoher Zuverlässigkeit und Funktionsprüfungen.
Bewerten Sie, ob GPT-kompatible Endpunkte OpenAI-Formen folgen und Schlüsselfunktionen wirklich weitergeben.
Kein Identitätsnachweis auf Krypto-Niveau – aber ausreichend, um die meisten Adapterlecks und fehlenden Funktionen aufzudecken.
Aktualisierungen mit Scantiefe oben. Der Vollmodus deckt alle anwendbaren Prüfungen ab. Sonden mit langem Kontext erfordern ein zusätzliches Opt-In.
Stellen Sie sicher, dass die Basisanfragen für Chat-Abschlüsse stabil zurückgegeben werden können.
Vergleichen Sie die Felder „Anforderungsmodell“ und „Antwortmodell“, um festzustellen, ob sie übereinstimmen.
Überprüfen Sie die Tool-Aufrufe, den Funktionsnamen, den JSON-Parameter und die Aufrufstruktur.
Stellen Sie sicher, dass JSON-Schema/strikte Ausgabebeschränkungen wirksam sind.
Überprüfen Sie die Form von Feldern wie ID, Objekt, Auswahlmöglichkeiten, Zielgrund, Verwendung usw.
Vergleichen Sie die Stream- und Nicht-Stream-Text- und Token-Nutzung, um Konsistenz zu gewährleisten.
Überprüfen Sie die Beziehung zwischen Eingabeaufforderung, Abschluss und Gesamttokenmessung.
Die gleiche Frage vergleicht den Input-Verbrauch und das Antwortverhalten zwischen Kanälen und offiziellen Kanälen (oder Baseline).
Das Modell wird aufgefordert, eine feste Markierung wörtlich zu reproduzieren und dabei zu prüfen, wie deterministisch die Anweisungen befolgt werden.
Vergleichen Sie Benutzer nur mit explizitem System+Benutzer und prüfen Sie, ob feste Wörter durch versteckte Anweisungen überschrieben werden.
Verwenden Sie minimalistische Anfragen, um zu beobachten, ob input_tokens ungewöhnlich hoch ist, und um implizite Systeminjektionen zu identifizieren.
Verwenden Sie vorgefertigte Argumentationsfragen, um zu überprüfen, ob überprüfbare Antworten richtig sind.
Zufällige Varianten führen eine Gegenprüfung auf ungewöhnliche Signale wie Nonce-Lecks, korrigierte Antworten und verdächtige Cache-Wiederverwendung durch.
Überprüfen Sie, ob die Sicherheitsrichtlinie stabil ist, indem Sie Denial-of-Antwort-Szenarien und Umschreibungs-/Kodierungs-/progressive Varianten verwenden.