Grundlegende Anfrage
Stellen Sie sicher, dass Gemini OpenAI kompatible Pfade stabil zurückgegeben werden können.
pangolin prüft Gemini-Relays über OpenAI-kompatible APIs auf Protokoll, Funktionen und Nutzung. Metadaten-Passthrough.
Konzentriert sich auf kompatibles Protokoll und standardmäßiges Denken – nicht auf Claude-Signatur-Identität.
Misst das echte Gemini-Verhalten auf OpenAI-kompatiblen Endpunkten, die von Drittanbieter-Relays verwendet werden.
Kommt der tatsächlichen Verwendung von Gemini-Relais von Drittanbietern am nächsten.
Aktualisierungen mit Scantiefe oben. Der Vollmodus deckt alle anwendbaren Prüfungen ab. Sonden mit langem Kontext erfordern ein zusätzliches Opt-In.
Stellen Sie sicher, dass Gemini OpenAI kompatible Pfade stabil zurückgegeben werden können.
Überprüfen Sie die Modelldeklaration, die Antwortstruktur und die Form des Kandidateninhalts.
Überprüfen Sie den Funktionsaufrufnamen, das Parameterobjekt und die Aufrufstruktur.
Überprüfen Sie, ob Einschränkungen für das Antwortschema/die JSON-Ausgabe gelten.
Überprüfen Sie Felder wie Kandidaten, Zielgrund, Sicherheit, Nutzungsmetadaten usw.
Vergleichen Sie die Ausgabe- und Endgründe von Stream und Nicht-Stream, um die Konsistenz zu gewährleisten.
Überprüfen Sie die Feldintegrität des UsageMetadata-Tokens und die Messbeziehungen.
Die gleiche Frage vergleicht den Input-Verbrauch und das Antwortverhalten zwischen Kanälen und offiziellen Kanälen (oder Baseline).
Das Modell wird aufgefordert, eine feste Markierung wörtlich zu reproduzieren und dabei zu prüfen, wie deterministisch die Anweisungen befolgt werden.
Vergleichen Sie Benutzer nur mit explizitem System+Benutzer und prüfen Sie, ob feste Wörter durch versteckte Anweisungen überschrieben werden.
Verwenden Sie minimalistische Anfragen, um zu beobachten, ob input_tokens ungewöhnlich hoch ist, und um implizite Systeminjektionen zu identifizieren.
Verwenden Sie vorgefertigte Argumentationsfragen, um zu überprüfen, ob überprüfbare Antworten richtig sind.
Zufällige Varianten führen eine Gegenprüfung auf ungewöhnliche Signale wie Nonce-Lecks, korrigierte Antworten und verdächtige Cache-Wiederverwendung durch.
Überprüfen Sie, ob die Sicherheitsrichtlinie stabil ist, indem Sie Denial-of-Antwort-Szenarien und Umschreibungs-/Kodierungs-/progressive Varianten verwenden.