Temel istek
Sohbet Tamamlama temel isteklerinin istikrarlı bir şekilde geri dönebildiğini doğrulayın.
pangolin GPT taklidi yapanlar için Sohbet Tamamlama şeklini, araç çağrılarını, akış tutarlılığını ve kullanım parmak izlerini kontrol eder.
OpenAI'nin Claude tarzı sunucu sahteciliğe karşı imzası yoktur, bu nedenle bu sayfa yüksek güvenliğe sahip protokol ve yetenek kontrollerine odaklanmaktadır.
GPT uyumlu uç noktaların OpenAI şekillerini takip edip etmediğini ve temel yetenekleri gerçekten geçip geçmediğini değerlendirin.
Kripto düzeyinde kimlik kanıtı olmasa da adaptör sızıntılarının ve eksik yeteneklerin çoğunu tespit etmeye yeterlidir.
Yukarıdaki Tarama derinliği ile güncellemeler. Tam mod, geçerli tüm kontrolleri kapsar. Uzun bağlam araştırmalarının ekstra bir katılıma ihtiyacı vardır.
Sohbet Tamamlama temel isteklerinin istikrarlı bir şekilde geri dönebildiğini doğrulayın.
Eşleşip eşleşmediklerini görmek için istek modeli ve yanıt modeli alanlarını karşılaştırın.
tool_calls'ı, işlev adını, JSON parametresini ve çağrı yapısını kontrol edin.
JSON Şeması/katı çıktı kısıtlamalarının etkin olduğunu doğrulayın.
Kimlik, nesne, seçimler, bitiş_nedeni, kullanım vb. alanların şeklini doğrulayın.
Tutarlılık için akışlı ve akışsız metin ve belirteç kullanımını karşılaştırın.
İstem/tamamlama/toplam belirteç ölçümü ilişkisini kontrol edin.
Aynı soru, kanallar ile resmi (veya temel) arasındaki girdi tüketimini ve yanıt davranışını karşılaştırır.
Talimatların ne kadar belirleyici bir şekilde takip edildiğini kontrol ederek modelden sabit bir işareti kelimesi kelimesine yeniden üretmesi istenir.
Sabit sözcüklerin gizli yönergeler tarafından geçersiz kılınıp kılınmadığını kontrol ederek kullanıcıyı yalnızca açık sistem+kullanıcıyla karşılaştırın.
input_tokens'ın anormal derecede yüksek olup olmadığını gözlemlemek ve örtülü Sistem enjeksiyonunu tanımlamak için minimalist istekleri kullanın.
Doğrulanabilir yanıtların doğru olup olmadığını kontrol etmek için hazır akıl yürütme sorularını kullanın.
Rastgeleleştirilmiş değişkenler, tek seferlik sızıntılar, sabit yanıtlar ve şüpheli önbellek yeniden kullanımı gibi anormal sinyalleri çapraz kontrol eder.
Yanıt reddi senaryolarını ve yeniden yazma/kodlama/aşamalı değişkenleri kullanarak güvenlik politikasının istikrarlı olup olmadığını kontrol edin.