الطلب الأساسي
تأكد من أن الطلبات الأساسية لإتمامات الدردشة يمكن أن تعود بشكل ثابت.
pangolin يتحقق من شكل إكمالات الدردشة واستدعاءات الأدوات واتساق البث وبصمات الاستخدام لمتظاهري GPT.
لا يحتوي OpenAI على توقيع مكافحة تزوير الخادم على غرار Claude، لذلك تركز هذه الصفحة على بروتوكول عالي الثقة وفحوصات القدرة.
قم بتقييم ما إذا كانت نقاط النهاية المتوافقة مع GPT تتبع أشكال OpenAI وتمرر بالفعل عبر الإمكانات الأساسية.
ليس إثبات هوية من فئة التشفير - ولكنه كافٍ لاكتشاف معظم تسريبات المحولات والقدرات المفقودة.
التحديثات مع عمق المسح أعلاه. يغطي الوضع الكامل جميع الفحوصات المعمول بها. تحتاج تحقيقات السياق الطويل إلى الاشتراك الإضافي.
تأكد من أن الطلبات الأساسية لإتمامات الدردشة يمكن أن تعود بشكل ثابت.
قارن بين حقلي نموذج الطلب ونموذج الاستجابة لمعرفة ما إذا كانا متطابقين.
تحقق من مكالمات_الأداة واسم الوظيفة والمعلمة JSON وبنية الاتصال.
تحقق من أن مخطط JSON / قيود الإخراج الصارمة سارية المفعول.
تحقق من شكل الحقول مثل المعرف والكائن والاختيارات وسبب_الإنهاء والاستخدام وما إلى ذلك.
قارن بين النص المتدفق وغير المتدفق واستخدام الرمز المميز لتحقيق الاتساق.
تحقق من علاقة قياس الرمز المميز الفوري/الإكمال/الإجمالي.
يقارن نفس السؤال استهلاك المدخلات وسلوك الاستجابة بين القنوات والمسؤول (أو خط الأساس).
يُطلب من النموذج إعادة إنتاج علامة ثابتة حرفيًا، والتحقق من مدى حتمية اتباع التعليمات.
قارن المستخدم فقط بمستخدم النظام + المستخدم الصريح، وتحقق مما إذا كانت الكلمات الثابتة قد تم تجاوزها بواسطة التوجيهات المخفية.
استخدم الطلبات البسيطة لملاحظة ما إذا كانت رموز الإدخال مرتفعة بشكل غير طبيعي وتحديد حقن النظام الضمني.
استخدم الأسئلة المنطقية الجاهزة للتحقق من صحة الإجابات التي يمكن التحقق منها.
تقوم المتغيرات العشوائية بالتحقق من وجود إشارات غير طبيعية مثل التسريبات غير المتوقعة، والردود الثابتة، وإعادة استخدام ذاكرة التخزين المؤقت المشبوهة.
تحقق مما إذا كانت سياسة الأمان مستقرة باستخدام سيناريوهات رفض الإجابة وإعادة الكتابة/التشفير/المتغيرات التقدمية.