كشف ترحيل OpenAI API البروتوكول/القدرة

تحقق من بروتوكول وقدرات ترحيل OpenAI API

pangolin يتحقق من شكل إكمالات الدردشة واستدعاءات الأدوات واتساق البث وبصمات الاستخدام لمتظاهري GPT.

استكمالات الدردشة استدعاء الوظيفة الإخراج المنظم بصمة الاستخدام

لا يحتوي OpenAI على توقيع مكافحة تزوير الخادم على غرار Claude، لذلك تركز هذه الصفحة على بروتوكول عالي الثقة وفحوصات القدرة.

تسليط الضوء على OpenAI: اكتشاف تسرب البروتوكول وتخفيض القدرات

قم بتقييم ما إذا كانت نقاط النهاية المتوافقة مع GPT تتبع أشكال OpenAI وتمرر بالفعل عبر الإمكانات الأساسية.

ليس إثبات هوية من فئة التشفير - ولكنه كافٍ لاكتشاف معظم تسريبات المحولات والقدرات المفقودة.

جذر متوافق مع OpenAI، على سبيل المثال. https://api.example.com أو https://api.example.com/v1.

يتم استخدام المفتاح فقط لهذه المهمة ولا يتم الاحتفاظ به أبدًا.

أدخل معرف نموذج GPT، أو اختر من بين المرشحين الذين تم اختبارهم.

الشيكات التي سيتم تشغيلها

التحديثات مع عمق المسح أعلاه. يغطي الوضع الكامل جميع الفحوصات المعمول بها. تحتاج تحقيقات السياق الطويل إلى الاشتراك الإضافي.

القدرات القياسية · الرئيسية (مستحسن) · 14

الطلب الأساسي

تأكد من أن الطلبات الأساسية لإتمامات الدردشة يمكن أن تعود بشكل ثابت.

اتساق النموذج

قارن بين حقلي نموذج الطلب ونموذج الاستجابة لمعرفة ما إذا كانا متطابقين.

استدعاء وظيفة

تحقق من مكالمات_الأداة واسم الوظيفة والمعلمة JSON وبنية الاتصال.

إخراج منظم

تحقق من أن مخطط JSON / قيود الإخراج الصارمة سارية المفعول.

معيارية البروتوكول

تحقق من شكل الحقول مثل المعرف والكائن والاختيارات وسبب_الإنهاء والاستخدام وما إلى ذلك.

اتساق التدفق

قارن بين النص المتدفق وغير المتدفق واستخدام الرمز المميز لتحقيق الاتساق.

الفواتير الرمزية

تحقق من علاقة قياس الرمز المميز الفوري/الإكمال/الإجمالي.

المقارنة الرسمية التي تحمل نفس العنوان

يقارن نفس السؤال استهلاك المدخلات وسلوك الاستجابة بين القنوات والمسؤول (أو خط الأساس).

استنساخ دقيق للأوامر (مضاد للغلاف)

يُطلب من النموذج إعادة إنتاج علامة ثابتة حرفيًا، والتحقق من مدى حتمية اتباع التعليمات.

اختبار تعارض النظام

قارن المستخدم فقط بمستخدم النظام + المستخدم الصريح، وتحقق مما إذا كانت الكلمات الثابتة قد تم تجاوزها بواسطة التوجيهات المخفية.

الحد الأدنى من تدقيق رمز الإدخال

استخدم الطلبات البسيطة لملاحظة ما إذا كانت رموز الإدخال مرتفعة بشكل غير طبيعي وتحديد حقن النظام الضمني.

القدرة على الاستدلال الشديد (العد النظري للأعداد)

استخدم الأسئلة المنطقية الجاهزة للتحقق من صحة الإجابات التي يمكن التحقق منها.

إخفاء كشف الحقن

تقوم المتغيرات العشوائية بالتحقق من وجود إشارات غير طبيعية مثل التسريبات غير المتوقعة، والردود الثابتة، وإعادة استخدام ذاكرة التخزين المؤقت المشبوهة.

الرفض الأمني واستقرار السياسة

تحقق مما إذا كانت سياسة الأمان مستقرة باستخدام سيناريوهات رفض الإجابة وإعادة الكتابة/التشفير/المتغيرات التقدمية.

2026-09-08 · Sharing, languages, and scoring tweaks

This update improves report sharing and language switching, and lightly rebalances OpenAI / Gemini scoring emphasis.