Deteksi relai API Gemini Protokol yang kompatibel

Verifikasi protokol dan kemampuan relai API Gemini

pangolin menyelidiki relai Gemini melalui API yang kompatibel dengan OpenAI untuk protokol, kemampuan, dan penggunaan Metadata pass-through.

Jalur yang kompatibel dengan OpenAI Pemanggilan Fungsi penggunaanMetadata Gemini 3 sadar

Berfokus pada protokol yang kompatibel dan perilaku berpikir secara default — bukan identitas tingkat tanda tangan Claude.

Sorotan Gemini: jalur & penggunaan Metadata yang kompatibel

Mengukur perilaku Gemini yang sebenarnya pada titik akhir yang kompatibel dengan OpenAI yang digunakan oleh relay pihak ketiga.

Paling dekat dengan cara penggunaan relay Gemini pihak ketiga.

Induk dari /chat/completions. Google menggunakan /v1beta/openai; pihak ketiga sering menggunakan /v1.

Hanya digunakan untuk pekerjaan ini; dikirim melalui Authorization: Bearer.

Lebih suka model Gemini yang benar-benar diaktifkan oleh relai Anda.

Pemeriksaan yang akan dijalankan

Pembaruan dengan kedalaman Pindai di atas. Mode penuh mencakup semua pemeriksaan yang berlaku. Penyelidikan konteks panjang memerlukan keikutsertaan ekstra.

Standar · semua berlaku (disarankan) · 14

Permintaan dasar

Konfirmasikan bahwa jalur yang kompatibel Gemini OpenAI dapat dikembalikan secara stabil.

Bentuk respons model

Periksa response.model dan bentuk choices[].message Chat Completions.

panggilan fungsi

Periksa nama panggilan fungsi, objek parameter, dan struktur panggilan.

Keluaran terstruktur

Verifikasi apakah skema respons/batasan keluaran JSON berlaku.

Normativitas protokol

Verifikasi id, object, choices, finish_reason, usage, serta sidik jari lintas protokol di usage.

konsistensi streaming

Bandingkan keluaran dan alasan akhir aliran dan non-aliran untuk konsistensi.

Penggunaan token

Periksa integritas bidang prompt / completion / total token di usage dan hubungan pengukurannya.

Perbandingan resmi dengan judul yang sama

Pertanyaan yang sama membandingkan konsumsi input dan perilaku respons antara saluran dan pejabat (atau baseline).

Reproduksi perintah yang akurat (anti-casing)

Model diminta untuk mereproduksi tanda tetap secara verbatim, memeriksa seberapa deterministik instruksi yang diikuti.

Pengujian konflik sistem

Bandingkan pengguna hanya dengan sistem+pengguna eksplisit, periksa apakah kata-kata tetap ditimpa oleh arahan tersembunyi.

Audit Token Input Minimalis

Gunakan permintaan minimalis untuk mengamati apakah input_tokens sangat tinggi dan mengidentifikasi injeksi Sistem implisit.

Kemampuan penalaran yang ekstrim (penghitungan teori bilangan)

Gunakan pertanyaan penalaran terekam untuk memeriksa apakah jawaban yang dapat diverifikasi benar.

Sembunyikan deteksi injeksi

Varian acak memeriksa ulang sinyal abnormal seperti kebocoran nonce, balasan tetap, dan penggunaan kembali cache yang mencurigakan.

Penolakan keamanan dan stabilitas kebijakan

Periksa apakah kebijakan keamanan stabil menggunakan skenario penolakan jawaban dan varian penulisan ulang/pengkodean/progresif.

2026-09-08 · Sharing, languages, and scoring tweaks

This update improves report sharing and language switching, and lightly rebalances OpenAI / Gemini scoring emphasis.