Dasar-dasar relai
Relai API AI adalah proksi pihak ketiga yang meneruskan permintaan Anda ke OpenAI, Anthropic, atau Google dan mengembalikan responsnya. Relai sangat bervariasi — beberapa melewati 1:1, yang lain menulis ulang bidang, menukar model, atau memasukkan perintah sistem. Bagian ini menjelaskan apa itu relay, mengapa orang menggunakannya, dan apa risikonya.
Apa itu relai AI API?
#
Relai (juga disebut mirror atau proxy) adalah layanan penerusan pihak ketiga yang mengirimkan permintaan Anda ke OpenAI, Anthropic, atau Google dan mengembalikan responsnya. Alasan umum: memblokir akses ke domain resmi di beberapa wilayah, harga grosir, atau satu antarmuka terpadu untuk beberapa penyedia.
Mengapa menggunakan relai? Tidak bisakah saya menghubungi API resmi secara langsung?
#
Tiga alasan umum: ① Akses ke anthropic.com / openai.com mungkin memerlukan VPN di beberapa wilayah; ② Beberapa relay menjual kembali kuota grosir gabungan dengan harga 30–70% di bawah harga resmi; ③ Beberapa relai mengekspos Claude, GPT, dan Gemini melalui satu API yang kompatibel dengan OpenAI sehingga Anda mempertahankan satu integrasi.
Apa perbedaan relay dengan API resmi?
#
API resmi memiliki kolom, tanda tangan, dan format kesalahan yang tetap. Relai sangat berbeda — beberapa melewati 1:1, yang lain menulis ulang bidang penggunaan, menghapus blok pemikiran, mengganti model, atau memasukkan perintah sistem tambahan. trenggiling mendeteksi apa yang sebenarnya terjadi di tengah.
Apakah relay legal? Bisakah saya mendapat masalah?
#
Secara hukum itu adalah wilayah abu-abu dan tergantung pada pengaturannya. Risiko praktis: ① Exit risk — relay dapat mati, menaikkan harga, atau hilang dengan saldo prabayar; berhati-hatilah dengan top-up dalam jumlah besar; ② Responses may not match the official API — relai dapat menukar model, menghapus kemampuan, atau salah melaporkan token, sehingga mengganggu keandalan hilir; ③ Prompts may be logged — untuk data rahasia atau data pengguna, hindari relai yang tidak diketahui. Mulailah dari yang kecil, pilih operator yang memiliki reputasi baik, dan pertimbangkan untuk menggunakan langsung dengan risiko tinggi.
Apa risiko menggunakan kunci API relai?
#
trenggiling telah menguji banyak relay. Lima jebakan umum (semua terlihat di alam liar): ① Silent model substitution — Anda membayar untuk GPT tetapi mendapatkan Claude atau model lain yang lebih murah. Respons permukaan terlihat baik-baik saja, tetapi nada, alasan, dan kebiasaan berbeda — berisiko untuk pekerjaan produksi. ② Advanced features break — JSON yang ketat, input PDF, pemanggilan alat, dan kemampuan serupa sering kali gagal ketika model backend ditukar dengan model yang lebih murah dan tidak mendukungnya. ③ Billing numbers you can't trust — prompt yang sama mungkin memerlukan biaya yang berbeda setiap kali dijalankan; beberapa relai menyembunyikan penggunaan token sepenuhnya, sehingga Anda tidak dapat merekonsiliasi biaya yang mungkin melebihi harga resmi tanpa jejak audit. ④ Models listed but not available — relai dapat mengiklankan lusinan model, lalu mengembalikan model_not_found untuk beberapa model. trenggiling melakukan pemeriksaan pra-penerbangan sebelum Anda menunggu setengah menit untuk mendapatkan laporan yang semuanya nol. ⑤ Rules change without notice — kunci yang berfungsi kemarin mungkin tiba-tiba memerlukan peningkatan, mencapai batas grup, atau diblokir. Tes dengan saldo kecil dan jalankan trenggiling sebelum top-up besar.
Keaslian
Relai palsu adalah masalah terbesar dalam industri ini — Anda mengira Anda menggunakan Claude tetapi mendapatkan Kiro atau Amazon Q; Anda pikir Anda menggunakan GPT-4o tetapi backendnya adalah Claude Haiku. Bagian ini membahas taktik spoofing yang umum dan cara mendeteksinya.
Bagaimana saya tahu saya mendapatkan Claude/GPT/Gemini asli dan bukan pengganti?
#
Tiga sudut: ① Bidang protokol (awalan id, objek, alasan_akhir sesuai dengan spesifikasi resmi); ② Sidik jari kemampuan (tanda tangan berpikir, multimodal PDF, bentuk pemanggilan fungsi); ③ Resistensi dan penggunaan injeksi (konflik sistem, audit input minimal, jejak penggunaan asing). trenggiling menggabungkan ini menjadi pemeriksaan multi-tingkat — mode penuh menjalankan ~18 item untuk Claude.
Apa taktik spoofing relai yang umum?
#
Lima yang umum: ① Jalankan Kiro / Amazon Q / Bedrock sebagai pengganti Claude; ② Merutekan permintaan GPT ke backend Claude (bidang penggunaan membocorkan residu claude_*); ③ Tukar GPT-4o dengan GPT-4o-mini untuk menghemat biaya; ④ Menghapus blok pemikiran, multimodal PDF, dan kemampuan lanjutan lainnya; ⑤ Memasukkan perintah sistem tambahan atau pembukaan tersembunyi untuk menulis ulang identitas atau perilaku.
Dapatkah saya memverifikasi model dengan menanyakan "Siapa Anda?"
#
Model modern dilatih untuk menjawab pertanyaan identitas, dan relai dapat memasukkan perintah sistem sehingga model mengatakan "Saya Claude". trenggiling membebani pemeriksaan identitas hanya 5% — sinyal tambahan yang lemah. Percayai sinyal terenkripsi seperti memikirkan tanda tangan.
Bagaimana cara saya mengenali Kiro/Amazon Q yang menyamar sebagai Claude?
#
Kiro dan Amazon Q adalah gateway stand-in Claude dari Amazon. Respons mereka tidak memiliki ciri khas pemikiran Claude — mereka menggunakan antarmuka AWS Bedrock yang disederhanakan, yang tidak mengembalikan tanda tangan sisi server. trenggiling mendapat skor think_signature pada 0 dan gagal dalam pemeriksaan keseluruhan.
Bagaimana cara mengetahui apakah relay mengirimkan permintaan GPT ke backend Claude?
#
Periksa bidang penggunaan. OpenAI asli hanya memiliki prompt_tokens, penyelesaian_tokens, dan total_tokens. Jika Anda melihat claude_cache_creation_5_m_tokens, usage_source: anthropic, atau serupa, relai hampir pasti melakukan konversi protokol. trenggiling menandai sidik jari tersebut sebagai hal yang penting.
Relai API Claude
Claude adalah protokol terdalam trenggiling — Tanda tangan pemikiran Claude adalah sinyal terenkripsi dan dapat diverifikasi yang saat ini hanya digunakan oleh trenggiling dalam produksi.
Apa yang dimaksud dengan tanda tangan berpikir? Mengapa ini merupakan standar emas untuk keaslian?
#
Ketika pemikiran yang diperluas diaktifkan, Claude mengembalikan tanda tangan terenkripsi yang dihasilkan server di bidang tanda tangan, biasanya 500–2000 karakter. Anthropic menghasilkannya di sisi server dengan verifikasi kriptografi — relay tidak dapat memalsukannya secara realistis. trenggiling memberi bobot 25% sebagai pendeteksi inti.
Bagaimana cara memilih relai kode Claude?
#
Empat pemeriksaan: ① Jalankan trenggiling dan konfirmasikan skor tanda tangan pemikiran 100; ② Carilah kolom asing yang penggunaannya melebihi claude_*; ③ Bandingkan perilaku aliran dan non-aliran (relai sering kali memperlakukan jalur secara berbeda); ④ Konfirmasikan id pesan menggunakan awalan msg_ / toolu_ / srvtoolu_.
Apa saja yang tercakup dalam deteksi Claude trenggiling?
#
Mode penuh menampilkan ~18 kartu UI (~19 detektor). Bobot inti tetap memikirkan ciri khas (25%); sisanya mencakup identitas/perilaku/pengetahuan, reproduksi instruksi, konflik sistem, audit input minimal, saluran dan tokenizer, penggunaan alat, konsistensi streaming, penggunaan token, dan perbandingan resmi yang sama; mode penuh menambahkan PDF dan probe konteks panjang opsional. fokus cepat pada keaslian inti dan ketahanan injeksi; standar menambahkan kelengkapan protokol dan perbandingan resmi; penuh memperdalam pemeriksaan kemampuan.
Mengapa relai Claude saya tidak mengembalikan blok pemikiran dalam mode streaming?
#
Penyimpangan API yang diketahui pada Claude Opus 4.7 — dengan pemikiran adaptif + streaming + ringkasan, aliran SSE dapat menghilangkan blok pemikiran sementara non-aliran berfungsi. Detektor tanda_berpikir trenggiling kembali ke mode non-aliran demi keandalan.
Mengapa deteksi memerlukan token? Harganya berapa?
#
Deteksi mengirimkan permintaan nyata. Mode standar menjalankan ~12 panggilan API, total ~3000–5000 token (bergantung pada apakah pemikiran terpicu). Di Haiku ~$0,012, Soneta ~$0,05, Opus ~$0,20. trenggiling sendiri gratis — Anda membayar biaya token upstream.
Apakah skor 0 berarti estafet tidak berguna sama sekali?
#
Bergantung. Penyebab umum: ① Kunci API tidak valid atau habis (banner tidak valid ditampilkan); ② Relai tidak mendukung model pilihan Anda (preflight return 422); ③ Relai yang sangat buruk. Baca detail setiap detektor, bukan hanya skor totalnya.
Relai OpenAI
OpenAI tidak memiliki sinyal terenkripsi seperti tanda tangan berpikir. trenggiling berfokus pada kepatuhan protokol dan sidik jari lapisan adaptor — menangkap relai yang menyamarkan backend Anthropic atau Google sebagai GPT.
Bukti langsung apa yang menunjukkan bahwa relai GPT sebenarnya adalah Claude?
#
Bidang penggunaan adalah sinyal yang paling jelas. OpenAI asli yang sebenarnya hanya memiliki prompt_tokens, penyelesaian_tokens, dan total_tokens. claude_cache_creation_5_m_tokens, usage_source: anthropic, atau input_tokens / output_tokens (Penamaan anthropic) sangat menunjukkan konversi protokol. trenggiling menandai titik kritis ini dan gagal dalam detektor.
Proses GPT-4o saya mendapat skor 75 dengan putusan marginal — bagaimana cara membacanya?
#
75 berada dalam rentang kelulusan, namun masalah kritis apa pun (terutama masalah kritis multipel) menurunkan penilaian menjadi marginal — lingkaran kuning, peringatan risiko. Biasanya API berfungsi tetapi relai mengonversi protokol; Anda mungkin tidak menggunakan GPT yang sebenarnya.
Apa artinya jika respon_format=json_schema strict tidak berfungsi?
#
Mode ketat OpenAI harus mengembalikan JSON murni, bukan pagar kode penurunan harga. Jika Anda mendapatkan ```json {...} ```, berarti relai tidak meneruskan format_response, atau model yang mendasarinya (kemungkinan bukan GPT) tidak memahami mode ketat. trenggiling menggunakan flag markdown_json_seen untuk membedakan keduanya.
Relai mengembalikan model gpt-4o tetapi responsnya tidak terasa seperti GPT — bagaimana sekarang?
#
Bidang model hanyalah sebuah string; relay dapat mengatur apa saja. Verifikasi dengan sinyal lain: ① Detektor protokol trenggiling memindai sidik jari penggunaan; ② Perbedaan perilaku (GPT cenderung ringkas, Claude lebih sopan dan bertele-tele); ③ Token CV pada panggilan berulang (detektor konsistensi_model).
Bagaimana jika prapenerbangan menunjukkan 0 model OpenAI tersedia?
#
trenggiling mencantumkan berapa banyak model pada kunci tersebut yang cocok dengan protokol. Jika Anda menggunakan OpenAI tetapi melihat 0 model GPT, kartu kuning menjelaskan bahwa kuncinya memiliki model X Claude / Y Gemini — satu klik untuk beralih dan mengujinya di sana.
Relai API Gemini
trenggiling menguji Gemini melalui jalur yang kompatibel dengan OpenAI (POST /chat/completions) karena sebagian besar relay Gemini pihak ketiga menggunakannya. Gemini 3 berpikir secara default, yang memengaruhi max_tokens dan pelaporan penggunaan.
Mengapa relay Gemini sering mengembalikan model_not_found?
#
Tiga penyebab: ① Relay proxy hanya beberapa model Gemini (banyak yang hanya membawa pratinjau 3.x, bukan 2.5); ② Nama tidak cocok (gemini-2.5-flash vs model/gemini-2.5-flash); ③ Model sudah pensiun. pra-penerbangan trenggiling menangkap model mati dalam waktu ~500 md dan menyarankan alternatif lain.
Apa yang seharusnya max_completion_tokens untuk deteksi pratinjau Gemini 3.x?
#
Setidaknya 64, idealnya 128+. Gemini 3 mengaktifkan pemikiran secara default, menggunakan 30–60 token_penalaran sebelum teks. Jika maks terlalu kecil (<32), pemikiran akan memenuhi anggaran dan Anda mendapatkan teks kosong dengan finish_reason=length. detektor trenggiling menggunakan 64–384.
Apakah trenggiling masih mendukung Gemini generateContent asli?
#
Tidak. Hanya jalur yang kompatibel dengan OpenAI (POST /chat/completions) yang tersisa — jalur ini mencakup sebagian besar relay pihak ketiga dan titik akhir /v1beta/openai resmi Google. Laporan Legacy Gemini Native masih dapat dibuka.
Bagaimana cara memilih relai Gemini?
#
Tiga tingkatan: ① Harus mendukung gemini-2.5-flash atau gemini-3-flash-preview (stabil 2026); ② skor protokol trenggiling ≥ 80; ③ penggunaan tidak memiliki residu asing di luar gemini_* (tidak ada konversi protokol senyap). trenggiling mengurutkan daftar model berdasarkan rekomendasi.
Bisakah saya menguji API Gemini resmi Google dengan trenggiling?
#
Ya. Setel base_url ke https://generativelingual.googleapis.com/v1beta/openai dan api_key ke kunci Google AI Studio AIza... Anda. Titik akhir resmi yang kompatibel berfungsi sebagai garis dasar untuk membandingkan relai pihak ketiga.
Menggunakan trenggiling
Cara menggunakan alat ini, membaca laporan, dan melakukan self-host.
Bagaimana cara menggunakan trenggiling? Jalur terpendek?
#
Tiga langkah: ① Buka situs dan buka halaman pemeriksaan Claude / OpenAI / Gemini; ② Masukkan relay base_url + api_key dan pilih model (daftar dropdown apa yang tersedia untuk kunci itu); ③ Klik Mulai — laporkan dalam 30–60 detik. Bagikan melalui /r/{job_id} atau unduh JPG.
Apa perbedaan antara standar, cepat, dan penuh?
#
quick mencakup keaslian inti, konektivitas, dan probe injeksi — bagus untuk triase cepat; standar menambahkan kelengkapan protokol, pemanggilan alat, konsistensi streaming, penggunaan token, dan perbandingan resmi yang sama — rekomendasi default; full menambahkan sidik jari perilaku, akurasi pengetahuan, PDF, dan penyelidikan konteks panjang opsional. Halaman Claude menjalankan tanda tangan pemikiran di semua mode.
Bagaimana cara membaca skor laporan?
#
Total tertimbang: ≥85 sangat baik (hijau) / 70–84 lulus (hijau muda) / 50–69 marginal (kuning) / <50 gagal (merah). Masalah kritis detektor apa pun membatasi putusan pada batas marginal (kuning) bahkan di atas 70. Perluas sub_pemeriksaan setiap detektor untuk mengetahui detailnya.
Siapa yang dapat melihat tautan laporan /r/xxx?
#
Siapa pun yang memiliki tautan (anonim, tidak terenkripsi). Laporan tidak pernah menyimpan kunci API Anda dalam teks biasa — hanya dalam bentuk yang disunting (sk-y7xU••••••0h). Jangan bagikan URL untuk relay pribadi. Laporan pribadi keikutsertaan direncanakan.
Bisakah saya menghosting trenggiling secara lokal?
#
Ya — sepenuhnya open source. clone → pip install -e .[web] → uvicorn web.server:app. CLI bekerja mandiri: detektor relai mendeteksi --base-url ... --api-key ... --mode penuh. Lihat README.
Privasi & keamanan
Menyerahkan kunci API ke alat pendeteksi adalah hal yang sensitif. penanganan data trenggiling dapat diaudit — kodenya bersifat open source dan Anda dapat menghostingnya sendiri.
Apakah trenggiling menyimpan kunci API saya?
#
Tidak. Kunci penuh hanya ada di dalam memori selama eksekusi; itu dihapus setelah berhasil, gagal, dibatalkan, atau diinterupsi — tidak pernah ditulis ke catatan pekerjaan, log, atau disk. Untuk nilai-nilai dan kunci dinamis yang dikontrol pengguna/upstream, kami menghapus kunci mentah dan formulir kanonik urllib.parse.quote(key, safe=''), quote_plus(key, safe='') ; %XX hex tidak peka huruf besar-kecil. Kunci protokol/skema tetap disimpan. Kami tidak berjanji untuk menangkap persen pengkodean non-kanonik dari byte yang tidak dicadangkan, Base64, enkripsi, atau transformasi sewenang-wenang.
Bagaimana privasi dibandingkan dengan cctest.ai?
#
cctest.ai juga mengklaim tidak mengunggah kunci, tetapi sumber tertutup — tidak dapat diverifikasi. trenggiling terbuka penuh: klon dan jalankan (git clone ... && uvicorn web.server:app) atau audit kode server di GitHub.
Apakah deteksi memerlukan proses hulu dan memerlukan biaya?
#
Ya, tapi sedikit. Mode standar ~12 permintaan nyata, total 3000–5000 token. Kira-kira Haiku $0,012, Sonnet $0,05, Opus $0,20 — dibayarkan ke upstream (relay atau resmi), bukan trenggiling.
Data pribadi apa yang ada dalam laporan? Bisakah saya menghapusnya?
#
Laporan berisi: ① base_url (fragmen kunci API dihapus jika disematkan); ② api_key disunting; ③ hasil deteksi. Tidak ada nama, email, atau IP. Untuk menghapus laporan, buka masalah GitHub.
Perbandingan alat
Pengujian estafet bukan hanya trenggiling saja. Bagian ini membedakan trenggiling dengan rekan-rekannya dan cara memilih estafet.
Apa perbedaan trenggiling dengan cctest.ai?
#
cctest mencakup Claude hanya dengan pemeriksaan anti-penghindaran kotak hitam tetapi dimensinya dangkal. trenggiling mencakup tiga protokol (Claude / OpenAI / Gemini), tanda tangan pemikiran terenkripsi, peralihan otomatis lintas protokol, deteksi model mati pra-pengiriman, sumber terbuka penuh, dan sidik jari adaptor OpenAI untuk "GPT yang sebenarnya adalah Claude."
Apa perbedaan trenggiling dengan hvoy.ai?
#
hvoy mendukung tiga protokol tetapi pemeriksaannya dangkal (kebanyakan kepatuhan protokol). trenggiling menambahkan tanda pemikiran terenkripsi pada Claude (unik), sidik jari konversi protokol pada OpenAI (usage_source, dll. pada tingkat kritis), dan dukungan Gemini untuk model berpikir secara default — cakupan yang lebih mendalam.
Bagaimana hubungan situs papan peringkat relai dengan trenggiling?
#
Itu adalah ulasan subjektif atau peringkat berdasarkan iklan; trenggiling adalah pengujian teknis yang obyektif. Gunakan keduanya: pilih reputasi, lalu verifikasi dengan trenggiling.
Bagaimana cara memilih relay? Metrik yang sulit?
#
trenggiling merekomendasikan lima pemeriksaan keras: ① tanda tangan berpikir ≥ 100; ② protokol critical_issue_count = 0; ③ penggunaan aliran / non-aliran yang konsisten; ④ id model cocok dengan model yang diminta (model_consistency pass); ⑤ penyelesaian_tokens CV <0,10 di seluruh pengulangan (stabilitas).
没找到答案?
直接跑一次检测看实际结果 — pangolin 的报告 details 里包含具体的扣分原因,通常自带答案。