Papan peringkat relai AI API

trenggiling mengumpulkan deteksi komunitas publik dan memberi peringkat secara estafet berdasarkan skor tertimbang Bayesian (lebih banyak tes + skor lebih stabil → peringkat lebih tinggi). Berdasarkan 28 laporan publik di 7 relay (6 dengan ≥2 tes memenuhi syarat untuk papan utama). Disegarkan setiap 10 menit · Ingin menguji relai? Kembali ke rumah

🏆 Papan utama Atas 7

Diurutkan berdasarkan skor tertimbang Bayesian — lebih banyak tes membuat skor lebih dapat dipercaya

Bagaimana penilaian dewan? Klik untuk memperluas aturan

Setiap laporan publik /r/{job_id} dimasukkan ke forum ini, dikelompokkan berdasarkan base_url domain. Pemeringkatan menggunakan Bayesian-weighted score (prior=50, prior_weight=5): satu kali sempurna 100 hanya memberi peringkat ~58,3 — Anda memerlukan ≥10 lari stabil mendekati sempurna untuk naik ke papan utama. Hal ini menghentikan relay baru untuk menduduki puncak tangga lagu setelah satu kali keberuntungan. “Median” UI adalah median skor masa lalu (untuk intuisi); urutan pengurutan menggunakan bobot Bayesian.

Relai sampel tunggal tidak berada di papan utama (pengendali kebisingan) tetapi masih muncul di bagian bawah daftar lengkap.

2026-09-08 · Sharing, languages, and scoring tweaks

This update improves report sharing and language switching, and lightly rebalances OpenAI / Gemini scoring emphasis.