test.apiqik-kratos.apiqik.com
Problèmes courants : Capacité de raisonnement extrême (comptage de la théorie des nombres)、 Pensez solidaire
pangolin regroupe les détections de la communauté publique et classe les relais par score pondéré bayésien (plus de tests + scores plus stables → rang plus élevé). Basé sur 28 rapports publics sur 7 relais (6 avec ≥2 tests se qualifient pour la carte principale).
Trié par score pondéré bayésien : davantage de tests rendent le score plus fiable
Problèmes courants : Capacité de raisonnement extrême (comptage de la théorie des nombres)、 Pensez solidaire
Problèmes courants : Capacité de raisonnement extrême (comptage de la théorie des nombres)、 Audit de jeton d'entrée minimaliste、 Facturation des jetons
Problèmes courants : Capacité de raisonnement extrême (comptage de la théorie des nombres)、 Claude Vérification du tokeniseur
Problèmes courants : Capacité de raisonnement extrême (comptage de la théorie des nombres)、 Pensez solidaire
Problèmes courants : Audit de jeton d'entrée minimaliste、 Test de conflit système
Problèmes courants : cohérence du style comportemental、 exactitude des connaissances
Problèmes courants : authenticité du contexte long、 Spécification de la structure du message
Chaque rapport public /r/{job_id} alimente ce tableau, regroupé par base_url domain. Le classement utilise un Bayesian-weighted score (prior=50, prior_weight=5) : un 100 parfait unique ne se classe qu'à ~58,3 — vous avez besoin de ≥10 courses régulières presque parfaites pour grimper sur le tableau principal. Cela empêche un nouveau relais de figurer en tête du classement après une seule course chanceuse. La « médiane » de l'interface utilisateur est la médiane des scores passés (pour intuition) ; l'ordre de tri utilise le poids bayésien.
Les relais à échantillon unique restent en dehors de la carte principale (contrôle du bruit) mais apparaissent toujours au bas de la liste complète.