test.apiqik-kratos.apiqik.com
Các vấn đề phổ biến: Khả năng suy luận cực cao (đếm lý thuyết số)、 Hãy suy nghĩ ủng hộ
tê tê tổng hợp các phát hiện của cộng đồng công cộng và xếp hạng các trạm tiếp sức theo điểm số Bayesian (nhiều bài kiểm tra hơn + điểm ổn định hơn → xếp hạng cao hơn). Dựa trên 28 báo cáo công khai trên 7 rơle (6 với ≥2 bài kiểm tra đủ điều kiện cho bảng chính).
Sắp xếp theo điểm số Bayesian - nhiều bài kiểm tra hơn làm cho điểm đáng tin cậy hơn
Các vấn đề phổ biến: Khả năng suy luận cực cao (đếm lý thuyết số)、 Hãy suy nghĩ ủng hộ
Các vấn đề phổ biến: Khả năng suy luận cực cao (đếm lý thuyết số)、 Kiểm tra mã thông báo đầu vào tối giản、 Thanh toán mã thông báo
Các vấn đề phổ biến: Khả năng suy luận cực cao (đếm lý thuyết số)、 Claude Xác minh mã thông báo
Các vấn đề phổ biến: Khả năng suy luận cực cao (đếm lý thuyết số)、 Hãy suy nghĩ ủng hộ
Các vấn đề phổ biến: Kiểm tra mã thông báo đầu vào tối giản、 Kiểm tra xung đột hệ thống
Các vấn đề phổ biến: tính nhất quán trong phong cách hành vi、 kiến thức chính xác
Các vấn đề phổ biến: tính xác thực của bối cảnh dài、 Đặc tả cấu trúc tin nhắn
Mỗi báo cáo /r/{job_id} công khai cung cấp bảng này, được nhóm theo base_url domain. Xếp hạng sử dụng Bayesian-weighted score (trước=50, trước_weight=5): 100 hoàn hảo duy nhất chỉ xếp hạng ~ 58,3 - bạn cần ≥10 lần chạy ổn định gần như hoàn hảo để leo lên bảng chính. Điều đó ngăn cản một rơle mới đứng đầu bảng xếp hạng sau một lần chạy may mắn. Giao diện người dùng “Trung bình” là điểm trung bình của các điểm trong quá khứ (đối với trực giác); thứ tự sắp xếp sử dụng trọng số Bayes.
Rơle một mẫu nằm ngoài bảng mạch chính (kiểm soát tiếng ồn) nhưng vẫn xuất hiện ở cuối danh sách đầy đủ.