Kết quả phát hiện

Model: claude-haiku-4-5-20251001 · chế độ standard · rơle https://test.apiqik-kratos.dimleap.cn

Tổng số điểm
Mỗi mục đều đạt/không đạt/lỗi; tổng số là kết quả có trọng số và có thể ở giữa.
97 / 100
Xác thực mô hình Đã hoàn tất xác minh

Kiểm tra danh tính tự khai báo của người mẫu, dư lượng thương hiệu và các dấu hiệu ngụy trang phổ biến.

Vượt qua 100
Hãy suy nghĩ ủng hộ Đã hoàn tất xác minh

Xác minh xem các trường dành riêng cho phía máy chủ như suy nghĩ / chữ ký Claude có được truyền tải một cách minh bạch hay không.

Vượt qua 100
Tái tạo lệnh chính xác (chống vỏ) Đã hoàn tất xác minh

Mô hình được yêu cầu tái tạo nguyên văn một dấu cố định, kiểm tra mức độ tuân theo các hướng dẫn xác định.

Vượt qua 100
Kiểm tra xung đột hệ thống Đã hoàn tất xác minh

Chỉ so sánh người dùng với hệ thống + người dùng rõ ràng, kiểm tra xem các từ cố định có bị ghi đè bởi các lệnh ẩn hay không.

Vượt qua 100
Khả năng suy luận cực cao (đếm lý thuyết số) Đã hoàn tất xác minh

Sử dụng các câu hỏi lý luận soạn sẵn để kiểm tra xem các câu trả lời có thể kiểm chứng được có đúng hay không.

thất bại 0
Phát hiện kênh Đã hoàn tất xác minh

Kênh được lưu trữ:Anthropic

Vượt qua 100
Claude Xác minh mã thông báo Đã hoàn tất xác minh

người mẫu:— · Mã thông báo được quan sát:None · Mã thông báo dự kiến:None · Trận đấu:unknown

Không áp dụng
Kiểm tra mã thông báo đầu vào tối giản Đã hoàn tất xác minh

Sử dụng các yêu cầu tối giản để quan sát xem liệu input_tokens có cao bất thường hay không và xác định việc tiêm Hệ thống tiềm ẩn.

Vượt qua 100
kiến thức chính xác Đã hoàn tất xác minh

Sử dụng Anthropic / Claude câu hỏi kiến thức chung để xác thực chéo xem phần phụ trợ có được xác nhận là Claude hay không.

Vượt qua 100
Tính nhất quán của khai báo mô hình Đã hoàn tất xác minh

So sánh mô hình yêu cầu, mô hình phản hồi và độ ổn định danh tính trong nhiều vòng trả về.

Vượt qua 100
Đặc tả cấu trúc tin nhắn Đã hoàn tất xác minh

Kiểm tra ID tin nhắn, chuỗi sự kiện SSE và khối nội dung để đảm bảo tuân thủ thông số kỹ thuật Anthropic.

Vượt qua 100
Sử dụng công cụ/Đầu ra có cấu trúc Đã hoàn tất xác minh

Kiểm tra xem khối tool_use, ID toolu_, tên hàm và lược đồ tham số có được chuẩn hóa hay không.

Vượt qua 100
tính nhất quán phát trực tuyến Đã hoàn tất xác minh

So sánh văn bản, mã thông báo và lý do kết thúc của luồng và không phải luồng để đảm bảo tính nhất quán.

Vượt qua 100
Tính nhất quán trong việc sử dụng mã thông báo Đã hoàn tất xác minh

Kiểm tra xem các trường mã thông báo đầu vào/đầu ra/bộ đệm có đầy đủ và xác thực hay không.

Vượt qua 85
So sánh chính thức của cùng một tiêu đề Đã hoàn tất xác minh

Câu hỏi tương tự so sánh mức tiêu thụ đầu vào và hành vi phản hồi giữa các kênh và kênh chính thức (hoặc đường cơ sở).

Không áp dụng
Ẩn phát hiện tiêm Đã hoàn tất xác minh

Các biến thể ngẫu nhiên kiểm tra chéo các tín hiệu bất thường như rò rỉ không liên tục, phản hồi cố định và sử dụng lại bộ đệm đáng ngờ.

Vượt qua 100
Từ chối bảo mật và ổn định chính sách Đã hoàn tất xác minh

Kiểm tra xem chính sách bảo mật có ổn định hay không bằng cách sử dụng các kịch bản từ chối trả lời và viết lại/mã hóa/các biến thể lũy tiến.

thất bại 50
Mã thông báo đầu tiên
1,758ms
Tổng thời gian
58,553ms
Thông lượng (T/S)
54.5
Mã thông báo đầu vào
3,025
Mã thông báo đầu ra
3,191
What does each Claude check cover?
Xác thực mô hình
Kiểm tra danh tính tự khai báo của người mẫu, dư lượng thương hiệu và các dấu hiệu ngụy trang phổ biến.
Hãy suy nghĩ ủng hộ ⭐
Xác minh xem các trường dành riêng cho phía máy chủ như suy nghĩ / chữ ký Claude có được truyền tải một cách minh bạch hay không.
Tái tạo lệnh chính xác (chống vỏ)
Mô hình được yêu cầu tái tạo nguyên văn một dấu cố định, kiểm tra mức độ tuân theo các hướng dẫn xác định.
Kiểm tra xung đột hệ thống
Chỉ so sánh người dùng với hệ thống + người dùng rõ ràng, kiểm tra xem các từ cố định có bị ghi đè bởi các lệnh ẩn hay không.
Kiểm tra mã thông báo đầu vào tối giản
Sử dụng các yêu cầu tối giản để quan sát xem liệu input_tokens có cao bất thường hay không và xác định việc tiêm Hệ thống tiềm ẩn.
Khả năng suy luận cực cao (đếm lý thuyết số)
Sử dụng các câu hỏi lý luận soạn sẵn để kiểm tra xem các câu trả lời có thể kiểm chứng được có đúng hay không.
Phát hiện kênh
Xác định kênh lưu trữ từ tiền tố ID phản hồi.
Claude Xác minh mã thông báo
Đếm input_tokens với các gợi ý cố định so với đường cơ sở của mô hình đã hiệu chỉnh.
tính nhất quán trong phong cách hành vi
So sánh các đặc điểm của chuỗi Claude thông qua sở thích hành vi và mẫu câu trả lời.
kiến thức chính xác
Sử dụng Anthropic / Claude câu hỏi kiến thức chung để xác thực chéo xem phần phụ trợ có được xác nhận là Claude hay không.
Tính nhất quán của khai báo mô hình
So sánh mô hình yêu cầu, mô hình phản hồi và độ ổn định danh tính trong nhiều vòng trả về.
Đặc tả cấu trúc tin nhắn
Kiểm tra ID tin nhắn, chuỗi sự kiện SSE và khối nội dung để đảm bảo tuân thủ thông số kỹ thuật Anthropic.
Sử dụng công cụ/Đầu ra có cấu trúc
Kiểm tra xem khối tool_use, ID toolu_, tên hàm và lược đồ tham số có được chuẩn hóa hay không.
tính nhất quán phát trực tuyến
So sánh văn bản, mã thông báo và lý do kết thúc của luồng và không phải luồng để đảm bảo tính nhất quán.
Tính nhất quán trong việc sử dụng mã thông báo
Kiểm tra xem các trường mã thông báo đầu vào/đầu ra/bộ đệm có đầy đủ và xác thực hay không.
So sánh chính thức của cùng một tiêu đề
Câu hỏi tương tự so sánh mức tiêu thụ đầu vào và hành vi phản hồi giữa các kênh và kênh chính thức (hoặc đường cơ sở).
tính xác thực của bối cảnh dài
Sử dụng kim tiêm để xác minh rằng các cửa sổ ngữ cảnh dài được tôn trọng.
Nhận dạng đa phương thức/PDF
Gửi bản thăm dò PDF để xác nhận rằng liên kết hiểu tài liệu chưa bị trạm trung chuyển tước bỏ.
Ẩn phát hiện tiêm
Các biến thể ngẫu nhiên kiểm tra chéo các tín hiệu bất thường như rò rỉ không liên tục, phản hồi cố định và sử dụng lại bộ đệm đáng ngờ.
Từ chối bảo mật và ổn định chính sách
Kiểm tra xem chính sách bảo mật có ổn định hay không bằng cách sử dụng các kịch bản từ chối trả lời và viết lại/mã hóa/các biến thể lũy tiến.

2026-09-08 · Sharing, languages, and scoring tweaks

This update improves report sharing and language switching, and lightly rebalances OpenAI / Gemini scoring emphasis.