탐지 결과

모델: claude-haiku-4-5-20251001 · 모드 quick · 릴레이 https://test.apiqik-kratos.apiqik.com/

총점
각 항목은 합격/실패/오류입니다. 총계는 가중치를 적용한 결과이며 그 사이에 있을 수 있습니다.
98 / 100
모델 인증 확인 완료

모델이 직접 보고한 아이덴티티, 브랜드 잔여물, 위장의 일반적인 징후를 조사합니다.

패스 100
사고 지원성 확인 완료

Claude 생각/서명 등 서버측 전용 필드가 투명하게 전송되는지 확인합니다.

패스 100
정확한 명령 재현(안티케이싱) 확인 완료

모델은 고정된 마크를 그대로 재현하도록 요청받아 지침이 얼마나 결정적으로 준수되는지 확인합니다.

패스 100
시스템 충돌 테스트 확인 완료

사용자만 명시적인 시스템+사용자와 비교하여 고정 단어가 숨겨진 지시문에 의해 재정의되는지 확인합니다.

패스 100
극한의 추론 능력(정수론 계산) 확인 완료

미리 준비된 추론 질문을 사용하여 검증 가능한 답변이 올바른지 확인하세요.

실패했다 0
채널 감지 확인 완료

호스팅 채널:Anthropic

패스 100
Claude 토크나이저 검증 확인 완료

모델:— · 관찰된 토큰:None · 예상 토큰:None · 경기:unknown

해당 없음
미니멀리스트 입력 토큰 감사 확인 완료

최소한의 요청을 사용하여 input_tokens가 비정상적으로 높은지 관찰하고 암시적인 시스템 주입을 식별합니다.

패스 100
모델 선언 일관성 확인 완료

여러 라운드의 반환에서 요청 모델, 응답 모델 및 ID 안정성을 비교합니다.

패스 100
메시지 구조 사양 확인 완료

메시지 ID, SSE 이벤트 시퀀스, 콘텐츠 블록이 Anthropic 사양을 준수하는지 확인하세요.

패스 100
주입 감지 숨기기 확인 완료

무작위 변종은 nonce 누출, 고정 응답, 의심스러운 캐시 재사용과 같은 비정상적인 신호를 교차 검사합니다.

패스 100
보안 거부 및 정책 안정성 확인 완료

응답 거부 시나리오와 재작성/인코딩/점진적 변형을 사용하여 보안 정책이 안정적인지 확인합니다.

실패했다 50

이 결과를 어떻게 읽을 수 있나요?

暂时无法判断 Token 是否虚报

接口没有返回完整 usage 字段,所以这次不能确认它有没有多算。

첫 번째 토큰
6,238ms
총 시간
58,650ms
처리량(T/S)
40.6
입력 토큰
1,101
출력 토큰
2,384
What does each Claude check cover?
모델 인증
모델이 직접 보고한 아이덴티티, 브랜드 잔여물, 위장의 일반적인 징후를 조사합니다.
사고 지원성 ⭐
Claude 생각/서명 등 서버측 전용 필드가 투명하게 전송되는지 확인합니다.
정확한 명령 재현(안티케이싱)
모델은 고정된 마크를 그대로 재현하도록 요청받아 지침이 얼마나 결정적으로 준수되는지 확인합니다.
시스템 충돌 테스트
사용자만 명시적인 시스템+사용자와 비교하여 고정 단어가 숨겨진 지시문에 의해 재정의되는지 확인합니다.
미니멀리스트 입력 토큰 감사
최소한의 요청을 사용하여 input_tokens가 비정상적으로 높은지 관찰하고 암시적인 시스템 주입을 식별합니다.
극한의 추론 능력(정수론 계산)
미리 준비된 추론 질문을 사용하여 검증 가능한 답변이 올바른지 확인하세요.
채널 감지
응답 ID 접두사에서 호스팅 채널을 식별합니다.
Claude 토크나이저 검증
보정된 모델 기준과 비교하여 고정 힌트가 있는 input_token 수를 계산합니다.
행동 스타일의 일관성
행동 선호도와 답변 패턴을 통해 Claude 계열 특성을 비교해 보세요.
지식 정확성
Anthropic / Claude 일반 지식 질문을 사용하여 백엔드가 Claude로 주장되는지 여부를 교차 검증하세요.
모델 선언 일관성
여러 라운드의 반환에서 요청 모델, 응답 모델 및 ID 안정성을 비교합니다.
메시지 구조 사양
메시지 ID, SSE 이벤트 시퀀스, 콘텐츠 블록이 Anthropic 사양을 준수하는지 확인하세요.
도구 사용/구조화된 출력
tool_use 블록, toolu_ ID, 함수 이름, 매개변수 스키마가 표준화되어 있는지 확인하세요.
스트리밍 일관성
일관성을 위해 스트림과 비스트림 텍스트, 토큰, 최종 이유를 비교합니다.
토큰 사용 일관성
입력/출력/캐시 토큰 필드가 완전하고 확실한지 확인하세요.
같은 제목의 공식 비교
동일한 질문은 채널과 공식(또는 기준) 간의 입력 소비와 응답 동작을 비교합니다.
긴 컨텍스트 진정성
긴 컨텍스트 창이 적용되는지 확인하려면 needle-in-haystack을 사용하세요.
다중 모드/PDF 인식
PDF 프로브를 제출하여 문서 이해 링크가 전송 스테이션에서 제거되지 않았는지 확인하세요.
주입 감지 숨기기
무작위 변종은 nonce 누출, 고정 응답, 의심스러운 캐시 재사용과 같은 비정상적인 신호를 교차 검사합니다.
보안 거부 및 정책 안정성
응답 거부 시나리오와 재작성/인코딩/점진적 변형을 사용하여 보안 정책이 안정적인지 확인합니다.

2026-09-08 · Sharing, languages, and scoring tweaks

This update improves report sharing and language switching, and lightly rebalances OpenAI / Gemini scoring emphasis.