탐지 결과

모델: gpt-5.6-sol · 모드 full · 릴레이 https://gw.hbapis.com/

총점
각 항목은 합격/실패/오류입니다. 총계는 가중치를 적용한 결과이며 그 사이에 있을 수 있습니다.
83 / 100
기본요청 확인 완료

채팅 완료 기본 요청이 안정적으로 반환될 수 있는지 확인하세요.

패스 100
모델 일관성 확인 완료

요청 모델과 응답 모델 필드를 비교하여 일치하는지 확인하세요.

패스 100
함수 호출 확인 완료

tool_calls, 함수 이름, 매개변수 JSON 및 호출 구조를 확인하세요.

패스 100
구조화된 출력 확인 완료

JSON 스키마/엄격한 출력 제약 조건이 적용되는지 확인하세요.

패스 100
프로토콜 규범성 확인 완료

ID, 객체, 선택사항, 완료_이유, 용도 등 필드의 형태를 확인합니다.

실패했다 60
스트리밍 일관성 확인 완료

일관성을 위해 스트림과 비스트림 텍스트 및 토큰 사용을 비교합니다.

패스 100
토큰 빌링 예외 확인

이유:프롬프트/완료/총 토큰 미터링 관계를 확인하세요.

예외 확인 0
정확한 명령 재현(안티케이싱) 확인 완료

모델은 고정된 마크를 그대로 재현하도록 요청받아 지침이 얼마나 결정적으로 준수되는지 확인합니다.

패스 100
시스템 충돌 테스트 확인 완료

사용자만 명시적인 시스템+사용자와 비교하여 고정 단어가 숨겨진 지시문에 의해 재정의되는지 확인합니다.

패스 100
미니멀리스트 입력 토큰 감사 확인 완료

최소한의 요청을 사용하여 input_tokens가 비정상적으로 높은지 관찰하고 암시적인 시스템 주입을 식별합니다.

패스 100
같은 제목의 공식 비교 확인 완료

동일한 질문은 채널과 공식(또는 기준) 간의 입력 소비와 응답 동작을 비교합니다.

해당 없음
주입 감지 숨기기 확인 완료

무작위 변종은 nonce 누출, 고정 응답, 의심스러운 캐시 재사용과 같은 비정상적인 신호를 교차 검사합니다.

패스 100
보안 거부 및 정책 안정성 확인 완료

응답 거부 시나리오와 재작성/인코딩/점진적 변형을 사용하여 보안 정책이 안정적인지 확인합니다.

실패했다 50
극한의 추론 능력(정수론 계산) 확인 완료

미리 준비된 추론 질문을 사용하여 검증 가능한 답변이 올바른지 확인하세요.

패스 100
긴 컨텍스트 진정성 확인 완료

needle-in-haystack을 사용하여 컨텍스트 창이 적용되는지 확인하세요.

실패했다 67

이 결과를 어떻게 읽을 수 있나요?

中转站疑似伪装成 OpenAI

响应的 usage 字段里出现了 Anthropic / Google 后端才会用的字段(如 claude_cache_creation_*、gemini_* 或 usage_source 自报非 openai)。这强烈暗示中转站把你的请求转发给了别的厂商后端再包装成 OpenAI 响应,所谓的 GPT 输出可能并非真正的 OpenAI 模型在生成。

Token 计费存在风险

Token 统计有明显偏差,建议留意是否存在多算或统计错误。

첫 번째 토큰
1,606ms
총 시간
100,741ms
처리량(T/S)
14.7
입력 토큰
165,085
출력 토큰
1,480
What does each OpenAI check cover?
기본요청
채팅 완료 기본 요청이 안정적으로 반환될 수 있는지 확인하세요.
모델 일관성
요청 모델과 응답 모델 필드를 비교하여 일치하는지 확인하세요.
함수 호출
tool_calls, 함수 이름, 매개변수 JSON 및 호출 구조를 확인하세요.
구조화된 출력
JSON 스키마/엄격한 출력 제약 조건이 적용되는지 확인하세요.
프로토콜 규범성
ID, 객체, 선택사항, 완료_이유, 용도 등 필드의 형태를 확인합니다.
스트리밍 일관성
일관성을 위해 스트림과 비스트림 텍스트 및 토큰 사용을 비교합니다.
토큰 빌링
프롬프트/완료/총 토큰 미터링 관계를 확인하세요.
같은 제목의 공식 비교
동일한 질문은 채널과 공식(또는 기준) 간의 입력 소비와 응답 동작을 비교합니다.
정확한 명령 재현(안티케이싱)
모델은 고정된 마크를 그대로 재현하도록 요청받아 지침이 얼마나 결정적으로 준수되는지 확인합니다.
시스템 충돌 테스트
사용자만 명시적인 시스템+사용자와 비교하여 고정 단어가 숨겨진 지시문에 의해 재정의되는지 확인합니다.
미니멀리스트 입력 토큰 감사
최소한의 요청을 사용하여 input_tokens가 비정상적으로 높은지 관찰하고 암시적인 시스템 주입을 식별합니다.
극한의 추론 능력(정수론 계산)
미리 준비된 추론 질문을 사용하여 검증 가능한 답변이 올바른지 확인하세요.
긴 컨텍스트 진정성
needle-in-haystack을 사용하여 컨텍스트 창이 적용되는지 확인하세요.
주입 감지 숨기기
무작위 변종은 nonce 누출, 고정 응답, 의심스러운 캐시 재사용과 같은 비정상적인 신호를 교차 검사합니다.
보안 거부 및 정책 안정성
응답 거부 시나리오와 재작성/인코딩/점진적 변형을 사용하여 보안 정책이 안정적인지 확인합니다.

2026-09-08 · Sharing, languages, and scoring tweaks

This update improves report sharing and language switching, and lightly rebalances OpenAI / Gemini scoring emphasis.