채팅 완료 기본 요청이 안정적으로 반환될 수 있는지 확인하세요.
탐지 결과
모델: gpt-5.5 · 모드 full · 릴레이 https://test.apiqik-kratos.dimleap.cn
요청 모델과 응답 모델 필드를 비교하여 일치하는지 확인하세요.
tool_calls, 함수 이름, 매개변수 JSON 및 호출 구조를 확인하세요.
JSON 스키마/엄격한 출력 제약 조건이 적용되는지 확인하세요.
ID, 객체, 선택사항, 완료_이유, 용도 등 필드의 형태를 확인합니다.
일관성을 위해 스트림과 비스트림 텍스트 및 토큰 사용을 비교합니다.
프롬프트/완료/총 토큰 미터링 관계를 확인하세요.
모델은 고정된 마크를 그대로 재현하도록 요청받아 지침이 얼마나 결정적으로 준수되는지 확인합니다.
사용자만 명시적인 시스템+사용자와 비교하여 고정 단어가 숨겨진 지시문에 의해 재정의되는지 확인합니다.
최소한의 요청을 사용하여 input_tokens가 비정상적으로 높은지 관찰하고 암시적인 시스템 주입을 식별합니다.
동일한 질문은 채널과 공식(또는 기준) 간의 입력 소비와 응답 동작을 비교합니다.
무작위 변종은 nonce 누출, 고정 응답, 의심스러운 캐시 재사용과 같은 비정상적인 신호를 교차 검사합니다.
응답 거부 시나리오와 재작성/인코딩/점진적 변형을 사용하여 보안 정책이 안정적인지 확인합니다.
미리 준비된 추론 질문을 사용하여 검증 가능한 답변이 올바른지 확인하세요.
needle-in-haystack을 사용하여 컨텍스트 창이 적용되는지 확인하세요.
이 결과를 어떻게 읽을 수 있나요?
Token 数明显异常: usage 字段、token 增量或流式/非流式统计存在明显问题,有虚报或统计错误风险。
What does each OpenAI check cover?
- 기본요청
- 채팅 완료 기본 요청이 안정적으로 반환될 수 있는지 확인하세요.
- 모델 일관성
- 요청 모델과 응답 모델 필드를 비교하여 일치하는지 확인하세요.
- 함수 호출
- tool_calls, 함수 이름, 매개변수 JSON 및 호출 구조를 확인하세요.
- 구조화된 출력
- JSON 스키마/엄격한 출력 제약 조건이 적용되는지 확인하세요.
- 프로토콜 규범성
- ID, 객체, 선택사항, 완료_이유, 용도 등 필드의 형태를 확인합니다.
- 스트리밍 일관성
- 일관성을 위해 스트림과 비스트림 텍스트 및 토큰 사용을 비교합니다.
- 토큰 빌링
- 프롬프트/완료/총 토큰 미터링 관계를 확인하세요.
- 같은 제목의 공식 비교
- 동일한 질문은 채널과 공식(또는 기준) 간의 입력 소비와 응답 동작을 비교합니다.
- 정확한 명령 재현(안티케이싱)
- 모델은 고정된 마크를 그대로 재현하도록 요청받아 지침이 얼마나 결정적으로 준수되는지 확인합니다.
- 시스템 충돌 테스트
- 사용자만 명시적인 시스템+사용자와 비교하여 고정 단어가 숨겨진 지시문에 의해 재정의되는지 확인합니다.
- 미니멀리스트 입력 토큰 감사
- 최소한의 요청을 사용하여 input_tokens가 비정상적으로 높은지 관찰하고 암시적인 시스템 주입을 식별합니다.
- 극한의 추론 능력(정수론 계산)
- 미리 준비된 추론 질문을 사용하여 검증 가능한 답변이 올바른지 확인하세요.
- 긴 컨텍스트 진정성
- needle-in-haystack을 사용하여 컨텍스트 창이 적용되는지 확인하세요.
- 주입 감지 숨기기
- 무작위 변종은 nonce 누출, 고정 응답, 의심스러운 캐시 재사용과 같은 비정상적인 신호를 교차 검사합니다.
- 보안 거부 및 정책 안정성
- 응답 거부 시나리오와 재작성/인코딩/점진적 변형을 사용하여 보안 정책이 안정적인지 확인합니다.