Resultados de detecção

Modelo: claude-opus-4-7 · modo quick · relé https://api.apiqik.com

Pontuação total
Cada item é aprovado/reprovado/erro; o total é um resultado ponderado e pode estar intermediário.
48 / 100
Autenticação de modelo Verificação concluída

Examine a identidade autodeclarada do modelo, os resíduos da marca e os sinais comuns de camuflagem.

Passe 100
Pense solidário Verificação concluída

Verifique se os campos exclusivos do lado do servidor, como Claude pensamento/assinatura, são transmitidos de forma transparente.

falhou 0
Reprodução precisa do comando (anti-casing) Verificação concluída

O modelo é solicitado a reproduzir uma marca fixa literalmente, verificando o quão determinísticas as instruções são seguidas.

falhou 0
Teste de conflito de sistema Verificação concluída

Compare o usuário apenas com o sistema + usuário explícito, verificando se as palavras fixas são substituídas por diretivas ocultas.

falhou 0
Capacidade extrema de raciocínio (contagem da teoria dos números) Verificação concluída

Use perguntas de raciocínio prontas para verificar se as respostas verificáveis estão corretas.

falhou 0
Detecção de canal Verificação concluída

Canal hospedado:Anthropic

Passe 100
Claude Verificação do tokenizador Verificação concluída

Modelo:claude-opus-4-7 · Tokens observados:6 · Tokens esperados:17 · Partida:false

falhou 0
Auditoria minimalista de token de entrada Verificação concluída

Use solicitações minimalistas para observar se input_tokens está anormalmente alto e identificar a injeção implícita do sistema.

falhou 50
Consistência da declaração do modelo Verificação concluída

Comparando modelo de solicitação, modelo de resposta e estabilidade de identidade em múltiplas rodadas de devoluções.

Passe 100
Especificação da estrutura da mensagem Verificação concluída

Verifique IDs de mensagens, sequências de eventos SSE e blocos de conteúdo quanto à conformidade com as especificações Anthropic.

Passe 100
Ocultar detecção de injeção Verificação concluída

Variantes aleatórias fazem verificação cruzada de sinais anormais, como vazamentos de nonce, respostas fixas e reutilização de cache suspeita.

Passe 100
Rejeição de segurança e estabilidade política Verificação concluída

Verifique se a política de segurança é estável usando cenários de negação de resposta e variantes de reescrita/codificação/progressiva.

falhou 50

Como ler esse resultado?

暂时无法判断 Token 是否虚报

接口没有返回完整 usage 字段,所以这次不能确认它有没有多算。

Primeiro token
3,426ms
Tempo total
46,572ms
Taxa de transferência (T/S)
41.0
Tokens de entrada
1,213
Tokens de saída
1,908
What does each Claude check cover?
Autenticação de modelo
Examine a identidade autodeclarada do modelo, os resíduos da marca e os sinais comuns de camuflagem.
Pense solidário ⭐
Verifique se os campos exclusivos do lado do servidor, como Claude pensamento/assinatura, são transmitidos de forma transparente.
Reprodução precisa do comando (anti-casing)
O modelo é solicitado a reproduzir uma marca fixa literalmente, verificando o quão determinísticas as instruções são seguidas.
Teste de conflito de sistema
Compare o usuário apenas com o sistema + usuário explícito, verificando se as palavras fixas são substituídas por diretivas ocultas.
Auditoria minimalista de token de entrada
Use solicitações minimalistas para observar se input_tokens está anormalmente alto e identificar a injeção implícita do sistema.
Capacidade extrema de raciocínio (contagem da teoria dos números)
Use perguntas de raciocínio prontas para verificar se as respostas verificáveis estão corretas.
Detecção de canal
Identifica o canal de hospedagem do prefixo do ID de resposta.
Claude Verificação do tokenizador
Conte input_tokens com dicas fixas em comparação com a linha de base do modelo calibrado.
consistência do estilo comportamental
Compare as características da série Claude por meio de preferências comportamentais e padrões de resposta.
precisão do conhecimento
Use perguntas de conhecimento geral Anthropic / Claude para validar cruzadamente se o back-end é tão reivindicado quanto Claude.
Consistência da declaração do modelo
Comparando modelo de solicitação, modelo de resposta e estabilidade de identidade em múltiplas rodadas de devoluções.
Especificação da estrutura da mensagem
Verifique IDs de mensagens, sequências de eventos SSE e blocos de conteúdo quanto à conformidade com as especificações Anthropic.
Uso de ferramenta/saída estruturada
Verifique se o bloco tool_use, toolu_ ID, nome da função e esquema de parâmetros estão padronizados.
consistência de streaming
Compare texto de fluxo e não fluxo, token e motivo final para obter consistência.
Consistência de uso de token
Verifique se os campos de token de entrada/saída/cache estão completos e autênticos.
Comparação oficial do mesmo título
A mesma pergunta compara o consumo de insumos e o comportamento de resposta entre canais e oficiais (ou linha de base).
autenticidade de contexto longo
Use agulha no palheiro para verificar se longas janelas de contexto são respeitadas.
Reconhecimento multimodal/PDF
Envie uma investigação em PDF para confirmar se o link de compreensão do documento não foi removido pela estação de transferência.
Ocultar detecção de injeção
Variantes aleatórias fazem verificação cruzada de sinais anormais, como vazamentos de nonce, respostas fixas e reutilização de cache suspeita.
Rejeição de segurança e estabilidade política
Verifique se a política de segurança é estável usando cenários de negação de resposta e variantes de reescrita/codificação/progressiva.

2026-09-08 · Sharing, languages, and scoring tweaks

This update improves report sharing and language switching, and lightly rebalances OpenAI / Gemini scoring emphasis.