Detecção de retransmissão da API OpenAI Protocolo/capacidade

Verifique o protocolo e os recursos de retransmissão da API OpenAI

pangolin verifica o formato das conclusões do bate-papo, chamadas de ferramentas, consistência de streaming e impressões digitais de uso para pretendentes GPT.

Conclusões de bate-papo Chamada de função Saída Estruturada impressão digital de uso

OpenAI não possui assinatura antifalsificação de servidor estilo Claude, portanto, esta página se concentra em protocolos de alta confiança e verificações de capacidade.

Destaque OpenAI: detecte vazamentos de protocolo e cortes de capacidade

Avalie se os endpoints compatíveis com GPT seguem os formatos OpenAI e realmente passam pelos principais recursos.

Não é uma prova de identidade de nível criptográfico – mas o suficiente para detectar a maioria dos vazamentos de adaptadores e recursos ausentes.

Raiz compatível com OpenAI, por ex. https://api.example.com ou https://api.example.com/v1.

A chave é usada somente para este trabalho e nunca é persistida.

Insira o ID do modelo GPT ou escolha um dos candidatos sondados.

Verificações que serão executadas

Atualizações com profundidade de verificação acima. O modo completo cobre todas as verificações aplicáveis. As sondagens de contexto longo precisam de uma aceitação extra.

Padrão · principais capacidades (recomendado) · 14

Solicitação básica

Confirme se as solicitações básicas de conclusões de bate-papo podem retornar de forma estável.

consistência do modelo

Compare os campos do modelo de solicitação e do modelo de resposta para ver se eles correspondem.

chamada de função

Verifique tool_calls, nome da função, parâmetro JSON e estrutura da chamada.

Saída estruturada

Verifique se o esquema JSON/restrições de saída estritas estão em vigor.

Normatividade do protocolo

Verifique o formato dos campos como id, objeto, escolhas, razão_de_acabamento, uso, etc.

consistência de streaming

Compare o uso de token e texto de fluxo e não fluxo para obter consistência.

Faturamento de token

Verifique a relação de medição de prompt/conclusão/total de tokens.

Comparação oficial do mesmo título

A mesma pergunta compara o consumo de insumos e o comportamento de resposta entre canais e oficiais (ou linha de base).

Reprodução precisa do comando (anti-casing)

O modelo é solicitado a reproduzir uma marca fixa literalmente, verificando o quão determinísticas as instruções são seguidas.

Teste de conflito de sistema

Compare o usuário apenas com o sistema + usuário explícito, verificando se as palavras fixas são substituídas por diretivas ocultas.

Auditoria minimalista de token de entrada

Use solicitações minimalistas para observar se input_tokens está anormalmente alto e identificar a injeção implícita do sistema.

Capacidade extrema de raciocínio (contagem da teoria dos números)

Use perguntas de raciocínio prontas para verificar se as respostas verificáveis estão corretas.

Ocultar detecção de injeção

Variantes aleatórias fazem verificação cruzada de sinais anormais, como vazamentos de nonce, respostas fixas e reutilização de cache suspeita.

Rejeição de segurança e estabilidade política

Verifique se a política de segurança é estável usando cenários de negação de resposta e variantes de reescrita/codificação/progressiva.

2026-09-08 · Sharing, languages, and scoring tweaks

This update improves report sharing and language switching, and lightly rebalances OpenAI / Gemini scoring emphasis.