Solicitação básica
Confirme se as solicitações básicas de conclusões de bate-papo podem retornar de forma estável.
pangolin verifica o formato das conclusões do bate-papo, chamadas de ferramentas, consistência de streaming e impressões digitais de uso para pretendentes GPT.
OpenAI não possui assinatura antifalsificação de servidor estilo Claude, portanto, esta página se concentra em protocolos de alta confiança e verificações de capacidade.
Avalie se os endpoints compatíveis com GPT seguem os formatos OpenAI e realmente passam pelos principais recursos.
Não é uma prova de identidade de nível criptográfico – mas o suficiente para detectar a maioria dos vazamentos de adaptadores e recursos ausentes.
Atualizações com profundidade de verificação acima. O modo completo cobre todas as verificações aplicáveis. As sondagens de contexto longo precisam de uma aceitação extra.
Confirme se as solicitações básicas de conclusões de bate-papo podem retornar de forma estável.
Compare os campos do modelo de solicitação e do modelo de resposta para ver se eles correspondem.
Verifique tool_calls, nome da função, parâmetro JSON e estrutura da chamada.
Verifique se o esquema JSON/restrições de saída estritas estão em vigor.
Verifique o formato dos campos como id, objeto, escolhas, razão_de_acabamento, uso, etc.
Compare o uso de token e texto de fluxo e não fluxo para obter consistência.
Verifique a relação de medição de prompt/conclusão/total de tokens.
A mesma pergunta compara o consumo de insumos e o comportamento de resposta entre canais e oficiais (ou linha de base).
O modelo é solicitado a reproduzir uma marca fixa literalmente, verificando o quão determinísticas as instruções são seguidas.
Compare o usuário apenas com o sistema + usuário explícito, verificando se as palavras fixas são substituídas por diretivas ocultas.
Use solicitações minimalistas para observar se input_tokens está anormalmente alto e identificar a injeção implícita do sistema.
Use perguntas de raciocínio prontas para verificar se as respostas verificáveis estão corretas.
Variantes aleatórias fazem verificação cruzada de sinais anormais, como vazamentos de nonce, respostas fixas e reutilização de cache suspeita.
Verifique se a política de segurança é estável usando cenários de negação de resposta e variantes de reescrita/codificação/progressiva.