Authentification du modèle
Examinez l'identité déclarée du modèle, les résidus de marque et les signes courants de camouflage.
pangolin utilise thinking signature, des champs de protocole et des sondes de capacité pour distinguer Claude natif des wrappers ou des backends réduits.
Cette page met l'accent sur la vérification de la signature côté serveur. Les demandes réelles sont facturées sur le compte amont de la clé.
La détection de Claude n’est pas « est-ce que ça ressemble à Claude ? — il vérifie si les signatures du serveur et les preuves du protocole Anthropic existent réellement.
Pour une identité de qualité cryptographique, commencez par Claude ; pour la compatibilité des protocoles, vérifiez également OpenAI / Gemini.
Mises à jour avec la profondeur d'analyse ci-dessus. Le mode complet couvre toutes les vérifications applicables. Les sondes à contexte long nécessitent un opt-in supplémentaire.
Examinez l'identité déclarée du modèle, les résidus de marque et les signes courants de camouflage.
Vérifiez si les champs exclusifs côté serveur tels que Claude réflexion/signature sont transmis de manière transparente.
Il est demandé au modèle de reproduire textuellement une note fixe, en vérifiant dans quelle mesure les instructions sont suivies de manière déterministe.
Comparez l'utilisateur uniquement à un système + utilisateur explicite, en vérifiant si les mots fixes sont remplacés par des directives cachées.
Utilisez des requêtes minimalistes pour observer si input_tokens est anormalement élevé et identifier l’injection système implicite.
Utilisez des questions de raisonnement prédéfinies pour vérifier si les réponses vérifiables sont correctes.
Identifie le canal d'hébergement à partir du préfixe de l'ID de réponse.
Comptez les input_tokens avec des indices fixes par rapport à la référence du modèle calibré.
Comparez les caractéristiques de la série Claude à travers les préférences comportementales et les modèles de réponse.
Utilisez les questions de connaissances générales Anthropic / Claude pour valider de manière croisée si le backend est aussi revendiqué que Claude.
Comparaison du modèle de demande, du modèle de réponse et de la stabilité de l'identité dans plusieurs séries de retours.
Vérifiez la conformité des ID de message, des séquences d'événements SSE et des blocs de contenu avec les spécifications Anthropic.
Vérifiez si le bloc tool_use, toolu_ ID, le nom de la fonction et le schéma des paramètres sont standardisés.
Comparez le texte du flux et du non-flux, le jeton et la raison de fin pour plus de cohérence.
Vérifiez que les champs d'entrée/sortie/jeton de cache sont complets et authentiques.
La même question compare la consommation d'intrants et le comportement de réponse entre les canaux et les autorités (ou référence).
Utilisez une aiguille dans une botte de foin pour vérifier que les longues fenêtres contextuelles sont respectées.
Soumettez une sonde PDF pour confirmer que le lien de compréhension du document n'a pas été supprimé par la station de transfert.
Les variantes aléatoires vérifient les signaux anormaux tels que les fuites occasionnelles, les réponses corrigées et la réutilisation suspecte du cache.
Vérifiez si la politique de sécurité est stable à l'aide de scénarios de déni de réponse et de variantes de réécriture/codage/progressive.