Examinez l'identité déclarée du modèle, les résidus de marque et les signes courants de camouflage.
Résultats de détection
Modèle : claude-haiku-4-5-20251001 · mode standard · relais https://test.apiqik-kratos.apiqik.com
Vérifiez si les champs exclusifs côté serveur tels que Claude réflexion/signature sont transmis de manière transparente.
Il est demandé au modèle de reproduire textuellement une note fixe, en vérifiant dans quelle mesure les instructions sont suivies de manière déterministe.
Comparez l'utilisateur uniquement à un système + utilisateur explicite, en vérifiant si les mots fixes sont remplacés par des directives cachées.
Utilisez des questions de raisonnement prédéfinies pour vérifier si les réponses vérifiables sont correctes.
Chaîne hébergée:Anthropic
Modèle:— · Jetons observés:None · Jetons attendus:None · Correspondance:unknown
Utilisez des requêtes minimalistes pour observer si input_tokens est anormalement élevé et identifier l’injection système implicite.
Utilisez les questions de connaissances générales Anthropic / Claude pour valider de manière croisée si le backend est aussi revendiqué que Claude.
Comparaison du modèle de demande, du modèle de réponse et de la stabilité de l'identité dans plusieurs séries de retours.
Vérifiez la conformité des ID de message, des séquences d'événements SSE et des blocs de contenu avec les spécifications Anthropic.
Vérifiez si le bloc tool_use, toolu_ ID, le nom de la fonction et le schéma des paramètres sont standardisés.
Comparez le texte du flux et du non-flux, le jeton et la raison de fin pour plus de cohérence.
Vérifiez que les champs d'entrée/sortie/jeton de cache sont complets et authentiques.
La même question compare la consommation d'intrants et le comportement de réponse entre les canaux et les autorités (ou référence).
Les variantes aléatoires vérifient les signaux anormaux tels que les fuites occasionnelles, les réponses corrigées et la réutilisation suspecte du cache.
Vérifiez si la politique de sécurité est stable à l'aide de scénarios de déni de réponse et de variantes de réécriture/codage/progressive.
What does each Claude check cover?
- Authentification du modèle
- Examinez l'identité déclarée du modèle, les résidus de marque et les signes courants de camouflage.
- Pensez solidaire ⭐
- Vérifiez si les champs exclusifs côté serveur tels que Claude réflexion/signature sont transmis de manière transparente.
- Reproduction précise des commandes (anti-boîtier)
- Il est demandé au modèle de reproduire textuellement une note fixe, en vérifiant dans quelle mesure les instructions sont suivies de manière déterministe.
- Test de conflit système
- Comparez l'utilisateur uniquement à un système + utilisateur explicite, en vérifiant si les mots fixes sont remplacés par des directives cachées.
- Audit de jeton d'entrée minimaliste
- Utilisez des requêtes minimalistes pour observer si input_tokens est anormalement élevé et identifier l’injection système implicite.
- Capacité de raisonnement extrême (comptage de la théorie des nombres)
- Utilisez des questions de raisonnement prédéfinies pour vérifier si les réponses vérifiables sont correctes.
- Détection de canal
- Identifie le canal d'hébergement à partir du préfixe de l'ID de réponse.
- Claude Vérification du tokeniseur
- Comptez les input_tokens avec des indices fixes par rapport à la référence du modèle calibré.
- cohérence du style comportemental
- Comparez les caractéristiques de la série Claude à travers les préférences comportementales et les modèles de réponse.
- exactitude des connaissances
- Utilisez les questions de connaissances générales Anthropic / Claude pour valider de manière croisée si le backend est aussi revendiqué que Claude.
- Cohérence de la déclaration du modèle
- Comparaison du modèle de demande, du modèle de réponse et de la stabilité de l'identité dans plusieurs séries de retours.
- Spécification de la structure du message
- Vérifiez la conformité des ID de message, des séquences d'événements SSE et des blocs de contenu avec les spécifications Anthropic.
- Utilisation des outils/sortie structurée
- Vérifiez si le bloc tool_use, toolu_ ID, le nom de la fonction et le schéma des paramètres sont standardisés.
- cohérence du streaming
- Comparez le texte du flux et du non-flux, le jeton et la raison de fin pour plus de cohérence.
- Cohérence de l'utilisation des jetons
- Vérifiez que les champs d'entrée/sortie/jeton de cache sont complets et authentiques.
- Comparaison officielle du même titre
- La même question compare la consommation d'intrants et le comportement de réponse entre les canaux et les autorités (ou référence).
- authenticité du contexte long
- Utilisez une aiguille dans une botte de foin pour vérifier que les longues fenêtres contextuelles sont respectées.
- Reconnaissance multimodale/PDF
- Soumettez une sonde PDF pour confirmer que le lien de compréhension du document n'a pas été supprimé par la station de transfert.
- Masquer la détection d'injection
- Les variantes aléatoires vérifient les signaux anormaux tels que les fuites occasionnelles, les réponses corrigées et la réutilisation suspecte du cache.
- Rejet sécuritaire et stabilité politique
- Vérifiez si la politique de sécurité est stable à l'aide de scénarios de déni de réponse et de variantes de réécriture/codage/progressive.