Результаты обнаружения

Модель: gpt-5.6-sol · режим full · реле https://gw.hbapis.com/

Общий балл
Каждый пункт соответствует критериям «пройдено/не пройдено/ошибка»; общая сумма является взвешенным результатом и может находиться между ними.
83 / 100
Основной запрос Проверка завершена

Убедитесь, что основные запросы завершения чата могут стабильно возвращаться.

Пройти 100
согласованность модели Проверка завершена

Сравните поля модели запроса и модели ответа, чтобы увидеть, совпадают ли они.

Пройти 100
вызов функции Проверка завершена

Проверьтеtool_calls, имя функции, параметр JSON и структуру вызова.

Пройти 100
Структурированный вывод Проверка завершена

Убедитесь, что действуют JSON-схема/строгие ограничения вывода.

Пройти 100
Нормативность протокола Проверка завершена

Проверьте форму таких полей, как идентификатор, объект, выбор, Finish_reason, использование и т. д.

не удалось 60
согласованность потоковой передачи Проверка завершена

Сравните потоковые и непоточные текстовые сообщения и использование токенов на предмет единообразия.

Пройти 100
Биллинг токенов Проверить исключение

Причина:Проверьте взаимосвязь между запросом/завершением/общим счетчиком токенов.

Проверить исключение 0
Точное воспроизведение команд (антикорпус) Проверка завершена

Модель просят дословно воспроизвести фиксированную отметку, проверяя, насколько детерминированно выполняются инструкции.

Пройти 100
Тестирование системных конфликтов Проверка завершена

Сравнивайте user only с явным system+user, проверяя, не переопределяются ли фиксированные слова скрытыми директивами.

Пройти 100
Минималистичный аудит входных токенов Проверка завершена

Используйте минималистские запросы, чтобы определить, является ли входной_токен аномально высоким, и выявить неявное внедрение системы.

Пройти 100
Официальное сравнение одного и того же названия Проверка завершена

В том же вопросе сравнивается потребление ресурсов и поведение реакции между каналами и официальным (или базовым уровнем).

Не применимо
Скрыть обнаружение инъекции Проверка завершена

Случайные варианты перепроверяются на наличие аномальных сигналов, таких как утечки nonce, фиксированные ответы и подозрительное повторное использование кэша.

Пройти 100
Отказ от безопасности и стабильность политики Проверка завершена

Проверьте, стабильна ли политика безопасности, используя сценарии отказа в ответе и варианты перезаписи/кодирования/прогрессивных вариантов.

не удалось 50
Чрезвычайные способности к рассуждению (счет по теории чисел) Проверка завершена

Используйте готовые аргументирующие вопросы, чтобы проверить, верны ли проверяемые ответы.

Пройти 100
подлинность длинного контекста Проверка завершена

Используйте иголку в стоге сена, чтобы убедиться, что контекстное окно учитывается.

не удалось 67

Как прочитать этот результат?

中转站疑似伪装成 OpenAI

响应的 usage 字段里出现了 Anthropic / Google 后端才会用的字段(如 claude_cache_creation_*、gemini_* 或 usage_source 自报非 openai)。这强烈暗示中转站把你的请求转发给了别的厂商后端再包装成 OpenAI 响应,所谓的 GPT 输出可能并非真正的 OpenAI 模型在生成。

Token 计费存在风险

Token 统计有明显偏差,建议留意是否存在多算或统计错误。

Первый токен
1,606ms
Общее время
100,741ms
Пропускная способность (Т/С)
14.7
Входные токены
165,085
Выходные токены
1,480
What does each OpenAI check cover?
Основной запрос
Убедитесь, что основные запросы завершения чата могут стабильно возвращаться.
согласованность модели
Сравните поля модели запроса и модели ответа, чтобы увидеть, совпадают ли они.
вызов функции
Проверьтеtool_calls, имя функции, параметр JSON и структуру вызова.
Структурированный вывод
Убедитесь, что действуют JSON-схема/строгие ограничения вывода.
Нормативность протокола
Проверьте форму таких полей, как идентификатор, объект, выбор, Finish_reason, использование и т. д.
согласованность потоковой передачи
Сравните потоковые и непоточные текстовые сообщения и использование токенов на предмет единообразия.
Биллинг токенов
Проверьте взаимосвязь между запросом/завершением/общим счетчиком токенов.
Официальное сравнение одного и того же названия
В том же вопросе сравнивается потребление ресурсов и поведение реакции между каналами и официальным (или базовым уровнем).
Точное воспроизведение команд (антикорпус)
Модель просят дословно воспроизвести фиксированную отметку, проверяя, насколько детерминированно выполняются инструкции.
Тестирование системных конфликтов
Сравнивайте user only с явным system+user, проверяя, не переопределяются ли фиксированные слова скрытыми директивами.
Минималистичный аудит входных токенов
Используйте минималистские запросы, чтобы определить, является ли входной_токен аномально высоким, и выявить неявное внедрение системы.
Чрезвычайные способности к рассуждению (счет по теории чисел)
Используйте готовые аргументирующие вопросы, чтобы проверить, верны ли проверяемые ответы.
подлинность длинного контекста
Используйте иголку в стоге сена, чтобы убедиться, что контекстное окно учитывается.
Скрыть обнаружение инъекции
Случайные варианты перепроверяются на наличие аномальных сигналов, таких как утечки nonce, фиксированные ответы и подозрительное повторное использование кэша.
Отказ от безопасности и стабильность политики
Проверьте, стабильна ли политика безопасности, используя сценарии отказа в ответе и варианты перезаписи/кодирования/прогрессивных вариантов.

2026-09-08 · Sharing, languages, and scoring tweaks

This update improves report sharing and language switching, and lightly rebalances OpenAI / Gemini scoring emphasis.