Model Purity Check | выявление подмены моделей в AI API реле
AIBench.cc проверяет чистоту модели через response model fields, self-identity, tokenizer counts и protocol probes, чтобы выявить model swapping, downgrade или quantization risk.
Краткий ответ
Model purity check помогает понять, действительно ли запрошенный model id обслуживается нужной моделью. AIBench сравнивает response model fields, self-reported identity, tokenizer count deviations и protocol behavior, затем помечает противоречивые сигналы как suspicious или downgraded.
Как это работает
- 1Прочитайте model или modelVersion fields из ответа.
- 2Попросите модель self-identify и сопоставьте model-family keywords.
- 3Сравните tokenizer counts с известными baseline на коротком prompt.
- 4Объедините error codes, cache fields и usage schema в risk grade.
Сценарии
- Есть подозрение, что реле заменило большую модель меньшей.
- Нужно проверить, не делает ли дешевый канал silent downgrade.
- Отфильтровать непрозрачных API провайдеров перед закупкой.
- Разобрать резкое изменение качества или стиля ответа.
Ключевые метрики
model field
Название модели, заявленное ответом
Self-identity
Как модель отвечает на identity prompts
Tokenizer deviation
Попадают ли token counts в ожидаемые диапазоны
Protocol behavior
Error codes, cache fields и usage schema
Чистота модели - не один сигнал
Реле могут использовать aliases, fallback, quantization или account pools. AIBench показывает несколько evidence points, потому что один сигнал может вводить в заблуждение.
Почему результат градуируется
Self-identity зависит от system prompts, а tokenizer baselines могут отличаться. Градуированный результат честнее и проще для ревью, чем binary claim.
Связанные запросы
FAQ
Может ли model purity check доказать подмену на 100%?
Нет. Он дает сильные risk signals и проверяемые evidence, но удаленный probe не заменяет внутренний аудит поставщика.
Почему один model name дает разные результаты?
Канал может использовать aliases, fallback, account pools или rollout rules. Повторите тест с фиксированным временем, регионом и prompt.
Руководства и сравнения
Запустить реальную проверку API
Вставьте временный тестовый ключ и проверьте задержку, чистоту модели, кеш, лимиты и стоимость.