你以为自己在调用GPT-4o,后台可能跑着一个廉价的开源模型——API中间商偷换模型早就不是秘密。但怎么抓住它?布拉格经济大学的研究员托马什·布鲁克纳给出了一个几乎零成本的答案:让模型“想一个1到100之间的随机数”,反复问。输出的结果不是随机数,是模型指纹。
布鲁克纳测试了165个模型,每个问30次随机数。结果充满怪癖:GPT-4o明显偏爱42和37,仿佛这两个数字刻在了它的骨头上;Claude Sonnet 5对47有种近乎强迫症的执着,输出占比高得离谱;而Qwen3-Max简直像被编程了一样,30次全部吐出42。这些偏好不是偶然,它们构成了每条模型独一无二的行为指纹,比查API返回的model字段诚实多了。
实用性远超预期。只需大约120次请求,这套方法就能以10.6%的错误率确认模型真身。不需要解析权重,不用跑复杂基准,纯靠随机数偏好就能让偷换模型的中间商现出原形。对于被API中转站坑过的人来说,这就像随身带了一面照妖镜,轻巧、直接,让套壳无处遁形。

