中转站套壳,只要一个数字就能拆穿它
AIPress(AI普瑞斯)
现在网上的
AI
中转站、小众
AI
平台越来越多,很多商家都打着
“
自研新模型
”
的噱头引流,但实际上是
“挂羊头卖狗肉”的
套壳货。
说白了就是转手调用主流大模型的接口,换个界面、改个包装,就假装是自己研发的模型,普通用户根本看不出来。

最近,
布拉格经济大学
的研究员托马什·布鲁克纳(Tomáš Brückner)给这个问题找到了一个解法。
他在7月11日挂到
arXiv
上的论文《One Token Is Enough》里说:
识别一个模型是谁,一个Token就够了。

论文中提出的
这套FIT-Print识别方法门槛极低,无需专业工具,
简单到让人怀疑。
他找了165个AI模型,反复
发送一句话:
给我一个1到100的随机数。
每个模型问30遍,然后
记录下每一次输出的数字,统计好这些数字的出现频率。
按理说,随机应该是没有规律的,但结果显然不是这样。

以
GPT-4o、
Claude Sonnet 5
、Llama3.3和Qwen3-Max
四款模型为例。
它们给出的答案分布完全不同且稳定:GPT-4o的30次回答里,42、37、57三个数字占了一大半;Claude Sonnet 5疯狂输出47;
Llama 3.3
的答案多数是53;最夸张的是Qwen3-Max,30次全部是42,一次都没变过。
而且不光是数字,随机颜色、随机动物、随机城市、抛硬币……10类任务、32万6千条请求,结论都一样:
对于AI模型来说,根本没有真正的随机。
布鲁克纳管这叫
Behavioral Fingerprint(行为指纹)
。
原理也很简单。
每一个大模型,无论是原生模型、微调模型还是量化压缩模型,都会因
训练数据、模型架构、参数权重、优化策略
的差异,形成独一无二的“
行为
指纹”。
这种
“
行为
指纹”
不会被中转套壳、界面包装、简单微调抹去,是模型与生俱来的
“
生物特征
”
。
而所有中转站的套壳操作,都只是“中转转发、换皮包装”,根本没有能力改动大模型底层的核心算法和参数。
哪怕中转站修改对话格式、过滤部分内容,
模型底层的单Token输出概率分布不会改变
,这就是可用于核验模型真伪的核心依据。
论文的实验数据显示:用40个任务(
10任务×4语言
)的完整测试,错误率只有7.3%;哪怕只用8个
任务
,错误率也能控制在11%以内。
快去给你的大模型要一个随机数,试试它有没有套壳吧。
(转载自:AI普瑞斯)
