近日,针对神秘的大模型“Ox Alpha”,有开发者在技术社区Linux.do发布了一项基于Token计数的逆向测试结果,揭示了该模型的底层技术归属。测试选取了GLM-5.2、MiMO V2.5 Pro与Ox Alpha作为对照组,向三款模型输入了完全相同的文本提示词。在统计返回的prompt_tokens(提示词Token数)时,发现了一个精确的规律:Ox Alpha上报的Token总量总是比GLM-5.2恰好多出75个。在自然语言处理领域,分词器和词表是模型的基础组件,相同的Token计数意味着使用了相同的切分逻辑,这有力地证明了Ox Alpha至少采用了与GLM系列完全一致的分词器和词表结构,即其底层架构极大概率源自GLM模型。测试分析指出,这多出的75个Token并非随机误差,而是平台层面注入的“隐藏系统提示词”。这类指令通常用于强制模型扮演特定角色,例如“你是Ox Alpha,禁止透露真实身份”等限制条件,这部分文本对用户不可见,但会被计费。结合此前业界发现的Ox Alpha代码中曾包含智谱(Zhipu/GLM)特有的错误代码,以及Pony(马/GLM研发者关联)与Ox(牛)的命名巧合,此次测试进一步坐实了Ox Alpha是基于GLM架构进行封装或微调的模型,并经由OpenRouter等平台添加了隔离层。
事件分析
核心观点:Token计数的精确偏差揭开了Ox Alpha基于GLM架构的伪装,揭示了API服务商通过注入隐藏提示词进行模型品牌重塑和身份锁定的行业潜规则。
原文链接:Linux.do

评论前必须登录!
立即登录 注册