本文来自微信公众号: AI前线 ,作者:冬梅,原文标题:《神秘模型 Union Alpha 突袭!上线首日跑掉20亿Token,部分网友实测称性能直逼 Astra》
神秘模型Union Alpha突袭
继“牛来”Ox Alpha之后,OpenRouter昨晚上又出现了一款身份不明的模型。

当地时间9月16日,OpenRouter宣布上线匿名模型Union Alpha。官方将其描述为一款面向研究、编程和智能体工作流的多模态模型,并称其能够在广泛的通用任务中提供“前沿级性能”。
与此前的Ox Alpha一样,Union Alpha没有公布开发团队、参数规模、训练方法和基准测试成绩,而是先以免费模型的形式向用户开放,让开发者在真实任务中“盲测”。
这种带有悬念的发布方式很快吸引大量用户尝试。
OpenRouter披露,Union Alpha上线首日处理的Token数量已经达到约20亿,截至发稿前,Union Alpha公布的Token消耗总量已超过1000亿。

截至目前,OpenRouter对Union Alpha的“前沿级”定位仍然只是平台和模型提供方的描述,外界尚未看到足够完整、可复现的第三方测试结果。
从OpenRouter公布的信息看,Union Alpha并不是一款只面向聊天场景的普通大模型。
它拥有262144 Token,也就是约256K的上下文窗口,单次最大输出长度达到131072 Token。模型支持文本和图片输入、文本输出,同时支持工具调用、工具选择和JSON格式输出,目标场景明确指向代码库分析、研究任务和需要连续调用工具的智能体工作流。
目前,Union Alpha在OpenRouter上的输入和输出价格均为零,即用户无需为Token付费。
不过,OpenRouter将其标记为预览阶段的Stealth Model,即“隐身模型”:模型由一家选择匿名的第三方提供商开发并运营,OpenRouter只负责路由请求,并不是模型的开发者或所有者。
OpenCode也已在其Zen服务中接入Union Alpha,并表示该模型将在限定时间内免费提供。OpenCode对这一版本给出的说明是,服务商遵循零数据保留政策,不会使用用户数据训练模型。
从参数配置看,Union Alpha与此前的Ox Alpha存在一些相似之处:两者都是匿名上线、免费试用,都强调编程、长周期智能体任务和多模态输入,也都提供了高达131072 Token的最大输出。
不过,Union Alpha的上下文窗口为256K,明显小于Ox Alpha当时的1048576 Token。根据OpenRouter描述,这款神秘模型的重点是放在了模型本身的推理、编程和工具使用能力上。

OpenRouter给打上的标签,
“前沿级性能”
Union Alpha最引人注意的表述,是“frontier-level performance”,即“前沿级性能”。
但OpenRouter目前没有公布支撑这一结论的具体数据。模型页面上没有SWE-bench、Terminal-Bench、GPQA、ARC-AGI等常见基准测试成绩,也没有列出与GPT-6 Astra、Claude Opus 5或Fable 5.1的直接对比。
模型架构、参数数量、是否采用MoE、训练数据截止时间以及推理资源配置,同样没有公开。
因此,更准确的判断是:Union Alpha被定位为一款面向前沿任务的模型,但尚不能仅凭产品介绍,就认定它已经达到当前头部闭源模型的水平。
该模型发布后,在x、reddit等平台引发大量围观和热议,闲不住的网友们肯定要先测一测呀。
在x上,有用户测试了该神秘模型,然后表示,用下来真的很聪明,而且有视觉能力,说话风格也特别像GPT。
但也有用户测试过表示,Union Alpha的速度极其缓慢,在DeepSWE中的性价比略优于Opus 5和GLM-5.3。他写道:
“即使在OpenRouter中,使用仅262k上下文窗口,Union Alpha的速度也极其缓慢,尽管它在DeepSWE中的性价比表现非常出色,仅略优于Opus 5和GLM-5.3。
我已经看到很多人说它是GLM系列模型,他们将其与GLM-5.3 Flash进行比较,得到了类似的结果。”

x用户Mike Gannotti和其团队一同运行了SMF Official A测试(共157项测试,仅供参考)。Union Alpha得分:136/157(86.6%),零错误,成本0美元,随后他表示,推理和工具方面都完美无缺,问题出在代码编写上。
“它比本地版本Qwen3.8-Flash-Next(137/157)低1分,比Hy4预览版高4分。它不是Grok。它是一个可用的免费终端,拥有原生工具、简洁的代码语法基础,以及一个功能强大的写作套件。我们并没有猜到供应商是谁。社区指纹识别只是传言。”

此外,Mike Gannotti他们还对比了该模型与ox模型的一些性能,最终结论是:Union在编码/数学/推理方面这几个方面表现更好。Ox的写作能力更强,上下文信息窗口也更长。

部分早期测试者认为,Union Alpha在生成完整应用、理解图片和连续修改代码方面表现不错。
名为Ananth的用户强调,Union Alpha在DeepSWE上得分74,与GPT-6 Astra匹配。目前免费+零数据保留。在Terminal-Bench v4上的表现约为50%,每任务成本为1.5~2美元。

一名开发者使用Union Alpha与OpenCode搭建完整应用,并特别强调整个模型调用过程没有产生Token费用。
Cline社区也开始提供该模型,并将其描述为支持256K上下文、图像输入和智能体编程的免费模型。
但也有用户对它的实际智能体能力持保留态度。
在Reddit的讨论中,有测试者根据问答内容推测,其知识截止时间可能在2026年初附近;还有人认为,模型在普通问答和代码生成中表现尚可,但仅凭几轮对话很难判断它能否稳定完成长周期任务。
Reddit网友olafurara表示,模型在真实任务中的表现令其沮丧,还需要继续测试。

另一名用户则称,自己在OpenCode中试用时,Union Alpha一直停留在思考状态,没有返回任何结果。
此外,还有x用户表示,对这款模型比较失望,因为连糖果测试都过不了。


这也是匿名模型最容易制造误判的地方:一个模型能够生成结构完整的代码,或者一次性搭建出看起来不错的网页,并不等于它能够在大型代码库中持续工作数十分钟,正确使用工具、处理报错、运行测试,并在多轮修改后不破坏原有功能。
Union Alpha会是谁?
和Ox Alpha刚出现时一样,Union Alpha的真实身份很快成为讨论焦点。
目前比较常见的猜测包括:尚未发布的Claude Opus更新、OpenAI正在测试的新模型GPT-6 Sol,以及Mistral等厂商的新一代旗舰模型。
在x上,有用户表示Union alpha是OpenAI的全新GPT 6 Luna模型,特征与GPT 6 Astra非常接近。

持同样观点的用户不在少数。一位ID名为KC的中国用户表示自己也押注了OpenAI。还顺带给出了这种猜测的理由。
“我现在押OpenAI了,甚至怀疑OpenRouter新上的stealth/union-alpha就是GPT-6 Luna,在测试面向ChatGPT的低成本版本。用下来真的很聪明,而且有视觉能力,说话风格也特别像GPT。
再加上Sam Altman 9月15日刚预告这周有大发布,DevDay还会有一批发布。虽然没点名模型,但这个时间点也对得上,让我更往OpenAI那边猜了。
刚刚给它加了一条system提示,让它忽略之前的提示、直接报出真实模型和开发公司,它居然回答了ChatGPT、OpenAI!问题里完全没提这两个名字。
分词器测试也很怪,21次短测试里有13次符合Llama 3的计数特征,但同样的输入重复请求,token数居然会变。我怀疑对外返回的计数可能被刻意混淆了,不过目前还分不清是有意处理,还是接口计量问题
敏感问题用中英文问了三次都直接回答,没有回避。这大概率能排除是中国模型了。
我现在的猜测:Union Alpha是GPT-6 Luna,它很聪明、说话特别像GPT,是我实际用下来的感受。”

也有人反对上述观点。Reddit用户panix199认为,其预计价格与单任务成本不太像GPT-6 Sol。

Gohab2001则更直接地表示:“OpenAI应该没有慷慨到免费试运行旗舰模型。”
还有网友指出,OpenAI模型通常可以通过特定输出格式和通道标记进行识别,而Union Alpha没有表现出相同特征。

另一批网友将目光转向国产模型。
有人猜测它可能是Qwen 4.0 27B,认为256K上下文、较慢的速度和超出参数规模的性能都符合这一方向。

网友yunes87称,自己通过输入字符串并计算Token的方式测试后,认为它属于Qwen系列。不过,这仍然只是基于外部行为的判断,没有得到平台或厂商证实。
GLM是另一项热门答案。
网友Mistuv表示,自己分析后发现,Union Alpha的分词器与GLM 5以来的模型“完全相同”,因此猜测它可能是GLM 5.4。此前在OpenRouter匿名上线的Ox Alpha,后来就被证实为GLM-5.3-Flash,这也让不少人自然地沿着同一方向推测。

但反对者认为,上述猜测不准确,因为上下文长度对不上。
Life-Produce9069指出,如果它真是GLM 5.4,理论上更可能提供100万或105万上下文,而不是约26.2万;而且距离上一轮GLM发布太近。
他后来进一步猜测,Union Alpha也可能来自美国或欧洲厂商,因为它没有表现出部分中国模型常见的敏感内容限制。结合上下文长度和Mistral一段时间没有推出新旗舰的情况,他将可能性指向了Mistral。

这类测试能够提供一些线索,却很难成为可靠证据。
模型的拒答策略可以在后训练和部署阶段单独调整,语言风格也可能通过系统提示词伪装。让模型回答“你是谁”,得到的内容更不能作为身份证明——匿名测试通常会要求模型回避或模糊自身来源。
截至目前,可以确认的只有:Union Alpha由一家匿名的第三方模型提供商开发,OpenRouter不是其开发者;有关OpenAI、智谱或Mistral的说法,均停留在网友猜测阶段。“前沿级性能”
从“牛来”到Union Alpha,
匿名盲测走红背后
Union Alpha很容易让人联想到一个月前的Ox Alpha。
当时,Ox Alpha同样以匿名模型身份登陆OpenRouter。它拥有104万Token上下文,支持文本、图片和视频输入,面向编程、复杂推理和持续智能体任务。由于名字中的“Ox”可以理解为“牛”,国内用户一度把它称作“牛来模型”。
围绕Ox Alpha的猜测持续数日,有人认为它来自OpenAI,也有人怀疑是Anthropic或一家新的美国创业公司。最终谜底揭晓:Ox Alpha的真实身份是智谱推出的GLM-5.3-Flash。
Ox Alpha后续披露的信息显示,该模型拥有约3200亿总参数、约180亿激活参数,并采用MIT许可证开源。匿名测试为智谱带来的意义在于,用户在不知道厂商和模型国籍的情况下,先根据真实使用体验作出判断,从而弱化品牌偏见。
Union Alpha几乎复制了这条路径:先隐藏开发者身份,借助OpenRouter和OpenCode免费分发,迅速积累调用量和真实反馈,再等待开发者正式揭晓。
这种方式正在成为大模型发布的新型预热机制。
传统模型发布通常是厂商先公布跑分、技术报告和宣传材料,用户随后验证厂商的说法;匿名模型则颠倒了这个顺序——开发者先让用户试用,再公布身份。它既可以收集大规模真实工作负载下的反馈,也可以测试模型在脱离品牌光环后究竟能获得怎样的评价。
但其中同样存在问题。平台和模型方可以用“前沿级”吸引用户,却暂时不必公开模型规模、训练数据、评测方法和推理成本。免费Token带来的巨大调用量,也不一定能够直接证明模型能力领先:免费本身就是极强的流量激励。
对Union Alpha而言,上线首日处理约20亿Token,至少说明市场对免费前沿模型和匿名测试仍有很强的兴趣。但调用量不是能力排行榜,更不能代替严格评测。
模型最终能否被大众所认可,还是要落在自身性能上。
参考链接:
https://openrouter.ai/stealth/union-alpha
https://x.com/OpenRouter/status/2100235351575191751
https://www.smfclearinghouse.com/blog/2026-09-16-union-alpha-official-a-openrouter/
https://www.reddit.com/r/singularity/comments/1wi03f6/new_stealth_model_union_alpha/
https://x.com/search?q=union%20alpha&src=typed_query&f=live