【神秘模型 Union Alpha 登场】
继“牛来”Ox Alpha 之后,当地时间 9 月 16 日,OpenRouter 昨晚上又出现了一款身份不明的模型 Union Alpha。官方将其描述为一款面向研究、编程和智能体工作流的多模态模型,能在广泛通用任务中提供“前沿级性能”。和 Ox Alpha 一样,它未公布开发团队、参数规模、训练方法和基准测试成绩,先以免费模型形式向用户开放,让开发者“盲测”,这种方式吸引了大量用户尝试。
【Union Alpha 的性能与特点】
OpenRouter 披露,Union Alpha 上线首日处理 Token 数量约 20 亿,截至发稿前,Token 消耗总量超 1000 亿。不过,外界尚未看到足够完整、可复现的第三方测试结果。它不是普通聊天场景大模型,拥有约 256K 的上下文窗口,单次最大输出长度达 131072 Token,支持文本和图片输入、文本输出,还支持工具调用等,目标场景指向代码库分析等。目前在 OpenRouter 上输入和输出价格为零,被标记为预览阶段的“隐身模型”,OpenCode 也接入并限时免费提供,且服务商遵循零数据保留政策。
【与 Ox Alpha 的对比】
从参数配置看,Union Alpha 与 Ox Alpha 有相似之处,如匿名上线、免费试用,强调编程等,最大输出都达 131072 Token,但 Union Alpha 上下文窗口 256K 小于 Ox Alpha 的 1048576 Token。OpenRouter 描述其重点在推理、编程和工具使用能力上。
【“前沿级性能”存疑】
Union Alpha 最引人注意的是“前沿级性能”表述,但 OpenRouter 未公布支撑结论的具体数据,模型页面无常见基准测试成绩,也无与其他模型的直接对比,模型架构等信息同样未公开。所以,不能仅凭产品介绍认定它达到当前头部闭源模型水平。
【网友测试情况】
该模型发布后引发大量围观和热议。在 x 上,有用户认为它聪明、有视觉能力、说话风格像 GPT,但也有用户觉得速度极慢,在 DeepSWE 中性价比略优于 Opus 5 和 GLM - 5.3。x 用户 Mike Gannotti 团队运行测试,Union Alpha 得分 136/157 (86.6%),零错误,成本 0 美元,他认为推理和工具方面完美,问题在代码编写上,还对比得出 Union 在编码等方面表现更好,Ox 写作能力更强、上下文信息窗口更长。部分早期测试者认为它在生成完整应用等方面表现不错,名为 Ananth 的用户强调其在 DeepSWE 上得分 74 与 GPT - 6 Astra 匹配等。但也有用户对其实际智能体能力持保留态度,如在 Reddit 讨论中,有人推测其知识截止时间,有人认为难判断能否稳定完成长周期任务,还有用户试用时遇到无结果返回等情况。
【真实身份猜测】
和 Ox Alpha 一样,Union Alpha 的真实身份成焦点。常见猜测有尚未发布的 Claude Opus 更新、OpenAI 新模型 GPT - 6 Sol、Mistral 新一代旗舰模型等。在 x 上有用户认为是 OpenAI 的 GPT 6 Luna 模型,一位中国用户给出猜测理由,如使用感受、时间点等,但也有人反对,指出预计价格、识别特征等不符。还有网友猜测是国产模型,如 Qwen 4.0 27B、GLM 5.4 等,但均未得到证实,且存在上下文长度等方面的质疑。也有人猜测来自美国或欧洲厂商,指向 Mistral。不过,这类测试难成可靠证据,模型拒答策略等可调整,让模型回答“你是谁”的内容不能作身份证明。目前能确认的是,它由匿名第三方模型提供商开发,OpenRouter 不是开发者,有关各方的说法均为网友猜测。
【匿名盲测走红背后】
Union Alpha 让人联想到 Ox Alpha,当时 Ox Alpha 以匿名模型登陆 OpenRouter,最终被证实是智谱推出的 GLM - 5.3 - Flash,匿名测试为智谱弱化了品牌偏见。Union Alpha 复制了先隐藏开发者身份,积累调用量和反馈再揭晓的路径,这种方式成大模型发布新型预热机制。传统模型发布是厂商先公布信息用户再验证,匿名模型颠倒顺序,可收集反馈和测试无品牌光环下的评价,但也存在问题,如平台和模型方暂不公开关键信息,免费 Token 带来的调用量不能直接证明模型能力领先。对 Union Alpha 而言,上线首日处理约 20 亿 Token 说明市场有兴趣,但调用量不能代替严格评测,模型最终认可还得看自身性能。那么,Union Alpha 能否凭借自身实力获得大众认可呢?