「牛来」之后,匿名模型 Omen Alpha 又炸场海外:代码实测刷屏,真身仍是谜

8 月底,代号 Ox Alpha(牛来) 的匿名模型横扫 OpenRouter,后来被证实是智谱 GLM-5.3-Flash,把全球 AI 开发者圈震了一遍。仅仅两周,海外 AI 开发平台 OpenC…

#Omen Alpha#Ox Alpha#OpenCode#智谱#GLM#匿名模型#stealth#大模型出海更新于 2026-09-05
📑 本页目录

「牛来」之后,匿名模型 Omen Alpha 又炸场海外:代码实测刷屏,真身仍是谜

本文关键参数与定价已对照 OpenCode 官方数据核验(opencode.ai 与 models.dev,2026-09-04 更新);模型归属为社区推测,尚未获得厂商官宣,文中已逐处标注。

导语

8 月底,代号 Ox Alpha(牛来) 的匿名模型横扫 OpenRouter,后来被证实是智谱 GLM-5.3-Flash,把全球 AI 开发者圈震了一遍。仅仅两周,海外 AI 开发平台 OpenCode 又悄无声息上线另一款 Stealth(隐身/匿名)模型:Omen Alpha

无白皮书、无官方模型卡、没有厂商官宣,只有代号、API 接口和开发者实测反馈。后台路径线索指向智谱 AI,疑似 GLM-5.x / Omni 系列迭代版本,主打代码生成、Agent 智能体、长上下文多模态生产级任务。

国产模型再次用「匿名灰度上线」模式,不打品牌光环,直接扔到真实海外生产环境接受硬核测试。


一、基本上线信息:哪里来、谁能用

上线时间: 2026-09-04,OpenCode 平台官方上线,定位 new stealth model(新型隐形模型)

访问权限:

  1. 原生入口:OpenCode Go 订阅会员专属(官方实测:OpenCode Go 是 10 美元/月的低价订阅,提供主流开源编码模型可靠访问)
    • 订阅月费:10 美元/月,官方宣传口号:花 10 美元获得 100 美元额度($100 usage for $10,平台推广口径)
    • 限流配额(OpenCode 官方订阅页实锤):每 5 小时最多 11,600 次请求;每周 29,000 次;每月 57,900 次——严格速率限制,防滥用
  2. 第三方聚合平台:已有第三方中转平台兼容 OpenAI 接口,可直接改 base_url 调用,降低接入门槛(生态现象,稳定性以实际为准)
  3. 重要现状:开发厂商至今没有公开认领。 OpenCode 后台数据路径命名空间标记为 zhipu,社区高度怀疑为智谱 GLM-5.x 系列变种(GLM-5.3 Air / Omni 分支),但没有官方确认,属于社区推论(请务必注意:线索指向,尚未官方官宣)

二、核心规格参数(已按官方数据核验)

项目 Omen Alpha 参数(models.dev 官方数据)
上下文窗口 50 万 token
最大单次输出 12.8 万 token
输入模态 文本 + 图像多模态输入(暂不支持视频输入,区别于 Ox Alpha)
核心能力 复杂推理、大规模代码生成、Agent 智能体、长文档处理(官方标记:reasoning / tool_call / 结构化输出 / 附件输入全支持)
接口兼容 OpenAI 兼容 API,几乎零改代码迁移
数据策略 零数据保留,用户输入不会留存训练(OpenCode Go 平台承诺)
官方标价 输入 0.20 美元/百万 token;输出 0.66 美元/百万 token;缓存读取 0.04 美元/百万 token

对照前辈 Ox Alpha:上下文 104 万 token,支持图文视频输入,上线初期免费;Omen Alpha 窗口减半、去掉视频输入、转为付费订阅模式,更偏向稳定生产使用。


三、社区实测表现:代码能力是王牌

目前没有官方基准跑分,全部来自海外开发者公开实测,集中在大型前端 3D 项目、复杂软件工程、Agent 任务。

典型测试案例:Three.js 大型 3D 场景生成

测试任务 1——完整火箭发射 3D 网页:

  • Omen Alpha:总耗时 11 分 50 秒,输出约 10.7 万 token,生成 728 行完整 Three.js 代码,自带多机位镜头、音效、倒计时、点火烟雾特效、完整动画流程,一次生成 + 自我修复完成,可直接浏览器运行
  • 对照组 GLM-5.3 Flash:耗时 20 分 47 秒,完整性、动画细节弱于 Omen Alpha

测试任务 2——火山喷发 3D 可视化:

  • Omen Alpha:9 分钟完成,866 行代码,7.3 万输出 token,火山岩浆、烟雾粒子系统完整可运行

开发者主观反馈汇总:

  • ✅ 长代码一次性生成能力强,大项目不需要大量拆分
  • ✅ 自带自我纠错,生成代码出现 bug 后,可在超长输出内部自行修复
  • ✅ Agent 链路稳定性好,适合循环迭代任务
  • ⚠️ 长推理任务速度会下降;限流严格,高并发场景容易触达平台配额上限
  • ⚠️ 没有官方跑分,全部是民间小样本测试,不代表通用能力全面碾压 GPT-5.6、Claude——代码垂直突出,通用能力仍待大规模验证

四、Omen Alpha VS Ox Alpha:两张匿名 Alpha 模型对比

维度 Ox Alpha(牛来) Omen Alpha
上线时间 2026-08 下旬 2026-09-04
推测归属 GLM-5.3-Flash(已官宣) GLM-5.x / Omni 分支(待官宣
上下文 104 万 token 50 万 token
多模态 文本 + 图像 + 视频 文本 + 图像,无视频
上线模式 OpenRouter 免费公测 OpenCode Go 付费订阅
定位 极限长上下文探索测试 生产级代码、Agent 稳定版本
价格 上线初期免费 订阅折扣付费模式
限流 宽松 严格分层请求限额

产品逻辑推测: Ox Alpha 做免费大规模压测,验证百万上下文、视频多模态;Omen Alpha 收敛为生产可用版本,降低上下文规模、砍掉视频能力,优化成本与稳定性,面向付费开发者。


五、商业模式解读:国产模型新玩法——匿名灰度出海

智谱连续两款模型采用匿名 stealth 隐身模式出海,这是非常值得思考的产品策略:

  1. 剥离品牌滤镜:不打「国产大模型」标签,海外开发者完全凭输出效果打分,不带预设偏见;好就是好,差直接被吐槽,拿到最真实的反馈
  2. 真实生产环境灰度测试:不局限实验室 benchmark 跑分,直接扔给全球开发者写代码、跑 Agent,暴露真实 bug、显存、推理延迟、长上下文衰减问题,收集真实反馈迭代模型,而不是靠论文跑分自嗨
  3. 分层产品矩阵:Ox Alpha 是技术预览测试版;Omen Alpha 是付费生产版本;后续再推出正式官宣版本,形成「匿名公测 → 付费灰度 → 正式发布」三步节奏
  4. 价格策略优势:对比海外闭源模型,Omen Alpha 定价具备明显成本优势,订阅打包模式进一步降低中小开发者门槛,抢夺海外 AI Agent、代码开发者市场

六、现存风险、疑问与局限(客观看待,不吹不黑)

  1. 厂商身份尚未官方确认:后台路径仅为线索,智谱官方还没有认领 Omen Alpha——社区推测,非官方实锤,避免传播不实信息
  2. 没有权威官方评测集:所有能力全部来自社区小范围实测,通用问答、数学、逻辑能力的完整水平未知,目前亮眼表现集中在代码生成场景
  3. 平台绑定和限流约束:原生只能 OpenCode Go 订阅使用,第三方中转稳定性不可控,请求数上限限制大规模企业业务直接落地
  4. 匿名模式的隐患:匿名上线模式下,一旦出现输出安全问题,责任主体模糊;海外社区也有一部分声音质疑这种「隐身发布」的透明度
  5. 上下文缩水:相比 Ox Alpha 104 万窗口缩减到 50 万 token,牺牲部分超长文档能力换取稳定性与推理成本优化

七、行业思考:国产大模型出海,正在换一套打法

过去国产大模型出海套路:开发布会、发白皮书、高调宣传参数,然后找渠道。Ox Alpha、Omen Alpha 走出完全不一样的路径:

先丢到海外开发者真实环境跑,用效果说话,火了之后再揭晓身份。

这代表国产大模型已经不再只追求纸面参数,而是更看重真实场景可用度。代码、Agent 是海外开发者最吃的赛道,国产模型连续两款匿名模型都瞄准这个赛道,已经在海外开发者圈层制造巨大声量。

当然热闹背后也要冷静:匿名灰度是很好的测试手段,但最终走向企业落地,依旧绕不开官方身份、完整评测报告、安全合规、SLA 服务保障。Omen Alpha 目前还是处在「灰度实验阶段」,距离大规模商用落地,还有一段距离。


结尾

短短两周,Ox Alpha 余热未消,Omen Alpha 接力登场。国产大模型正在以一种非常酷的方式,悄悄卷向全球开发者。

匿名隐身上线的玩法,到底会成为行业新范式,还是短期营销噱头?后续智谱官方的官宣,以及更多大规模第三方评测,将会给出答案。


本文来源说明:关键参数、定价、配额来自 OpenCode 官方(opencode.ai 订阅页与 models.dev 模型目录,2026-09-04 更新);社区实测与归属线索来自海外开发者社区公开信息;模型归属为社区推测,一切以厂商官方公告为准。