最近两天突然出现一个叫 Ox Alpha的匿名模型,直接免费开放,还带 100 万 token 的上下文窗口。作为一个平时主要靠 AI写代码、跑 agent 的独立开发者,我第一时间就去试了,也把大家的讨论整理了一下,跟大家分享一下目前能确认的信息。
在这里插入图片描述

它到底是什么?

Ox Alpha 是 2026 年 8 月 20 日左右悄然上线的“stealth”(隐身)模型。官方描述很直接:面向高效编码、持续 agent 工作流和真实生产场景的 frontier 推理模型。

核心参数目前公开的是:

  • 上下文窗口:1,048,576 tokens(约 100 万)
  • 最大输出:约 131,072 tokens
  • 多模态输入:文本 + 图像 + 视频
  • 目前价格:免费(预览期,预计持续约一周,到 8 月 27 日前后可能结束)
  • 声称服务能力:每日约 100 万亿 tokens,rate limit 非常宽松

推特上大家在猜什么?

推特上讨论非常热闹,核心问题只有一个:谁做的?

目前最主流的观点指向智谱(Zhipu AI / Z.ai)的下一代 GLM 系列,可能性较高的是 GLM-5.x 相关版本(有人推测是 GLM-5.3 Flash 或更强的统一多模态版本)。依据主要来自社区指纹分析:

  • Tokenizer 在多个 prompt 上的 token 计数几乎与 GLM-5.3 完全一致,仅存在固定偏移。
  • 视频编码器的帧采样、分辨率缩放等行为与 GLM-5V 系列高度吻合。
  • 对音频输入的拒绝方式也与智谱现有模型一致。

也有人提过小米 MiMo 或其他国内实验室的可能性,但目前证据链更偏向智谱。官方尚未认领,一切仍属社区推断。Manifold 等预测市场也把智谱的概率压得较高。

实际表现如何?

从社区分享的测试来看:

  • 在部分 DeepSWE(真实代码库漏洞修复)子集任务上,有人测出约 80% 的平均分,高于同期部分 Claude 和 GPT 变体。
  • Kingbench 等榜单上约 87.5%,接近或略低于公开的 GLM-5.3。
  • 编码和长上下文推理表现亮眼,尤其在需要理解完整代码库、规划多步任务时。
  • 缺点也有反馈:速度偏慢、工具调用偶有不稳定、部分场景还有小 bug。

我个人的体感是:它更适合做“硬核推理 + 长上下文编码”的场景,比如一次性喂完整项目、让它规划架构或找深层 bug。如果是需要高频快速迭代、重度工具调用的 agent 工作流,目前可能还需要配合其他模型使用。

怎么快速使用?

国内的中转平台也已经上架 ,访问 https://tokenra.io 找到Ox Alpha模型,选择模型ID:stealth/ox-alpha, 通过OpenAI 格式调用即可,具体以当前文档为准。

写在最后

对独立开发者来说,最大的价值就是:在官方正式发布前,能低成本摸到接近前沿的能力,尤其是 100 万上下文 + 多模态,对做复杂 agent 或代码理解类工具的人来说很有吸引力。

如果你已经试用过,可以评论区交流一下经验,比如和Claude或其他模型对比怎么样?

Logo

欢迎加入DeepSeek 技术社区。在这里,你可以找到志同道合的朋友,共同探索AI技术的奥秘。

更多推荐