ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

Ox Alpha:100万 Token 上下文、完全免费,这个神秘 AI 模型的幕后是谁?

Ox Alpha:100万 Token 上下文、完全免费,这个神秘 AI 模型的幕后是谁? 发布日期2026年8月24日 | 话题分类AI 模型动态 | 时效性本文基于2026年8月24日公开数据Ox Alpha 是 2026年8月20日在 OpenRouter 上匿名上线的神秘 stealth 推理模型支持文本、图像、视频三模态输入上下文窗口约100万tokens预览期完全免费。技术指纹分析高度指向智谱AIZhipu AI未发布的GLM-5.x多模态变体——分词器与GLM-5.3精确对齐视频编码器行为与GLM-5V-Turbo完全一致。用户组织的DeepSWE编程测试中Ox Alpha 以约80%通过率超越多款主流旗舰模型并以51,469项回归测试全部通过、69次工具调用仅出错1次获得开发者认可目前可通过 OpenRouter API 免费接入适合大型代码库审查和长流程 Agent 工作流但因来源不明不建议提交敏感数据。Ox Alpha 是一个没有官方发布公告、没有技术报告、没有开发者署名的 AI 模型——但它在上线四天内登上了 Bloomberg、TechCrunch、The Next Web 等12家国际媒体的报道。这种反常的爆发背后有三条硬线索。为什么Ox Alpha在开发者社区爆火Ox Alpha 的出现方式打破了惯例。2026年8月20日一个自称stealth的匿名提供商在 AI 模型聚合平台 OpenRouter 上线了这一模型模型ID为stealth/ox-alpha没有任何官方声明。三个关键因素让它迅速被引爆完全免费预览期内每日声称可处理100万亿tokensAPI调用零费用无需信用卡或注册信息罕见的超大上下文1,048,576 tokens的上下文窗口可容纳完整代码仓库或超长技术文档编程测试表现抢眼在用户自组织的编程任务测试中Ox Alpha以约80%通过率超越了同期参测的多款主流旗舰模型截至2026年8月24日该模型已累计处理超过180亿 tokens的编程 Agent 流量36Kr 以牛来了为题跟进X 平台讨论量持续攀升。技术规格100万 Token 上下文能做什么Ox Alpha 的核心规格如下参数数值模型IDstealth/ox-alpha上线日期2026年8月20日OpenRouter上下文窗口1,048,576 tokens约100万最大输出131,072 tokens输入模态文本 图像 视频不含音频架构推测MoE约744B总参数 / 40B活跃参数吞吐量中位数28 tokens/秒响应延迟中位数约4秒定价预览期免费100万token的上下文窗口意味着可以将整个大型代码库直接粘贴进对话或同时输入一份完整的法律合同及全部修订历史。但独立研究者也明确指出大上下文窗口不等于模型能有效利用每一个token——目前缺乏对超长输入下实际表现的独立验证数据这一能力边界有待观察。幕后黑手是谁证据全梳理目前证据最充分的推测是Ox Alpha 是智谱AIZhipu AI未公开发布的 GLM-5.x 多模态变体。独立研究员 Ben Davis 对25个不同提示进行了系统性测试汇总出四条关键指纹证据证据一分词器精确对齐Ox Alpha 与 GLM-5.3 的 token 计数完全一致仅存在固定的 75 token 隐藏包装差异强烈暗示双方共享同一词汇表。证据二视频编码器行为完全一致四组视频测试中Ox Alpha 与 GLM-5V-Turbo 的 token 消耗完全相同采样率约 147 tokens/秒帧率无关——这种精确匹配在概率上难以归因于巧合。证据三API 错误代码关联错误代码1210曾被记录与 Z.ai智谱旗下平台相关联触发错误时返回中文错误日志。证据四排除其他候选模型小米 MiMo v2.5支持音频输入而 Ox Alpha 明确拒绝音频、Qwen 3.8 Max视频编码器特征存在明显差异均被排除。候选模型排除理由小米 MiMo v2.5支持音频输入而 Ox Alpha 不支持Qwen 3.8 Max视频编码器特征明显不同GLM-4.6V视频编码行为与 Ox Alpha 不匹配社区结论99%确定 Ox Alpha 属于智谱AI未发布的 GLM-5.x 系列。公开版 GLM-5.3 仅支持文本若推测成立Ox Alpha 是其首个多模态变体的外部压测版本——免费放量正是大规模正式发布前进行真实流量测试的典型策略。Benchmark 测试它真的超越了旗舰模型吗Ox Alpha 最广为流传的数据来自用户自组织的DeepSWE 编程任务测试共10个子任务模型DeepSWE 得分用户测试Ox Alpha~80%Claude Fable 5~65%GLM-5.3~62%Grok 4~62%GPT-5.6 Sol~52%⚠️ 重要背景说明上述数据来源于10个任务的小样本用户测试非官方基准审计。DeepSWE 与行业标准 SWE-bench Verified 是不同测试集不可直接横向比较——在完整的 SWE-bench Verified 上多款主流模型得分均在96%以上。更具说服力的单项亮点Meriyah Explicit Resource Declarations任务Ox Alpha 首次尝试即通过而该任务此前记录中其他3款参测主流模型的得分均为0/4全量回归测试通过全部51,469 项回归测试零失败Agent工作流稳定性69次工具调用中仅出错1次无重试循环多名开发者报告发现了 Python 项目中其他工具遗漏的2个真实 bug如何免费接入 Ox Alpha三种方式方式一OpenRouter API开发者首选兼容标准 OpenAI SDK预览期 token 费用为零fromopenaiimportOpenAI clientOpenAI(base_urlhttps://openrouter.ai/api/v1,api_keyYOUR_OPENROUTER_API_KEY,)responseclient.chat.completions.create(modelstealth/ox-alpha,messages[{role:user,content:审查以下 Python 代码的潜在 bug}])print(response.choices[0].message.content)对于同时使用多款模型的开发者统一的 API 接入层可以避免在不同平台间频繁切换密钥和格式。国内的七牛云 Token Planqiniu.com/ai/plan支持通过单一接口管理多款主流大模型的调用对于需要横向评测 Ox Alpha 与其他模型的场景可作为对比测试的统一入口。方式二OpenCode 集成在 OpenCode 中连接 Zen 提供商使用/models命令选择模型标识符为x-preview-f-free。方式三无代码 Playground访问 oxalpha.com通过 OpenRouter 账号登录即可在网页端直接测试无需任何配置。适合哪些场景不适合哪些场景推荐场景大型代码库审查100万 token 上下文是核心优势无需拆分代码库即可整体输入长流程 Agent 工作流69次工具调用出错率极低适合多步骤自动化任务前端界面生成与迭代用户实测反馈好于同期多款免费模型回归测试辅助51,469项回归全部通过表明代码理解的系统性较强不推荐场景对响应速度敏感的实时应用4秒延迟 长推理时间不适合低延迟场景从零构建复杂后端系统实测稳定性有波动结果不一致音频输入的多模态任务明确拒绝音频生产环境敏感数据处理见下方隐私风险说明使用前必读风险与局限隐私风险OpenRouter 列明匿名提供商会保留提示和输出内容声称不用于训练与 OpenCode 平台宣传的零数据保留存在矛盾。建议在使用时不提交密码、个人身份信息或专有商业代码。来源不透明开发者身份至今未公开无技术报告无模型卡运营条款不明。Nous Research 等开发者已将其集成进 Hermes Agent 工作流属于基于自测的主动采纳而非经官方认证的合规接入。定价不确定性预览期免费策略可能随正式发布而改变将其纳入生产链路存在中断风险。X 平台研究员 VaibhavSisinty 指出Ox Alpha 是六个月内在主要分发平台上出现的第五个 stealth 模型匿名发布测试后正式商业化的模式正在成为规律。常见问题QOx Alpha 是 GLM-5.3 吗目前证据高度指向智谱AI旗下 GLM-5.x 系列的未发布多模态变体但官方从未确认。公开版 GLM-5.3 仅支持文本而 Ox Alpha 支持图像和视频若推测属实则为更高规格的多模态版本。QOx Alpha 免费使用有什么限制截至2026年8月24日通过 OpenRouter 和 OpenCode 可免费调用API token 零费用无信用卡要求。但这是预览期政策随正式发布可能调整也不排除存在流量限速。QDeepSWE 80% 能说明 Ox Alpha 比 GPT-5 或 Claude 更强吗不能直接得出此结论。该数据来源于10个任务的小样本用户测试非官方审计。在完整的 SWE-bench Verified 基准上多款主流模型得分均超过96%——两个测试集之间不可横向比较。Q如何在 Cursor 或 VS Code 中接入 Ox Alpha将 OpenRouter 设置为自定义 API 提供商base_url 填https://openrouter.ai/api/v1模型 ID 设为stealth/ox-alpha支持自定义模型端点的编辑器插件均可使用。Q为什么有人认为 Ox Alpha 是中国实验室开发的除技术指纹外免费放量测试的策略、后端中文错误日志、与国内平台 API 错误代码的关联三者叠加使得社区倾向于中国实验室方向。Bloomberg、Business Insider 等媒体的报道也明确提及some suspect a Chinese lab。结语Ox Alpha 代表了一种新的模型发布模式以匿名stealth形式在真实开发者场景中进行大规模流量压测而不是发布技术报告后等待市场自然采纳。据独立研究员 Ben Davis 的分词器和视频编码器分析智谱AI极大概率是其开发方截至2026年8月24日Ox Alpha 已处理超过180亿 tokens的编程 Agent 流量运营方自报。对于开发者而言当下是以零成本测试这款模型的窗口期尤其适合大上下文代码审查和 Agent 工作流的能力评估。在将其纳入生产链路前建议先在非敏感代码上充分评估稳定性与数据隐私边界。本文内容基于2026年8月24日公开数据Ox Alpha 来源及商业化进展持续演变建议关注后续官方声明。延伸阅读Ox Alpha 技术规格页https://oxalpha.com/OpenRouter 模型接入https://openrouter.ai/stealth/ox-alpha多模型统一接入管理七牛云 Token Planhttps://www.qiniu.com/ai/plan
返回列表