Vercel AI Gateway 上线 stealth 推理模型 Glyph Cluster,stealth 期免费:coding 实测指南与数据隐私红线
Vercel 在 10 月 7 日的 changelog 里上线了 stealth 推理模型 Glyph Cluster:面向 coding 与长上下文分析,支持 function calling 与流式输出,Pro / Enterprise 且购买过 AI Gateway credits 的团队在 stealth 期间免费调用(模型名 stealth/glyph-cluster),可在 Claude Code、Codex、Cursor 里直接切换。本文拆解它的能力定位、为什么独立开发者值得花一下午实测对比、AI Gateway 统一网关的 failover 与预算控制价值,以及必须先看清的三条限制:纯文本输入、无 structured outputs、无 ZDR——prompt 与 response 可能被用于训练,商业代码先定数据边界再喂。

Vercel 悄悄往 AI Gateway 里塞了一个新模型:Glyph Cluster,stealth 期间免费,模型名叫 stealth/glyph-cluster。官方 changelog 在 10 月 7 日上线了这条更新,措辞很克制——但克制的措辞背后,藏着一个对独立开发者相当友好的信号:一个为 coding 和长上下文分析调优的推理模型,现在可以零成本实测了。
这篇资讯把 changelog 里确认的事实拆开讲清楚:谁能免费用、这个模型到底擅长什么、怎么接进去,以及最重要的——免费背后那条没有写在标题里的数据隐私边界。
先讲事实:谁能免费,怎么免费
Glyph Cluster 的免费是有门槛的。只有 Pro 和 Enterprise 计划、并且购买了 AI Gateway credits 的团队,才能在 stealth 期间免费调用这个模型。注意措辞:免费的是 stealth 期间的调用额度,不是 AI Gateway 本身免费——你得先是付费计划用户,还得买过 credits。stealth 结束后按什么价格计费,changelog 里没有说。
这其实是 Vercel 一贯的玩法:先让真实用户在生产流量里把模型跑一遍,收集反馈、打磨定价。站在用户这边看,相当于官方开了一个"新推理模型试用通道"——你不用掏额外的钱,就能在真实任务里摸清这个模型的脾气。
接入方式给了三条路:AI SDK、OpenAI 兼容的 Chat Completions / Responses API,或者直接在 Claude Code、Codex、Cursor 这类 coding agent 里把模型切换成它。对已经在用这些工具的人来说,切换成本接近于零:下拉菜单里选一下,下一轮对话就是 Glyph Cluster 在干活。这种"换个模型名就能试"的设计,恰恰是做对比测试的最佳条件——同一任务、同一 prompt、不同模型,跑出来的差异一目了然。
CLI 一行命令开跑
官方给的接入命令也很短:
npm i -g vercel@latest
vercel ai-gateway setup
两行命令,AI Gateway 的鉴权和配置就位。没有复杂的 onboarding,没有要填的申请表。对于想快速验证的人来说,从看到 changelog 到跑起第一个请求,间隔可以压缩到几分钟。
这个模型到底是干什么的
changelog 对 Glyph Cluster 的定位写得很具体:一个为 coding 和长上下文分析设计的推理模型。关键词是"推理"——它不是快问快答的聊天模型,而是被调优来做多步工作的:规划、综合信息、定量推理、在大输入之间做对比分析。
翻译成开发者日常:它能 review 代码、解释失败原因、debug、提出修改建议、推演实现方案。注意这个能力清单的排序——review 和"解释失败"排在前面。这说明它的训练目标里,读懂现有代码、定位问题根因的权重很高,而不是只擅长从零生成代码。
这是一个值得细品的差异。市面上大部分 coding 模型都在卷"生成":给 prompt 吐代码,越快越好。但真实开发里,读代码的时间远多于写代码的时间——接手一个陌生仓库、排查一个诡异的线上 bug、review 队友的 PR,这些才是吞掉开发者时间的黑洞。一个在"读懂和解释"上更强的推理模型,打中的恰恰是成本最高的那部分工作。
function calling:推理能接到你自己的工具上
Glyph Cluster 支持 function calling,并且支持流式输出。这意味着 Agent 可以把它的推理过程接到自己的工具和系统上:查数据库、调内部 API、读写文件,推理不再是孤立的一段文字,而是一条可以驱动行动的链条。
对做 Agent 应用的人来说,这个组合(推理模型 + function calling + 流式输出)是标准答案。流式输出保证用户体验不卡顿,function calling 保证模型能动手干活,推理能力保证它动手之前先想清楚。三者缺一不可,而 Glyph Cluster 在 changelog 里把三者都点名了。
为什么独立开发者应该认真看这条更新
一人团队和独立开发者最缺的,从来不是模型,而是"便宜又能打"的 coding 推理模型。
算一笔直白的账:顶级的推理模型做深度代码分析,token 消耗是聊天场景的数倍。一个独立开发者做 code review、做架构推演、让 Agent 跑多步任务,一天烧掉的推理 token 很容易超过预期。贵模型的账单是按月结的,但焦虑是按天算的——每次点"发送"之前都要犹豫一下"这个问题值不值得用贵模型",这种犹豫本身就是生产力税。
stealth 期免费的意义就在这里:它把"试错成本"清零了。你可以在这两类任务上放开手脚实测:第一类是长上下文分析——扔进去整个模块的代码,让它做 review 和重构建议;第二类是多步推理——复杂 bug 的根因定位、跨文件的实现方案推演。免费期就是用来回答一个问题的:这个模型在你的真实工作流里,到底能不能替代你现在付费用的那个?
我的建议很具体:拿你上周真实遇到过的三个任务去跑它。不要用 benchmark 题,不要用 toy example,就用你自己的代码、你自己的 bug。benchmark 分数是给别人看的,你自己的任务通过率才是你的答案。如果它在你的任务上表现接近你现在用的主力模型,stealth 结束后的定价就是你唯一要等的变量。
AI Gateway 这层皮,价值被低估了
这条新闻的主角表面上是 Glyph Cluster,但真正值得留意的可能是 AI Gateway 本身。
AI Gateway 做的事情很简单:一个入口接多家模型。对独立开发者来说,这解决三个真实痛点。第一,failover:某个模型挂了、限流了、变慢了,请求自动切到备用模型,你的线上服务不用跟着一起宕机。第二,预算控制:credits 机制让你对 AI 开销有明确的上限和可见性,而不是月底收到一张看不懂的账单。第三,对比测试的便利性:同一套代码、同一个接口,换个模型名就能跑 A/B,不用为每个厂商写一套接入层。
反直觉的一点是:模型越多,统一网关的价值越大,而不是越小。很多人觉得"我就用一两个模型,要网关干嘛"。但现实是,模型格局变化太快了——这个月最好的 coding 模型,下个月可能就被反超。没有网关层,每次换模型都是一次小重构;有网关层,换模型就是改个字符串。Glyph Cluster 这种 stealth 新模型的出现,恰恰证明了这一点:它一上线就在 Gateway 里,Gateway 用户零成本试用,这就是基础设施的复利。
但是,先看清三条限制
changelog 把限制写得很老实,老实到值得逐条解读。
第一,纯文本输入。不支持图像和文件输入。这意味着你没法直接扔一张报错截图、一段 UI 走查图给它,一切都要先转成文字描述。对纯代码工作流这不是问题,但如果你习惯"截图 + 问一句"式的 debug,这个模型接不住。
第二,不支持 structured outputs。你没法要求它按固定 JSON schema 返回结果。这对 Agent 工作流是个实实在在的约束:需要严格结构化输出的环节(比如解析成固定格式的任务卡片),你得自己在外面套一层解析和校验,或者把这类任务留给支持结构化输出的模型。
第三,也是最重要的:没有 ZDR(zero data retention)。changelog 原话的意思是:你的 prompt 和 response 可能会被用于训练和模型改进。stealth 期间免费是有代价的,代价就是你的数据。
关于数据隐私,说得再直白一点
没有 ZDR 意味着什么?意味着你发给 Glyph Cluster 的每一行代码、每一个报错堆栈、每一段架构描述,理论上都可能进入未来的训练数据。对个人 side project,这通常不是问题;但对商业代码,这里有一条必须提前划好的线:
- 不要喂包含密钥、token、真实用户数据的代码。这是铁律,不管有没有 ZDR 都不该这么干,但没有 ZDR 时后果更严重。
- 专有算法和核心商业逻辑,先做脱敏再测。把关键业务逻辑抽象成等价但去业务化的版本去验证模型能力,能力验证和真实代码是两回事。
- 团队使用前先定政策。stealth 免费很容易让团队成员顺手就把生产代码粘进去。在免费期开始之前,先在团队里明确:什么能喂,什么不能喂。
这不是危言耸听。历史上因为"顺手把代码喂给 AI"导致泄露的案例,几乎每次的起因都是"当时没觉得这是个问题"。免费的 stealth 模型 + 顺手的工作流,这个组合恰恰是最容易让人放松警惕的。
一个值得思考的模式:stealth 模型正在变多
Glyph Cluster 不是第一个以 stealth 形态出现的模型。过去一年里,"先匿名上线、收集真实反馈、再公布身份"的发布模式越来越常见。对模型厂商来说,stealth 发布能拿到最真实的评测数据——用户不知道模型是谁,就不会有品牌偏见;对用户来说,stealth 期往往伴随着免费或低价,是低成本体验前沿模型的窗口。
但这个模式有个隐含的交换:你在用真实数据帮厂商调模型,厂商用免费额度买你的反馈。这笔交易本身是公平的,问题只在于很多人没意识到自己在参与交易。知道规则再上桌,和稀里糊涂上桌,是两回事。
现在可以做什么
如果你是 Vercel Pro / Enterprise 用户且买过 AI Gateway credits,行动清单很短:
- 跑
npm i -g vercel@latest和vercel ai-gateway setup,把网关接好。 - 在 Claude Code、Codex 或 Cursor 里把模型切到
stealth/glyph-cluster,或者走 OpenAI 兼容接口直接调。 - 拿三个你上周真实处理过的任务去跑:一次 code review、一次 bug 根因定位、一次实现方案推演。记录它和你主力模型的差异。
- 在团队内明确数据边界:哪些代码可以喂,哪些不行。先定政策,再放开用。
如果你不是目标用户(比如用的是 Hobby 计划),这条新闻的价值在于趋势:stealth 模型 + 网关统一接入正在成为新模型的标准出场方式。下一次再有类似的免费窗口,你会希望自己的工作流已经是"换个模型名就能试"的状态——而做到这一点的成本,就是现在把网关层搭好。
最后说一句判断:Glyph Cluster 值不值得长期用,现在下结论太早;但 stealth 免费期值不值得花一下午实测,答案是肯定的。免费的上限是你的时间,免费的下限是零成本拿到第一手体感。在模型迭代以周为单位的 2026 年,这种体感本身就是资产——它决定了下一次模型洗牌时,你是主动换,还是被动等。
一手来源:Vercel Changelog:Glyph Cluster is now available in stealth for free on AI Gateway(2026-10-07 发布)。
原始来源
相关文章

10 月 3 日,Sites in ChatGPT 以约 209 点赞、218 评论冲上 HN 前页。这不是发布,而是一场清算:提示词直达 URL,到底是玩具、原型托管,还是生产力?四个争论焦点、文档实锤的技术事实(D1/R2、登录、自定义域名),以及给 vibe coder 的三个判断。

2026 年 10 月 7 日,Google Developers 发布 Developer Knowledge API 生态:Google Cloud、Firebase、Android 等官方文档变成程序化事实来源,配 gcloud CLI 入口、官方 Agent Skill(一行安装)、MCP server 和多语言客户端库。为什么「文档 API 化」能连根拔掉 vibe coding「模型记错 API」的经典翻车。

一个 prompt、六小时无人值守:GPT-6 Astra 用 53 分钟、10 美元完成卡尔维诺 55 座《看不见的城市》的 three.js 可视化;Claude Opus 5.5 用了 85 分钟、6 个并行 subagent、74 美元,并在设计类任务上实现跃升。一篇关于 vibe coding 极限形态、模型选型与 token 成本账的一线记录。