适用场景:不是不能切,而是切之前要看清楚
这类问题通常出现在模型升级、供应方更名、base_url 迁移、代理路径变化、工具调用能力调整或多环境共享 profile 的时候。表面上看,只是把一个模型名换成另一个,实际上路径、参数、响应格式和 fallback 顺序都可能一起变。如果直接在生产上切换,报错往往先出现在业务页面,而不是配置页面。
永沃云枢把 CCSwitch 当作路由层,而不是简单的 Key 存放处。它要对接 AI API 接入、Codex 接入、开发者 AI 调用和 AI 自动化办公任务,因此最重要的是先确认路由是否可解释。你可以参考base_url 与路径核对、工具能力矩阵检查和模型别名退役迁移。
dry-run 要看哪四层
第一层是配置层,确认 profile 名称、环境、Key 归属和备注。第二层是路由层,确认 base_url、路径、query 参数和代理规则。第三层是能力层,确认目标模型是否支持工具调用、流式输出、长上下文、图片输入或结构化输出。第四层是回退层,确认主路由失败时会不会切到备用 profile,备用是否真能用。
很多人只看界面上选中了哪个 profile,却忽略了实际命中的模型名。别名映射、路径改写、项目 override 和环境变量都可能让结果偏离预期。dry-run 的目标不是证明“能发请求”,而是证明“发出去以后能说明为什么命中了这个接口”。
操作步骤:先小流量、后真实切换
- 固定一个测试任务,最好是文本长度适中、无敏感数据、无付费动作的请求,作为干跑样本。
- 在 CCSwitch 配置里复制一份临时 profile,不要直接改正式 profile。记录新旧差异,尤其是 base_url、模型名和工具开关。
- 用同一条请求分别命中旧 profile 和新 profile,观察返回码、错误对象、首 token 时间、工具调用字段和流式分片。
- 把结果写成对比表:配置、实际命中模型、返回类型、失败原因、回退顺序、是否需要人工确认。
- 如果只是模型名升级,先让 Codex 生成样本请求,再由人工跑一次低风险验证,不要一次性把批处理、办公流和前端同改。
- 确认新 profile 通过后,再做最小范围切流,保留回退窗口和旧 profile 观察期。
常见问题 / 避坑
第一个坑是把“可连接”当成“可使用”。端口通不代表模型支持当前参数。第二个坑是没记录实际路由结果,只记了配置截图。第三个坑是忽略工具能力差异,导致新模型不支持旧流程里的函数调用或 JSON 结构。第四个坑是回退链路没有压测,真出事时切回旧 profile 反而更慢。
如果你的场景里还混着 AI 自动化办公,尤其是表单、邮件、周报和资料整理,建议把“任务类型”写进路由说明里,让业务代码只看任务类型,不直接硬编码外部模型名。这样以后换模型时,Codex 接入侧和办公自动化侧都更容易一起调整。
检查清单
- 新旧 profile 的 base_url、模型名、工具开关和超时配置都已比对。
- dry-run 样本至少跑通一次文本请求,最好再补一个带工具调用的样本。
- 实际命中的模型和配置里看到的模型能对应上。
- 回退 profile 已做最小真实请求验证,不是只看页面上显示启用。
- 路由摘要有脱敏记录,能追溯到是哪个任务触发了切换。
- 延伸阅读:健康探测与降级、配置指纹比对、CCSwitch 专题、路由 trace 日志。
验收标准:切换前就知道会发生什么
合格的 dry-run 不是“这次没报错”,而是“新 profile 的行为、限制和风险都已清楚”。如果切换前无法解释返回结构、工具调用或回退路径,就说明还不能放到真实业务里。永沃云枢更看重这个解释能力,因为它直接决定 AI API 接入和模型调用管理能不能稳定运转。
补充验证:把回退路径也当成主流程测
很多团队只测新 profile,不测旧 profile 回退。真正上线时,恰恰是备用链路最容易掉链子,因为它长期没有真实流量,超时、证书、代理或权限都会积累问题。dry-run 完成后,至少要做一次“新 profile 失败后切回旧 profile”的模拟,确认旧链路还能完成一个完整请求,而不是只在配置页里显示启用。
如果团队同时使用 Codex 接入或 AI 自动化办公,回退测试还要带上最常见的工具调用和批处理请求。纯文本能通不代表复杂任务能通,尤其是涉及结构化输出和多步调用时,模型能力、提示词和路由映射都可能是不同的故障点。把这些样本写进变更记录,以后做模型迁移时就能直接复用。
另外,切换记录最好写清楚谁执行、谁确认、谁回滚。很多事故不是配置错,而是现场不知道该由谁按下回退按钮。只要把执行人、确认人和观察窗口写进记录,模型升级、base_url 迁移和代理调整这三类操作就会清楚很多,也更适合和 Codex 任务一起归档。
FAQ:是否要把 dry-run 写进日常变更流程?建议要。只要涉及模型名、路径、权限或工具能力变化,先干跑再切流,比上线后再追问题更省时间,也更适合给 Codex 交给自动化任务处理。