支持模型
各模型当前状态、降质告警与自测方法,以及两个 Harness 各自支持哪些模型。
支持模型
模型支持随时间变化,本页是当下的状态快照,不是长期承诺。所有模型走公司网关(LiteLLM),同一把凭证在 Claude Code 与 Codex 两个 Harness 下通用。
状态总览
| 模型 | Claude Code | Codex | 状态 |
|---|---|---|---|
gpt-6-astra | ✅ | ✅(默认) | ⚠️ 降智中(见下) |
gpt-5.6-sol | ✅(默认) | ✅ | ⚠️ 降智中(见下) |
gpt-5.5 | ✅ | ✅ | ⚠️ 降智中(见下) |
glm-5.3 | ✅ | — | 正常(稳定档) |
kimi-k3[1m] | ✅ | — | 正常 |
qwen3.8-max | ✅ | — | 正常 |
deepseek-v4 | ✅ | — | 正常 |
| Claude 原厂模型 | ⛔ 停用 | — | 见下 |
GPT 降智告警:GPT 全系(含 gpt-6-astra 与 gpt-5.6-sol)当前降质严重,并非完全可用,团队在持续解决。典型表现:复杂任务成功率明显下降、长输出崩坏、部分线路拒绝服务(菲律宾区等非区账号路由问题依旧,AI 目前对这些账号就是不行)。对质量敏感的任务建议用 glm-5.3 等稳定档模型。
Claude 原厂模型已暂时停用:封号严重,单独维护成本远高于普通模型。Harness 本身(Claude Code 运行时、MCP 插件)不受影响,仍可跑 GPT 与其他兼容模型。
降智自测
怀疑线路降智时,用这个经典 query 快速验证(画图任务对降质最敏感,正常模型每次都能产出完整 HTML):
请你画一个鹈鹕骑自行车的 HTML,不要加任何测试
判断标准:
- 正常:产出完整、可直接打开的 HTML 页面,鹈鹕和自行车轮廓清晰
- 降智:拒绝执行、敷衍输出(几个色块)、循环重复同一段代码、或 HTML 结构明显崩坏
可以多跑几次对比 token 消耗:降智线路常见「token 消耗正常但产出质量塌方」,或反之「反复重试烧掉数倍 token 才出一份能用的结果」。
各 Harness 怎么选模型
统一用 --model(Claude Code)/ -m(Codex)直接指定即可:
ginit claude --model glm-5.3ginit claude --model gpt-5.6-solginit codex -m gpt-6-astra各模型在 Claude Code 下的上下文/输出策略由 ginit 预置(如 gpt-5.6-sol 272K 上下文 / 64K 输出),不需要手动调。GPT 系模型是启动期参数(上下文/压缩策略需要在会话建立前生效),会话中途 /model 切换不走 ginit 的网关策略。
评论
正在加载评论…