Z.ai 发布 GLM-5.3,并将重点放在持续运行的编程任务和工具协作上。API 推理强度分为 low、high、max,默认 max;与旧版依赖的参数不同,调用时需要开启 thinking。公告称 GLM Coding Plan 用户先行获得访问,权重计划在上线两周后发布,因此发布当日不能把它描述为已可自行下载的开源模型。查看 Z.ai 公告和迁移说明。
为什么更新请求参数会影响结果
Z.ai 指出,旧应用可能使用 thinking.type: disabled 禁用思考;GLM-5.3 的 API 要求将 thinking 设置为 enabled,再用 low、high 或 max 指定推理档位。直接沿用旧参数会导致请求不兼容,或者无法得到预期的推理行为。默认 max 也会影响响应时间和 token 消耗,迁移时要把参数升级与成本评估放在一起。
长程编程任务如何试
选择一个包含多个步骤的真实任务,例如新增功能、修复连续失败的测试或完成跨文件迁移。要求模型先说明计划、将检查哪些文件、如何验证结果,然后在隔离分支工作。完成后运行项目测试,查看它是否遗漏边界条件、产生不必要改动或错误解释工具结果。对于一次性短问答,较高推理档位未必合算;可分别比较 low、high、max 的通过率和延迟。
迁移与部署检查清单
- 将旧的 disabled 参数改为 enabled,并显式写入团队选择的档位。
- 检查 SDK、代理服务和提示模板是否重写或覆盖 thinking 设置。
- 用固定任务集比较 GLM-5.3 与现行模型的测试通过率、工具调用次数、响应时间及用量。
- 按公告节奏核实 Coding Plan 权限和权重是否已实际发布,并阅读模型许可后再做自托管决策。
公告给出的预训练/强化学习及长程任务评测属于发布方结果,建议作为试验假设,而非业务承诺。