编程任务:先核查效果,再比较预算
低价不能代替代码正确率。这里以 GLM-5.3 与 GLM-5.3-Flash 为两个有限候选,不是最低价冠军或质量相同的推荐。适合先做文本代码生成、修复的候选初筛,再用自己的代码库验证。
共同证据与差异
两行属于同一LiveBench数据集、协议和固定runner修订;提供者与API基址相同。提供者:zhipuai;API基址:https://api.z.ai/api/paas/v4;固定runner修订:8f8e5c381a16e3f24257776edd53471fe86f8091;共同参数:{"temperature":1,"top_p":0.95,"max_tokens":131072,"stream":true,"reasoning_effort":"max","extra_body":{"thinking":{"type":"enabled"}}}。公开ID不承诺不可变权重,逐次请求日志与实际测试日期未公开。
| 精确候选/配置 | Coding | Agentic Coding | 场景文本标价 USD |
|---|---|---|---|
| GLM-5.3 glm-5.3 | 78.95% | 60.9090% | 21.60 |
| GLM-5.3-Flash glm-5.3-flash | 78.95% | 56.7677% | 2.40 |
两行在这个Coding分类均为78.95%;不能推导真实任务质量相同。代理编程分类也需单独核查;换数据集、工具或推理预算后结果可能不同,因此不把两个分类拼成新排名。迁移还需核查当前可购买端点、代码正确率、延迟、工具调用和重试。
可编辑的预算假设
每日100次、运行30天,每次输入2000与输出1000 token,仅计算该端点的文本输入/输出标价。实际缓存、重试、推理token、工具费和协议限制可能改变账单;完整单价缺失时不计算节省。用量、任务及来源版本会随入口传入,仍按当前数据重算。
打开这两个候选并设置编程任务来源与身份
GLM-5.3 · glm-5.3 · 规格来源 · 端点报价来源 · 固定运行配置 · 原始分类数据
API基址:https://api.z.ai/api/paas/v4;源修订 caa4253c8a3aa93b5c7ec234e681d4f120a20240;配置修订 8f8e5c381a16e3f24257776edd53471fe86f8091。分类是公开数据整理,许可CC BY-SA 4.0,本站未运行模型推理;测试时间未提供。
GLM-5.3-Flash · glm-5.3-flash · 规格来源 · 端点报价来源 · 固定运行配置 · 原始分类数据
API基址:https://api.z.ai/api/paas/v4;源修订 caa4253c8a3aa93b5c7ec234e681d4f120a20240;配置修订 8f8e5c381a16e3f24257776edd53471fe86f8091。分类是公开数据整理,许可CC BY-SA 4.0,本站未运行模型推理;测试时间未提供。
当前目录快照 2026-10-06T19:15:23.404095+00:00;这是采集目录版本,不是模型测试时间。共同配置或身份缺失会阻止该精选内容发布,待维护者复核。许可与范围
其他任务