公开评测快照: 2026-07-19
GLM / 智谱清言 vs DeepSeek 公开评测对比
如何阅读本页
本页用通俗方式汇总公开第三方评测。它帮助你快速了解公开数据里两边的相对位置,但不能替代你用真实任务亲自试用。
公开评测怎么说
下面只展示这些模型共同出现在同一公开评测类别里的结果。不同来源的分数不能相加,也不能直接宣布谁全面更好。
SWE-bench Verified · 真实软件问题修复
SWE-bench Verified 衡量的是 AI 编程系统修好真实 GitHub 问题的比例。解决率越高,说明那次测试里修好的问题越多。
| 产品 | 精确模型版本 | 排名 | 成绩 | 指标 |
|---|---|---|---|---|
| GLM | mini-SWE-agent + GLM-5 (high reasoning) | 26 | 72.8% | Resolved (%) |
| DeepSeek | mini-SWE-agent + DeepSeek V3.2 (high reasoning) | 46 | 70% | Resolved (%) |
产品入口
自己试用时可以看什么
- 你的真实问题能否一次答对,还是还要大量修改。
- 当前套餐下够不够用,以及价格是否可接受。
- 隐私、登录方式和团队协作是否适合你。
更多有公开证据的模型对比
官方来源与核验时间
下列链接是本页产品身份与套餐信息的官方来源,最后核验于 2026-07-19。价格、可用模型、配额与地区限制可能变化,请在购买或部署前以官网为准。
- 智谱清言官网 - 2026-07-19
- DeepSeek API models and pricing - 2026-07-19
常见问题
这页是否给出绝对排名?
不会。只有在公开测试条件、原始输出与人工方法完整披露时,才会发布限定条件下的结论。
价格和套餐信息可靠吗?
页面链接到官方来源并标注核验日期;购买前仍应以提供方官网和你所在地区显示的价格为准。
ModelAny 会保存提示词吗?
ModelAny 采用本地优先设计;提示词仅发送到你选择的 AI 服务,不会上传到 ModelAny 自有服务器。
用同一提示词比较多个模型
ModelAny 已在 Chrome 网上应用店上架;Microsoft Edge 扩展仍在审核中。草稿、设置与历史保留在浏览器本地。
安装扩展