横评GLM-5.3、DeepSeek-v4-pro、K3,谁才是Coding新王?
大模型编程能力哪家强?GLM-5.3、DeepSeek-v4-pro、Kimi K3 同题竞技,接官方 API 在 Claude Code 中直面前端网页、3D 场景、网站开发与游戏开发四重考验,从任务完成度与输出质量两个维度给出实测结论。 最近,模型圈又开卷了:江山代有模型出,各领风骚两三天。 DeepSeek-v4-pro正式版、Gork-4.6、Gemini-3.7-flash、GLM-5.3都在这周陆续发布,Benchmark分数一个比一个亮眼,但跑分归跑分,实测表现才是试金石。 于是,我拉来了久经考验的Kimi K3,一起做了这期横评。 参评选手:Kimi K3、GLM-5.3、DeepSeek-v4-pro-0813。统一任务类型、统一提示词、统一评分标准,全部接官方API在Claude Code里跑一遍。 共四个任务,覆盖前端网页、3D场景、网站开发、游戏开发等场景,主要评
原文:人人产品经理