DeepSeek 还在“瞎干”?
DeepSeek V4 发布后,作者用真实项目测试它能否替代 Claude Code 和 Codex。结果并非跑分宣传里的全能:它在推理、价格和开源上仍有优势,却在实际编码、稳定性和任务完成度上暴露短板。文章给出适用场景和选型判断。 最近 AI 圈很热,Kimi K3、阿里 Qwen 3.8、智谱 GLM 5.3、DeepSeek V4 等国产旗舰模型陆续发布,跑分和促销价格都很吸引人。 我现在写文章做项目,基本都用 Claude Code 和 Codex,但网络、支付问题一直是麻烦。如果国产模型能够替代它们,当然是件好事。所以 DeepSeek V4 发布后,我第一时间决定试一试。 不过,一用才发现,现在宣传的口径就像“皇帝的新衣秀”一样。 宣传只挑好的说,存在的问题却一点不讲。下面我结合真实体验,说清楚 DeepSeek V4 的亮点、缺陷,以及它究竟适合什么场景。 01 Deep
原文:人人产品经理