72小时AI巅峰之战,编程仍是皇冠
AI编程的竞争单位,已从代码交付变成了任务交付。大模型的军备竞赛仍在加速。9月初的三天内,已有5家头部厂商迭代了自己的旗舰模型。当地时间9月1日,Anthropic推出Claude Fable 5.1与Claude Mythos 5.1,定位是“目前面向编程和知识工作的最强模型”,编程跑分直接翻倍。前者向普通用户开放,后者则依然不开放个人申请,仅能通过Anthropic的可信访问计划(Trusted Access Programs)获取。9月2日,谷歌也连发Gemini 3.8 Flash和Gemini 3.8 Flash Cyber两款模型,继续强化“速度+成本”的路线,在价格不涨的情况下提升了软件工程和Agent工作流上的表现。而这次迭代距离其3.7 Flash的更新仅仅隔了三周。当日,Meta也更新了Muse Spark 1.3,瞄准长周期Agent任务,重点提升复杂上下文处理和编程
原文:钛媒体