据《华尔街日报》报道,Google 的 AI 研究部门最早将于周三发布一款编程能力显著升级的新模型。
报道称,这款名为 3.8 Flash、内部称为“Skimaki”的模型,在内部编程工具测试中受到 Google 工程师的青睐,表现优于 Anthropic 的 Opus。据报道,Google 一直在集中研究人员的时间和资源,提升模型的编程能力。
自去年以来,Google 在很大程度上落后于 Anthropic 和 OpenAI 的领先 AI 模型。随着 AI 开发领域转向代理式编程——能够在更少人工监督下创建和修改软件——这一差距进一步扩大。
根据The Latent 的指数对当前 AI 前沿模型能力的评估,前三名均由 Anthropic 的 Fable 和 Opus 模型占据,随后是 OpenAI 的 GPT-5.6 Sol。Google 的 Gemini 3.7 Flash 在 16 个模型中排名第 10。
尽管 3.7 Flash 在知识与推理,以及偏好与沟通能力评测中的排名更高,但在代理式工具和计算机使用,以及专业和现实工作评测中,该模型位居倒数。
最新 Gemini Flash 模型更强的编程表现可能会增强 Google 在 AI 领域的竞争力,但 WSJ 报道称,由于 Flash 模型采用了更小、更便宜、更快速的设计,能力不及更大型号,因此公司仍不太可能领跑这场竞赛。
即将发布的 Flash 版本正值 Google DeepMind 最近发生组织架构调整之际:联合创始人兼 CEO Demis Hassabis 转任新的董事长职位,Koray Kavukcuoglu 则接替 Hassabis,担任高级副总裁。
在此之前,Google 的 AI 部门经历了一波人员离职,其中包括资深 Google 高管 Jeff Dean(他随后创办了自己的初创公司),以及知名研究人员 Noam Shazeer 和 John Jumper,后两人分别加盟了 OpenAI 和 Anthropic。
