导语:微软近期接连曝出AI工具带来的副作用:Exchange团队因AI发现海量Bug而无法按时发布累积更新,Edge团队则因AI生成的浏览器扩展激增导致审核流程不堪重负。这反映出AI在提升生产效率的同时,也给下游的验证和审核环节带来了新的压力。
近年来,微软不断强调AI在其产品线中的应用:Copilot辅助编码、AI自动化检测缺陷、流程提效等。然而,近期两篇内部博客揭示了AI带来的另一面:并非“AI真香”,而是“AI产出过多,团队难以招架”。
一方面,Exchange团队表示AI工具检测到的缺陷数量激增,导致累积更新CU1的发布被推迟;另一方面,Edge团队承认AI生成的浏览器扩展数量已超出审核能力。不到一个月,微软两个团队先后自曝困境,而核心原因都是AI。
AI检测缺陷效率过高,CU1发布受阻
事件始于8月13日,微软Exchange团队发布了一篇题为《Exchange SE CU1到底在哪?》的帖子,回应了大量用户对Exchange Server订阅版累积更新CU1发布时间的追问。微软最初承诺在2026年上半年结束前发布,随后悄然改为“2026年下半年”,此后再无具体日期。
简要背景:Exchange SE是微软邮件服务器的订阅版本,累积更新(CU)是一种包含近期所有修复、新功能及过时代码移除的打包更新。微软每年会发布一到两次CU,部分用户更倾向于直接安装CU而非逐个打补丁。
对于CU的延迟,微软给出的理由出人意料:AI工具发现了过多缺陷。过去几个月,微软一直利用各种AI工具检测产品中的缺陷,但发现缺陷并非终点,反而意味着一连串后续工作正式开始:工程师需先确认缺陷是否真实存在,再尝试复现;确认后修改代码、测试修复效果,并进行回归测试,确保“修复一个缺陷不会引入三个新问题”;最后,还需将修复打包成安全更新并发布。
然而,安全缺陷不会排队等待工程师处理,新缺陷仍在不断出现,安全更新每月都需发布。于是Exchange团队陷入尴尬境地:一边修复新的安全缺陷,一边推进CU1。更棘手的是,微软不敢轻易推出CU1,因为一旦发布,若紧接着出现紧急安全缺陷,企业管理员可能立即需要安装另一个大型更新,因此微软宁愿继续等待。
Exchange团队表示,他们会将每月的安全更新持续整合到内部CU1版本,等到版本足够稳定,同时遇到没有“必须优先处理的紧急安全更新”的月份,再正式推出CU1。这听起来很稳妥,唯一的问题是:到底哪个月才能没有紧急安全更新?
博客最后写道:“简而言之,Exchange SE CU1肯定会发布,我们没有忘记,但目前还不能给到具体日期。”——这句话说得很体面,信息量却约等于零。
AI生成插件激增,Edge审核不堪重负
这边Exchange的事还没完,隔壁Edge团队又出事了。9月8日,微软Edge团队在一篇博客中承认,自己也有点被AI压垮了。博客写道:“随着AI辅助编程快速普及,开发者如今可以比过去更快地构建浏览器扩展。”
以往开发一个浏览器插件,多少还得自己写代码、调试、测试,再一点点迭代;现在不一样了:借助AI工具,开发者可以让模型生成代码,再不断修改、迭代,快速做出大量以前根本不会尝试的小工具。
于是,Edge扩展生态迎来了一个微软可能没料到的副作用:提交量开始猛涨。但插件进入Edge Add-ons商店之前,微软不能让它们“写完即上架”,还需要对扩展进行审核,检查是否违反平台政策、是否存在安全问题,以及是否符合相关质量要求。微软自己也承认,此前推出的“高质量、高价值扩展加速审核流程”,已开始承受新的压力。
说白了就是:开发者那边的AI油门越踩越深、插件提交量持续增加,微软的审核流水线负担越来越大,最终导致扩展审核的周转时间变长。面对这个问题,微软没有选择简单粗暴地扩大人工审核规模,而是继续给审核流程加AI。Edge团队表示,已经为审核流程中许多可重复的验证检查引入自动化,并简化了审核在流水线中的流转方式。微软特别强调,这并不意味着降低审核标准,也不会减少扩展需要通过的检查,只是把审核过程拆开:AI负责“标准答案”,人类负责“需要判断”的复杂案例。
至于这些自动化流程究竟用了多少AI,微软没有说得特别清楚。但逻辑其实已经非常明显了:既然AI让前面的生产速度快了,那后面的审核也得想办法自动化,否则整个系统迟早会堵。
不到一个月时间,微软两个团队已接连遇到类似困境。Exchange:让AI发现缺陷→缺陷数量增加→工程师验证、修复、测试→安全更新不断插队→CU1迟迟无法发布。Edge:让AI生成代码→开发者制作插件更快→提交量增加→人工审核压力暴涨→审核周期变长。
开发者可以一口气生成10个插件,审核团队却不能一口气审核10个插件;AI可以一次找到一批漏洞,但安全工程师还是得一个个确认、复现、修复。虽然一个卡在发布,一个卡在审核,但都有一个共同点:AI把上游的生产效率拉起来了,但下游没有同步提速。
这其实也是AI Coding发展到今天,一个越来越值得注意的变化。过去程序员最大的烦恼可能是“写不出来”,但当代码生成从“一个程序员一天写多少”,变成“一个Agent几个小时能写多少”之后,问题就变成了:这么多代码谁来测?Bug找出来之后谁来修?插件写出来之后谁来审?改完之后谁来验证?上线之后出了问题谁来负责……
毕竟,虽然AI让写代码变得更容易了,但并没有让代码变得更安全——这两件事,是两码事,目前AI没办法自动消除审核、验证等这些后续工作。
那么,微软Exchange和Edge团队遇到的这个问题,你在日常工作中是否也遇到过类似的,又是如何解决的呢?
参考链接:https://www.theregister.com/software/2026/09/09/another-microsoft-team-admits-its-struggling-to-handle-flood-of-ai-generated-code/5295185 https://techcommunity.microsoft.com/blog/exchange/where-is-exchange-se-cu1-anyway/4546837
免责声明:本文基于公开报道的事实信息整理,仅供参考。AI新纪元聚焦人工智能前沿动态,内容来源于公开渠道,如有不实请联系我们删除。
发表评论 取消回复