Anthropic内部工程师平均每季度交付的代码量,相比去年直接飙升了8倍。当外界还在争论AI会不会抢走程序员饭碗时,Anthropic Claude Code团队负责人Fiona Fung已经看到了水面之下的暗流。代码生成不再是瓶颈,那真正的难题到底转移到了哪? 以前我们愁的是怎么把功能敲出来,现在愁的是怎么确认这堆高速生成的代码到底对不对。验证质量、判断优先级、衡量真实产出,成了新的拦路虎。当团队里的设计师和产品经理都开始用AI提交代码时,整体吞吐量确实上去了,但如果没有严格的验证流程,这8倍的代码量可能就是8倍的隐患。 这其实和微软刚推出的常驻型智能体Scout面临的挑战如出一辙。Agent现在能直接读写本地文件、执行脚本,甚至自己启动子任务。能力边界拓宽了,但如果缺乏底层的验证和安全治理,它搞出的乱子也会成倍放大。 别再盯着Token消耗量自嗨了。代码量翻倍只是表象,能把这些代码安全、高质量地落地,并算清每一笔真实ROI,才是Agent时代真正的入场券。 既然敲代码不再是稀缺能力,那这8倍的增量到底是谁贡献的?Fiona Fung在播客里交了底:现在不只是工程师在提交代码,Claude Code团队里的产品经理和设计师,几乎所有人都在check in code。 这画面放在几年前简直不敢想。以前产品经理写文档,设计师抠UI细节,工程师负责把需求翻译成机器能懂的语言。大家各司其职,隔着明显的部门墙。现在角色边界正在被AI强行抹平。PM和设计师直接通过Agent生成代码并提交,而工程师反而被推着去培养更强的产品感。用Fiona的话说,越来越多人会成为builder。 大家都成了builder,听起来挺美,团队吞吐量也确实上去了。但现实的耳光马上就会扇过来。当非技术角色大量涌入代码库,验证的压力瞬间就全堆到了Review环节。你不可能指望几个核心工程师去逐行审查PM用AI生成的几十个PR。如果设计师花了一下午让Agent跑了十万行代码,最后发现根本跑不通,这狂烧的Token除了让云厂商的账单好看点,对真实ROI有什么实质贡献? 角色融合绝对是趋势,但这并不意味着大家可以闭着眼睛乱提交。当写代码的门槛降到零,真正的考验在于谁能对最终交付的质量负责。与其盯着每个人提交了多少行代码,不如赶紧建立起一套适配混合团队的验证流程。别光看谁敲键盘敲得欢,最后能稳定转化为业务价值的代码,才配谈什么投资回报率。 既然非技术人员和Agent都在疯狂产出代码,那怎么衡量这些产出的真实商业价值? 别再盯着Token消耗量自嗨了。以前大家比谁用的Token多,觉得Token烧得越狠,团队效率就越高。现在这种唯Token论的思维该扔进垃圾桶了。Fiona Fung在内部已经明确表态,必须把工具使用量和真实进展严格区分开。你不能看着后台账单上Token消耗量爆表,就沾沾自喜觉得产出翻倍。如果这些Token只是生成了几百个跑不通的PR,或者让异步Agent在后台陷入死循环空转,那这不叫效率提升,纯属给云厂商做慈善。 现在的Agent越来越趋向异步化,比如设定好任务流,让Agent每天早上自动读取反馈、启动执行、生成代码。这种常驻模式确实解放了双手,但它的ROI不能按干了多少活来算,得按干成了多少事来算。以前我们算投资回报,看的是工程师的工时和交付代码行数。现在面对满天飞的异步Agent,你得看它们生成的代码最终有多少能顺利通过验证,真正上线并产生业务价值。 把工具使用量误认为真实进展,是现在很多团队都在踩的坑。赶紧把衡量指标从Token消耗量切换到真实业务ROI上,建立起配套的验证和过滤机制。别等月底看到天价账单和一堆废弃代码时,才发现自己只是在为AI的无效劳动买单。 既然算清了ROI的账,接下来就是怎么验证这堆代码的质量。以前我们看Bug率、看崩溃日志,现在Fiona Fung在内部搞了个更接地气的指标:看用户的脏话频率。她和团队用“bad vs. sad”框架来定义产品质量,直接通过捕捉用户在使用产品时的挫败感来反推代码缺陷。这听起来有点野,但极其有效。当代码都是AI生成的,传统的静态扫描根本抓不住那些逻辑上跑得通但体验极其反人类的设计。 想要拿到这种最真实的反馈,管理者光盯着数据看板和听汇报是没用的。Fiona在早年做Visual Studio时就养成了深度使用自家产品的习惯,现在她更是要求管理者必须亲自下场Dogfooding,甚至建议他们先从一线独立贡献者做起。如果你自己都不用自家产品,你怎么知道Agent早上自动生成的那些代码到底会不会让用户在屏幕前爆粗口? 别被漂亮的仪表盘数据骗了。管理者只有把自己扔进真实的使用场景里去踩坑,才能建立起对产品质量的直觉。坐在办公室里看报表永远发现不了真正的痛点,亲自下场体验那种让人想砸键盘的挫败感,才是重构验证流程的底线。 代码量暴增8倍,AI把敲键盘的脏活累活全包了,一线工程师看似效率狂飙,但水面之下的暗面正在吞噬团队的技术底蕴。以前写代码,工程师会进入一种沉浸的心流状态,顺着逻辑一行行推敲,对底层架构了如指掌。现在AI瞬间吐出几百行代码,工程师硬生生被逼成了无情的代码审核机器。Fiona Fung在播客里交底,这种模式让工程师失去了过去写代码时的心流,大家各自盯着屏幕审查AI生成的PR,团队协作变得越来越孤独,以前那种在白板上激烈争论架构设计的场景几乎绝迹。 更让人后背发凉的是新人培养的断层危机。以前新人进公司,得从修边缘Bug、写基础模块开始,摸爬滚打几年才能真正吃透整个系统的底层逻辑。现在有了Agent加持,新人直接让AI生成完整功能,看似上手极快、产出惊人,实则完全跳过了亲手理解架构的关键阶段。这就导致团队里出现严重的认知断层:老员工在拼命Review那些逻辑晦涩的AI代码,新员工却对系统底层一问三不知。长此以往,一旦AI生成的代码出现深层架构缺陷,整个团队根本没人有能力去兜底。 效率的狂飙绝不能以牺牲工程师的深度思考和团队传承为代价。当代码生成不再是门槛,工程师的核心价值必须向系统设计和复杂问题拆解转移。别只顾着让AI跑得快,赶紧把架构复盘和底层逻辑拆解重新纳入日常考核,把失去的技术直觉找回来,这才是维持团队长期战斗力的底线。 既然异步Agent和连续工作成了行业刚需,微软在Build 2026上掏出的Scout就是对这种趋势最直接的回应。以前的AI助手顶多算个问答机器人,你敲一句它回一句。现在的Scout直接进化成了常驻打工人。它不再局限于对话框,而是真正接管了本地环境,能读写文件、跑脚本,甚至自己拉起子Agent并行处理任务。用微软的话说,真正的突破在于后续执行,系统能记住你的优先事项并代表你采取行动。 从工具变成员工,能力边界拓宽了,但也把前面提到的安全和ROI问题推到了极致。你让一个Agent拥有执行shell脚本和修改本地文件的权限,如果它陷入死循环或者被恶意注入,后果不堪设想。Scout在工程上做了一个关键设计:它没有用通用的共享服务账户裸奔,而是给每个实例分配了独立的Entra身份。它的凭据被死死限定在具体任务范围内,还得受Microsoft Purview的数据防泄漏策略约束。遇到高度敏感的操作,必须等人工点头才能继续。 这种架构设计其实透露出一个明确的信号:企业级Agent的落地,安全治理的优先级已经高于单纯的生产力狂飙。别总盯着Agent能自动跑多少个任务,先看看你的权限管控和数据隔离能不能兜住底。当AI从副驾变成主驾,企业敢不敢把核心系统的钥匙交出去,才是衡量这笔投资真实ROI的底线。 Agent权限一放开,风险直接拉满。以前AI顶多在沙盒里陪你聊聊天,现在直接拿到了本地环境的生杀大权。能跑脚本、改文件、甚至自己拉起子任务,这哪是助手,简直是请了个带核心系统钥匙的保姆。 能力越大,闯祸的动静也越大。之前基于OpenClaw框架的Agent就爆过雷,搞出过500条消息的垃圾信息死循环。当时就有安全专家直接放话,在核心架构重写前,跑这种工具等于把整个系统裸奔送给黑客。这绝不是危言耸听,当Agent能自动化操作浏览器、应用代码补丁时,一次模型幻觉或者一次恶意的提示词注入,就足以让企业核心数据被一锅端。生产力提升再诱人,也抵不过一次灾难性的数据泄露。 那这笔安全账到底怎么算?微软给Scout上的枷锁算是个行业参考。它没让Agent用个通用共享账号一路狂飙,而是给每个实例分配了独立的Entra身份。权限被死死卡在具体任务范围内,连诊断日志都要做脱敏处理,外面还套了一层Purview的数据防泄漏策略。碰到修改核心数据的高危操作,必须得等人工点头才能放行。 企业级Agent的落地,绝不是比拼谁给的权限更放开。在享受常驻打工人带来的效率红利前,先把权限管控、数据隔离和人工兜底的账算明白,才是守住商业底线的关键。 当代码生成量暴增8倍成为常态,技术管理者最该戒掉的就是对代码行数的迷恋。以前我们拿代码产出量衡量团队战斗力,现在这套逻辑早就该扔进故纸堆了。Fiona Fung在内部看得很透,写代码不再是最稀缺的能力,如果缺乏严格的验证,这8倍的增量可能就是8倍的定时**。 现在Agent能直接读写本地文件、跑脚本,能力边界拓宽了,但验证和安全流程如果还停留在上个时代,无异于闭着眼睛开高速。你不可能指望几个核心工程师去逐行Review产品经理用AI生成的几十个PR。必须把验证流程重构,用自动化测试、安全扫描,甚至用真实的业务反馈来兜底。同时,安全治理的优先级得无条件拉满。就像微软给Scout上枷锁那样,给每个Agent实例分配独立身份,把权限死死卡在具体任务范围内,高危操作必须等人工点头。 别再盯着后台飙升的Token账单沾沾自喜了。AI把敲键盘的脏活全包了,管理者的核心价值早就转移了。赶紧把团队的考核指标从代码生成量切换到真实业务ROI上,建立起适配混合团队的验证机制和安全隔离策略。当写代码的门槛降到零,谁能守住交付质量和系统安全的底线,谁才算真正拿到了Agent时代的入场券。