Google Andi Gutmans:从 PHP 到 Agent 团队负责人

内容管家 AI领域评论0字数 3766阅读12分33秒阅读模式

从 PHP 到 AI Agent:Andi Gutmans 谈开发者的角色进化

从"全民建站"到"全民开发"

Andi Gutmans 是 PHP 3 的核心作者之一,如今担任 Google Agentic Data Cloud 负责人。在 Stack Overflow Podcast 节目《Leaders of Code》中,他与平台工程总监 Peter O'Connor 展开对谈,梳理了 AI Agent 给软件开发带来的深层变革。

回顾 PHP 的历史意义,Gutmans 表示,当年 PHP 最具突破性的贡献,是让网页开发不再局限于计算机科班出身的人群——只要具备基本技术素养,就能用 PHP 建站。他甚至提到,有医生曾告诉他用 PHP 为诊所搭建了网站。这种"技术民主化"的基因,在他看来正在 AI 时代以更大幅度重现。

他以自身经历为例:姐姐并非技术人员,法律专业出身,如今正通过 AI 工具 Lovable 构建网站,效果"令人惊艳"。Gutmans 认为,当前的 Agent 化开发就像是 PHP 的升级版——在各个维度都实现了质的飞跃。更重要的是,Agent 还能将安全最佳实践内嵌到开发流程中,从而弥补早年"人人可建站"带来的安全隐患。

每个人都在变成"Agent 团队负责人"

Gutmans 提出的核心论断是:每一位个人贡献者(IC)正在成为其手下 Agent 的"团队负责人"。 这不是隐喻,而是对工作方式的实质重塑:代码审核&查验、面试评估、人与 Agent 的判断分配,都需要重新设计流程。

在 Guardrails(护栏)设计上,Gutmans 认为核心维度没有变——信任、安全、成本、可控性——但 Agent 的自主能力大幅提升,需要在机制上做出调整。关键决策包括:

  • Human in the loop(人在环中):高风险环节必须人工介入
  • Agent in the loop(Agent 在环):常规流程由 Agent 执行,人负责最终确认
  • Agent on the loop(Agent 旁观):Agent 监控系统运行,异常时才介入

Gutmans 强调,这本质上是风险管理问题,而非信任 AI 的问题——每个组织都需要根据自身风险承受度,明确三层决策的边界。

Google 面试逻辑已变:考核"与 Agent 协作推理"的能力

对谈还提到,Google 正在调整自身的工程师面试流程——不再单纯评估候选人独立手写代码的能力,而是看他们如何引导和推理 Agent 的工作过程。这一信号指向一个趋势:未来技术岗位的核心竞争力,正在从"自己能做"转向"能指挥 Agent 做好"。

这种面试逻辑的转变,与 Gutmans 所说的"每个人都是 Agent 团队负责人"形成呼应。当开发主体从个人转向"人 + Agent 协作单元",评价体系也必须随之更新。

工程师角色正在重新定义

在 AI 编程助手大规模普及的背景下,代码工程美学(code craft)的价值是否正在被重新评估?多位一线技术负责人在近期的讨论中,给出了颇为一致的答案。

价值重心从"写代码"转向"判断与引导"

一位来自大型科技公司的工程负责人指出,即使在 AI 辅助工具出现之前,编程语言本身的重要性也一直在下降。真正关键的问题始终是:你是否理解业务问题?架构设计是否稳固?是否具备规模化运营的能力?

传统开发模式下,工程师可能将 80% 的时间投入手写代码,只有 20% 的精力用于上述其他维度。而现在,AI 代理可以承担大量编码工作,工程师得以将重心转移到:确保目标方向正确,以及对 AI 输出结果进行有效审核。

每位工程师都在变成"代理团队负责人"

这种转变带来一个根本性的角色重塑:每个个体贡献者(individual contributor)都在逐渐变成一支 AI 代理团队的负责人。具体来说,工程师的职责从"自己动手写"变成了"设计任务、编排流程、判断输出质量"。

一个典型场景是:工程师编写核心逻辑后,让 AI 代理生成测试用例,再引入另一个 AI 代理对测试进行批判性审核&查验,最终仍需人工介入判断测试是否真正有效。整个过程中,人力投入减少了,但设计判断和流程编排的权重显著上升。

高等教育与招聘流程正在同步调整

关于技能断层的担忧,业内普遍认为问题会被自然消化。计算机科学教育本身正在改变——学生完全可以在大学期间就开始使用 AI 代理承担远比传统手写代码更复杂、更高规模的项目。这种经历本身就在训练他们成为"代理团队负责人"。

在招聘端,变化同样明显。Google 等公司已开始调整面试流程:不再要求候选人在白板上徒手实现快速排序,而是给他们一个问题和 AI 代理工具,观察他们如何思考、如何推理、如何引导代理协同工作。面试官更希望看到的是候选人的思维过程、问题空间设计能力,以及面对陌生问题时展现出的学习意愿和适应力——而非第 20 次重复实现某个经典算法。

代码理解从未真正完整,人机协作才是常态

关于 Linus Torvalds 近期引发讨论的那句话——"工程师担心自己不理解所写代码,他们的担心是对的,因为从来没有人真正完全理解过"——业界也有共鸣。

在大规模企业级项目中,从来没有哪个工程师能掌握代码库的 100%。通常情况下,工程师只熟悉自己正在处理的那部分代码,以及少数相邻模块。

有趣的是,AI 代理现在反而提供了一种新的可能:帮助工程师快速熟悉陌生的代码库、定位修改点、理解代码结构。同时,Google 等公司仍然坚持"人工代码审核&查验 + AI 代码审核&查验"双轨并行。AI 代理在代码审核&查验中能够覆盖比人类更广的代码范围,在某些类型的 Bug 发现上甚至更具优势——但人工判断的价值并未因此消失。

代码审核&查验:人机分工的风险管理逻辑

什么时候必须让人介入

圆桌嘉宾普遍认为,是否需要人工审核&查验代码,本质上是风险评估问题——不是所有代码都需要同等程度的关注。

高敏感区域(如安全令牌处理、身份认证逻辑)通常建议人工专家介入审核&查验;而在 CSS、HTML 或 Python 脚本等场景下,AI 代理反而可能比人类审核&查验者发现更多问题,尤其当团队已经在用 AI 做安全扫描时,机器的覆盖率和一致性往往优于人工全面检查。

Leaders of Code, The Stack Overflow Podcast.

安全感与真实风险之间的落差

一位嘉宾引用了 Waymo 的数据:人类驾驶者发生事故的概率比 Waymo 自动驾驶高出约 80%。然而,即便数据如此,相当多用户仍然更信任人类驾驶员。这说明在技术评估与心理安全感之间,存在不可忽视的落差。嘉宾坦言自己会放心让女儿乘坐 Waymo,因为更相信数据而非情绪判断。

同样,在代码审核&查验场景中,另一个值得思考的维度是:人工审核&查验本身也并非 100% 无懈。Stack Overflow 在内部引入 AI 时,也经历了"代码本来就常有错误"的心理建设过程——与其追求绝对安全,不如将精力集中在"impact 高"的区域(最典型的就是安全问题)。

安全不止于代码层面

嘉宾强调,安全是一个多层防御体系,不仅涉及代码本身,还包括部署方式、运维管理等多个环节。值得注意的新趋势是,AI 代理也正在被用于防御侧——主动识别和修复漏洞,速度远超传统人工流程。

Google 内部的 AI 落地现状

在 Google,AI 能力已向所有员工开放,包括 Gemini Enterprise 在内的企业级工具用于日历、邮件等日常办公场景。嘉宾坦言,这部分能力与企业客户目前能获取的并无本质差异。

真正拉开差距的,是 Google 内部在自主代理(autonomous agents) 上的深度投入:

  • SRE(站点可靠性工程):用代理自动化运维与故障响应
  • 客服:用代理处理工单分类与初步响应
  • 安全:用代理主动识别漏洞并触发修复流程

这些场景的共同目标是:减少人工重复劳动(toil),同时加快业务结果产出。

当前真正的瓶颈在哪里

当被问及"AI 尚不能解决的问题"时,嘉宾给出了一个耐人寻味的判断:模型本身已经不是主要瓶颈——无论是 Gemini 还是 Opus,当前模型能力已能自动化企业大部分工作流程。

真正的限制在于数据激活(data activation)

  • 过去只有极少量的结构化数据被用于分析(通常只是数据分析的一个子集)
  • 现在需要激活的是全量数据:所有结构化数据、运营数据,以及存放在对象存储中的非结构化内容(合同、图像、PDF 等)
  • 更关键的是要让 AI 理解数据的语义和业务问题的关联,才能真正驱动好的结果

嘉宾将其总结为:理想状态下,自主代理要能以高可信度、高自主性执行动作,前提是系统必须充分理解自身的数据资产。而这,正是当前企业级 AI 落地的核心投资方向。

企业级数据孤岛:AI 能否打破壁垒?

企业在数字化转型过程中积累了大量数据,但这些数据往往分散在多个云平台、本地数据中心以及各类 SaaS 应用中,彼此割裂、难以互通。传统方式依赖"数据管家"人工梳理,规模受限、成本高昂。随着 AI 代理(Agent)技术的成熟,用自动化手段盘活沉睡数据成为新方向。

AI Agent:数据发现的新路径

过去,企业数据的可发现性高度依赖人工维护的数据目录。如今,AI Agent 可以承担这一职责——自动扫描数据分布、梳理数据关联、识别权限归属。这种"Agentic Experience"让企业无需招募数千名数据管家,也能实现全量数据的智能管理。

跨云互联:打破数据边界

当前基础设施层面的突破使跨云数据访问更加可行。跨云互联(Cross-Cloud Interconnects)已能将延迟控制在个位数毫秒级别,同时保障传输安全、费用可控。企业数据可能分布在 GCP、AWS、Azure 或本地环境,统一访问的难度显著下降。

开放格式与"围蔷花园"的瓦解

行业正在形成共识:数据必须以开放格式(如 Apache Iceberg)流转,而非被困在特定平台的私有存储中。客户需求倒逼供应商开放数据出口,SAP、Workday、ServiceNow、Salesforce 等主流 SaaS 系统均已支持零拷贝(Zero-Copy)的开放数据访问,计费方式也从按 GB 出口收费转向按带宽计费。

Google 开放知识格式:推进数据主权

Google 近期发布了"开放知识格式"(Open Knowledge Format),目标是让知识以一种平台无关的方式被捕获和利用——无论是个人的个性化知识,还是企业业务相关的通用知识。借助开放格式,数据拥有者能够真正掌控自己的数据,而非被迫绑定某一家供应商。

从"人工定义"到"智能生成":知识本体编排的下一步

在企业数据治理领域,知识本体(Ontology) 的构建长期被视为一项高成本、低效率的工作。两位嘉宾在节目中分享了他们的观察:过去,构建一套完整的 OWL 本体需要投入大量人力,普通中小企业几乎难以承受——这导致实际投入其中的,主要是那些拥有明确且重大业务问题的企业。

AI 驱动的本体生成:从"人审"到"人编"

两位嘉宾均认为,大语言模型和 AI Agent 的出现正在改变这一局面。如今,即便要构建基于 OWL 的知识本体,也可以借助 Agent 自动推断大量语义关系,而无需全部依赖人工逐一定义。

Google 的 Andi Gutmans 提到,他们内部有一个名为 Knowledge Catalog 的项目,核心目标就是把知识本体的构建流程从"人类驱动"转变为"Agent 驱动"。其背后的逻辑很直接:当企业需要为数以万计的数据资产建立语义关联时,靠人力堆叠根本无法覆盖 100% 的数据状态。

AI 擅长处理"脏乱差",人类聚焦高价值决策

Stack Overflow 的 Peter O'Connor 分析了 AI 在这件事上的天然优势:AI 非常擅长处理数据的"脏乱差"状态,并能主动梳理出隐藏的关系网络——这类关系有时连人类都难以察觉。

这意味着在实践中,人类角色应当从繁重的"审核&查验模式"(inspector mode)转向更高价值的"策展模式(curation mode)**。也就是说,AI 负责处理大量重复性强、劳动密集的定义工作,而人类只需在关键节点进行判断和修正。

自生成本体:把隐性知识真正释放出来

Gutmans 还提到,许多有价值的知识实际上存储在员工的个人经验和头脑中,从未被正式纳入系统。当本体构建从手工转向自动生成,这些隐性的知识结构才有机会被真正挖掘出来——这正是 AI 能够带来实质性改变的地方。

延伸阅读

 
内容管家

发表评论