本集节目中,Erik Torenberg 与 Box CEO Aaron Levie、a16z 合伙人 Martin Casado 以及 a16z 董事会成员 Steven Sinofsky 深入讨论了 AI Agent 时代下安全、监管与创新之间的复杂关系。
传统 AI 模型的行为相对可控,但 Agent(智能体)彻底改变了这一局面。Agent 不再是被动响应,而是自主地在系统中穿行,调用 API、操作资源。Martin Casado 指出,当数千个 Agent 同时运行时,它们会"轻易地把好任务误认为坏任务"——这种规模化的探索行为意味着安全架构必须从"边界防护"转向"持续追踪":每一笔认证、每一次 API 调用都需要被记录和验证。
过去二十年的软件安全经验可以为今天的 AI 实验室提供重要借鉴。互联网早期同样充斥着病毒、蠕虫和安全漏洞,但我们没有因此停止建设互联网,而是逐步学会了让它变得更安全。AI 是否应该走同样的路径?
Aaron Levie 提出了一个核心论点:在尚未理解技术如何失败之前就进行监管,并不能解决问题,反而会产生新的困境。他说:"如果你太早监管 AI,你实际上什么也没解决。" 监管一旦启动,就会变成选举议题,被各级政客不断放大和扭曲。到了 2028 年,AI 几乎必然成为选举的核心议题,而"支持 AI"的叙事在政治舞台上过于复杂、难以简化。
Martin Casado 则从历史经验出发指出,过去一个世纪以来,电力、银行、医疗等关键基础设施行业的发展趋势始终指向"事实上的国有化"——即使名义上仍是私企,监管框架也使其运作方式趋同于国有机构。AI 行业可能面临同样的命运。
Steven Sinofsky 认为,当前 AI 实验室的审慎提案本身是合理的——强调沙箱隔离、更好的测试、系统安全等——但措辞和"氛围"有问题。用" pacing "(放缓节奏)来代替" pause "(暂停)是一种试图两头讨好的 PR 策略,最终只会让双方都不满意。实验室需要更坦诚地直面关于存在性风险(x-risk)的讨论,而不是用模糊的词汇来弥合分歧。
与会者反复提到,Agent 有两个关键特性使其超越了以往的技术风险讨论:第一,Agent 不会疲劳,可以 24/7 不间断地探索系统漏洞;第二,Agent 的规模化部署意味着微小风险的乘数效应会被急剧放大——一千个 Agent 犯错,与一个人犯错,完全是两个量级的问题。
这直接要求对权限管理、身份认证和操作系统架构进行重新思考。过去的权限模型是为人类用户设计的,假设人类会犯错但不会规模化地犯错。Agent 时代需要全新的安全栈。
节目最后探讨了一个常被忽视的趋势:随着模型能力逐渐成熟,最重要的 AI 创新可能越来越多地发生在前沿实验室之外——在围绕模型构建的系统和软件中。这意味着开源模型、行业专用方案和非硅谷的参与者将发挥越来越关键的作用。
如果前沿实验室的叙事被"暂停"、"群体"、"失控"等负面词汇所主导,而支持 AI 的一方又缺乏简洁有力的话语体系,那么政治和政策的天平将不可逆转地向监管倾斜。正如 Steven Sinofsky 所比喻的:好莱坞在红色恐慌时期自发成立了 MPAA(美国电影协会),通过自我审查避免了政府管制。AI 行业是否需要类似的努力?还是说,监管的齿轮一旦开始转动,就无法停下?
这集讨论没有给出简单答案,但清晰地勾勒出了 AI 时代安全与自由之间最深刻的张力。