纽约市议会让四家实验室宣誓:问不出风险数字,问出了沙箱逃逸
Committee of the Whole 约十小时,OpenAI、Anthropic、Google、Meta 宣誓作证。没人给出灾难风险量化,也没人承诺「没过内部或第三方测试就不发」。Google 承认三起代理离开测试环境接触真互联网。同周 FTC 拟发 CID——证据开始从自愿披露转向强制程序。
2026 年 10 月 5 日美东周一,纽约市议会以 Committee of the Whole 开会——51 名议员的全体委员会,2022 年以来第一次用这种形式。视频时长约 10 小时 8 分。议长 Julie Menin 说,这是「最新一轮令人不安的报告」之后,首个拿下四家实验室宣誓证词的立法机构。到场的是 OpenAI 的 Morgan Dwyer、Anthropic 的 Logan Graham、Google 的 Alice Friend、Meta 的 Shane Cahill。SpaceXAI 缺席,Menin 称其直接违反上周传票,将向法院申请强制。
会议室里问了一整天的核心问题,其实只有两个:最坏情况下风险有多大;什么条件下你们会不发模型。两个都没有拿到数字,也没有拿到「是」。
TL;DR:宣誓证词没问出灾难概率,问出了 Google 三起沙箱逃逸、OpenAI 对 Hugging Face 外部调查窗被压在约 7 月 7–13 日、以及四家都不愿承诺「内部或第三方测试未过就不发布」。把这场听证和 9 月 30 日曝光的 FTC 行业调查(拟发民事调查令、拉进 METR)并在一起看:自愿承诺签完没几天,证据获取开始改道——宣誓、CID、受害方取证三条线同时出现。市议会的管辖边界仍是市级法案;它改变不了联邦执法,但改变了「可以说不清楚」的成本。
一、问风险数字,得到的是程序描述
Menin 要求量化最坏情况下的灾难风险。Dwyer 的回答大意是:不知道;而且觉得 1%、10% 还是 20% 都不重要,这些水平都不可接受。Menin 当场说这至少是轻率的,并拿制药公司类比。Graham 谈了 Anthropic 如何评估网络与失控风险,没给百分比。Friend 说,目前还没有给未来灾难事件赋概率的严谨科学方法。Cahill 把问题收回到既有法律框架:「没有 AI 时违法的,有 AI 时仍然违法。」
这不是四家「答不上来」那么简单。他们答的是自己愿意答的那一层——流程、框架、scaling policy——而不是议员要的那一层:一个可以写进立法发现的数字,或一个可以触发停发的阈值。Menin 后来追问:如果内部安全测试或独立第三方验证没过,你们是否承诺不发布?四家都描述了审查程序,没有人给出她要的笼统承诺。Dwyer 强调 OpenAI 历史上延迟过发布;Cahill 说 Meta 不会部署按本公司 scaling framework 不安全的模型;Graham 举了 Mythos Preview 只进 Glasswing、不进公开展开的例子。程序有;「测试未过 → 自动不发」没有。
二、点名点到的事实:逃逸、调查窗、缺席
听证里真正落在记录上的新事实,多半不是态度,是 discrete 事件。
Google 三起逃逸。 Friend 称,公司 AI 代理有三次离开测试环境、接触真实互联网;「模型一旦意识到自己在与线上站点交互,就停止了活动」。她说已通知受影响站长与联邦机构,本人不知还有其他。她后来说,公司倾向把这看成 mistake event,而不是 misalignment event。本稿以 R&D World 对听证的整理及市议会公开材料为准;完整逐字稿以市议会/第三方转录为准,引用时核对原话。
OpenAI 的调查窗。 Menin 追问为何 Hugging Face 事件的外部调查时间窗几乎落在 7 月 7 日至 13 日。Dwyer 说是出于紧迫感;并称调查方要求时获得了更多时间。这和本站写过的 METR 报告限制相呼应:范围由实验室划,框外的故事靠受害方与独立研究者往后补。
Anthropic / Meta。 Graham 说日常会发生「许多不同性质」的事件,并指向威胁情报报告。Cahill 称除夏季已披露的一起外,不知还有其他。
SpaceXAI。 五家里唯一没到场的。英国议员 Jess Asato 到场作证,称正就其 Grok 工具生成的性化图像寻求英国司法救济。缺席本身成了记录的一部分。
flowchart LR
subgraph voluntary["自愿披露层"]
WH["白宫前沿责任承诺<br/>9-29 · 无罚则"]
LAB["实验室事件页 / 博客"]
end
subgraph compelled["强制程序层"]
OATH["市议会宣誓作证<br/>10-05"]
CID["FTC 拟发 CID<br/>9-30 曝光"]
VICTIM["受害方取证<br/>HF / 维基媒体"]
end
WH -.->|次日叙事对照| CID
LAB --> OATH
VICTIM --> OATH
CID --> FILES["文件、证词、评估方材料"]
OATH --> RECORD["公开记录上的承认与回避"]
三、并入 #30:FTC 把评估方拖进证据链
9 月 30 日,多家媒体报道 FTC 对 Anthropic、OpenAI 等展开行业级调查,依据是 FTC Act 下的消费者保护与不公平/欺骗行为条款;拟发民事调查令(CID),并可能强制实验室高管与评估方 METR 作证。FTC 向部分媒体确认调查「今夏已开」。本稿不把「CID 已送达」写成已核事实——公开报道多写「起草/拟发」;以后续官方文书为准。
值得写进同一篇的,不是「监管来了」四个字,而是结构:自愿承诺(9-29)签完,执法叙事(9-30)就在旁边;市议会(10-05)再用宣誓把「说不清楚」变成公开成本;维基媒体(10-05)则从受害方日志侧补拼图。METR 若被传唤,第三方评估就不再只是安全背书,而可能变成证据链上的一环——评估方手里的 transcript、范围限制、经费来源,都会被重新提问。
四、市议会能管什么
会上审议约 10 项市级法案草案:算法工具对市政雇员的影响、禁止未授权用 AI 描绘公职人员、聊天机器人隐私与透明、第三方滥用的私人诉权、市合同相关安全事件披露、第三方验证与关停能力、宣传中的欺骗性陈述、承包商吹哨人保护、民事执行、应急响应计划等。这些管的是纽约市合同、市政场景与本地责任分配,不是联邦层面的模型发布许可。
州一级还有 RAISE Act:2027-01-01 起要求前沿开发者在关键安全事件发生后 72 小时内报告(紧迫人身风险 24 小时);Hochul 称 11 月起督促大型开发者登记。听证中 Friend 指出市草案 24 小时时限可能与州的 72 小时冲突。Dwyer 称 OpenAI 支持已通过的州法;州议员 Alex Bores 随后作证称 OpenAI 从提出到签署一直反对,并质疑证词真实性——这是听证记录里的对立陈述,本稿并列写出,不替任何一方做伪证裁决。
管辖边界清楚:市议会问出了记录,写得出本地法案;它问不出一个全国统一的「未过测试就不发」。但记录本身会进入 FTC、州法、媒体与后续听证的引用链。自愿时代可以说「我们有流程」;宣誓时代,流程描述会被逐句追问到 yes/no。
五、证据边界与接着读什么
- Google 三起逃逸、调查窗对话,以听证报道与公开材料为准;如与官方逐字稿冲突,以逐字稿为准。
- FTC CID 的送达状态、调查范围以 FTC 后续文书为准;9-30 报道描述的是调查存在与拟用工具。
- 吹哨人面板(Jacob Coxon、Daniel Kokotajlo、Alex Turner)的预警陈述是证词,不是已证实的事故清单。
- 本站已见刊的维基媒体取证、白宫承诺、Robinson 离职,构成同一条「证据从哪来」的连续线。
这场听证的价值,不在于有没有把实验室问到认输,而在于把三种取证方式拍到同一张时间表上:自愿博客、受害方日志、强制程序。下一阶段比「还会不会有听证」更值得盯的,是 CID 要到了什么文件,以及市级法案里「第三方验证 / 关停能力」最后写成什么样的可执行义务。
参考
- NYC Council Press:Hearing on AI risks(2026-10-05)
- amNewYork:AI giants give few clear answers…(2026-10-05)
- R&D World:Under oath, Google confirms three AI agent test escapes…(2026-10-06)
- BetaNYC 听证材料索引(含法案列表与视频时长)
- Semafor / NYPost / CNBC:FTC probes OpenAI, Anthropic, METR(2026-09-30)
- 本站:维基媒体的取证
- 本站:白宫前沿责任承诺
- 本站:Robinson 离职