Hassabis 想给 AI 建一个 FINRA:注意,这是被监管者自己在画监管的边界

2026-07-21 · AI观点雷达 · AI治理 · Hassabis · 监管俘获 · 开源模型
真正的分歧不是要不要管 AI,而是用什么制度形态管——Hassabis 给的答案是行业自律,这既是解法也是风险。

先说结论

7 月 14 日,Google DeepMind 的 Demis Hassabis 在自己的 Substack 发了一篇叫《A Framework for Frontier AI and the Dawning of a New Age》的长文,核心主张只有一句话:给前沿 AI 建一个 FINRA。

FINRA 是华尔街那个行业出钱、行业出人、在 SEC 监督下运行的自律组织。Hassabis 想照这个样子搞一个"标准机构",让前沿实验室在模型发布前最多提前 30 天自愿把模型交上去做安全评测,等评测协议成熟了"很快就能正式化",变成进美国市场的强制门槛。

我的判断是:这篇东西真正的分量,不在"呼吁监管"——那是老调。它的分量在于,一个被监管对象,主动、具体地把监管的制度形态、门槛和边界都替监管者画好了。这既可能是当下最务实的解法,也可能是一次教科书级的监管俘获预演。两面都得看。

事情是怎么发生的

直接触发点,Hassabis 自己在 Axios 采访里说得很白:上个月美国政府对 Anthropic 的 Fable 5 / Mythos 5 那次临时封杀,是"一记警钟"。那次是亚马逊研究员发现一个越狱 prompt,商务部就以国家安全为由紧急叫停,连外籍员工都不能用,一封就是 19 天。事后被广泛批评:政府既缺技术判断力,决策又不透明,凭什么说封就封、说放就放。

Hassabis 的逻辑是:与其被这种"临时起意"的行政干预反复折腾,不如行业自己先立一套稳的。他要的机构,董事会由独立技术专家、开源社区代表加政府官员组成,行业出钱做大规模测试,覆盖范围是"每一个前沿级模型——不管国产进口、闭源还是开源权重",评测内容包括危险网络能力、生化核风险、自主能力升级、护栏绕过和欺骗行为。他给的时间表很急:“几个月”,最好年底前就跑起来,因为在他看来 AGI"大概只有几年之遥"。

值得注意的是反应:Altman、Nadella、Pichai、Musk 罕见地齐声点赞。这几个平时互撕的人一起叫好,本身就是个信号。

为什么重要

因为它把 AI 治理的辩论,从"该不该管"往前推到了"用什么制度形态管"。

这个问题被严重低估了。过去半年,从 Fable 5 被封到 GPT-5.6 走"政府预审"式发布,前沿模型的发布已经在悄悄变成一种受审查的基础设施。但这些都是零散动作。Hassabis 第一次给出了一个成型的制度设计,而且明确排除了"AI 版 FDA"那条重政府路线——白宫 AI 顾问 Sriram Krishnan 刚说过"不会有 AI 的 FDA",Hassabis 的 SRO 方案恰好是绕开这句话的政治解。

对我们做影像和色彩研究的人来说,别觉得这是华盛顿的事。manifesto 白纸黑字写了要覆盖 open-weight 开源权重模型。开源权重恰恰是我们做复现、教学、光谱/ISP 实验最依赖的东西。一旦"自愿"滑向"formalisation",合规成本会顺着链条往下游传导。

我的正反评价

先说它对的地方。FINRA 类比抓住了一个真实约束:政府确实没有评测前沿模型的技术能力,把 expertise 内化进一个专业机构,比商务部拍脑袋封 19 天强得多。主动设计也比被动挨打好。门槛对国产/进口、闭源/开源一视同仁,逻辑上也站得住。

但失败模式更值得盯:

第一,FINRA 的历史记录并不干净。2008 金融危机前,它恰恰没拦住华尔街。行业自律最经典的病,就是监管俘获——出钱的、出人的、定标准的,都是被考的人,等于让考生出考卷。

第二,“自愿 30 天→快速正式化"是个滑坡,而自愿期里没有强制力:谁定门槛?哪家觉得吃亏,退出就是了。

第三,也是最大的红旗——四家死对头一起点赞。当所有被监管者都支持同一套监管方案,通常说明这套方案对在位者有利:合规壁垒会抬高门槛,先发大厂锁定优势,被挤压的是小团队和开源生态。

对研究、教学和影像系统的启发

研究上,治理正在变成一个真实的约束变量,尤其涉及开源权重的发布节奏。做复现、做 spectral / AWB 的开源模型时,得开始把"这条线会不会被前沿治理误伤"纳入判断。

教学上,这是一份现成的课堂讨论材料。“让被监管者设计监管"是公共选择理论里的经典问题,正好和金融史上的 FINRA 对照着讲,比空谈"AI 伦理"扎实得多。

影像系统上,我更想主张一件事:治理要分级。我们做的 ISP、AWB、光谱估计,绝大多数是窄域、可验证、低灾难风险的系统——恰恰是"能被验证的才该被自动化"那一类,跟能写核生化利用代码的 frontier LLM 完全不是一个风险量级。别用一道门把它们全塞进去。Hassabis 提出了正确的问题,但答案里那道"一刀切覆盖 open-weight"的门,需要有人替下游把它撑开成分层的。