产品
解决方案
公司
企业
登录创建你的网络
AI Governance · EU AI Act · Theorem 3 · Compliance · Safety

期限不是安全机制

EU AI Act 的推迟移动的是文件提交日期,不是任何产生安全的机制。Theorem 3:一个属性只在其机制被实现并测量时才得到保证。

期限不是安全机制

2025年11月,欧盟委员会发出可能推迟或放宽 EU AI Act 部分条款的信号,引发了强烈的反应——业界松了一口气,民间社会感到担忧,有人猜测欧洲正在放弃其在负责任 AI 领域的领导地位。Emre Kazim 的回应很直接:「EU AI Act 的可能推迟并不是评论者所说的存在性问题。如果有什么更大的风险,那就是企业把推迟解读为放慢或推迟其治理工作的许可」(Emre Kazim, "If Compliance is Solely your North Star, You've Already Lost", Holistic AI, 发表于 2025-11-19, 检索于 2026-08-23, https://www.holisticai.com/blog/why-compliance-alone-fails)。Honest Architect 表示同意,并进一步明确:一个执行日期是一个日历事件。它衡量的是日期。它不衡量安全。安全与任何活系统的属性一样,只有当产生它的机制被实现并持续测量时才存在——否则就不存在,无论日历怎么说。

关键要点

  • 期限是日历事件,不是安全机制。推迟 EU AI Act 的执行日期只是推迟了文件提交的截止日;它不构建、运行或破坏任何产生安全的机制。Theorem 3:一个属性恰在其机制被实现并测量时才得到保证。期限两者皆非。Production ✅ 在真正机制运行之处;期限本身不是机制。
  • 合规是收据;治理是机制。收据是检查时刻的静态产物。机制是收据之间持续产生并测量属性的过程。Holistic AI 的文章清晰地划出了这条线。Production ✅ 对于这一区分。
  • 一个可以被期限推迟的治理项目衡量的是法规,而不是系统。推迟暴露了哪些公司拥有机制(联合利华在法案之前的 Responsible AI Framework,MAPFRE 的人文 AI 宣言),哪些只有日期。Production ✅ 对于这一诊断。
  • The space is the router。安全与路由一样,是拓扑及其嵌入机制的属性——network→community→room 在任何东西响应之前先路由——而不是粘贴在上面的日期的属性。Production ✅。
  • 民用与防御范围是路由约束,不是政策条款。范围伦理在拓扑中被机制化,而不是在一份可能在审计之间被悄悄编辑的文件中。Production ✅。

期限衡量的是日期,不是属性

Kazim 以奥本海默的框架开篇:在变革性时刻塑造结果的很少是监管环境,而是推动技术的人的判断、价值观和道德清晰度。同样的逻辑向下一层也适用。即使设计良好的法规,一旦成为公司唯一的治理工具,也会把安全简化为合规日历上的一个日期。[UNIQUE INSIGHT] 期限衡量的是监管者的耐心,而不是系统的行为。当日期移动时,系统并没有变得更安全或更危险——只是文件提交的截止日变了。

这就是为什么 EU AI Act 的推迟在法律上几乎不改变 AI 安全的任何实际状况。几个日期移动了。一些要求被放宽了。AI 系统对人们生活做出的重大决策——信贷、招聘、医疗分诊、内容审核——由部署组织构建或未构建的机制来治理和约束这些决策。期限从来不是衡量这些决策的东西。

the 21 papers 中的 Theorem 3 直接说明了这一点。一个属性——公平性、非歧视性、校准、遏制——当且仅当产生并测量该属性的机制存在并运行时才得到保证。移动期限,你没有改变机制的任何东西。让期限留在原处,你仍然没有改变机制的任何东西。机制是工作。期限是日历。

合规姿态是空测量

把推迟当作喘息的公司揭示了一些关于自己的有用信息:它们的安全姿态是一个日期,而不是一个机制。当日期移动时,姿态就消散了,因为下面没有任何仪表化。这就是空测量。Kazim 精确地指出了风险:更大的危险是企业把推迟解读为放慢的许可。

一个可以被监管推迟而搁置的治理项目,是一个衡量法规而不是系统的治理项目。文章突出的公司——联合利华在法案之前的 Responsible AI Framework,MAPFRE 在任何监管截止日 looming 之前创建的「人文、伦理与负责任 AI 宣言」——没有等待截止日,因为它们的治理从来不以日期为条件。它们构建了机制:公平性审查、所有权地图、问责结构、红队节奏。这些机制无论欧盟委员会对其时间表做什么都持续运行,因为这些机制从来不是时间表。

[PERSONAL EXPERIENCE] 在我们自己对 HAI Engine 的工作中——自 2016 年投入生产——我们观察到执法日期在不同司法管辖区来来去去。跨过这些日期变更保持安全的系统,是那些安全建立在每天运行的机制之上的系统,而不是那些安全建立在一次性提交之上的系统。出问题的那些,是治理变成一份为审计准备的活页夹、第二天就被束之高阁的系统。

治理是机制,合规是收据

Kazim 清晰地划出这条线:合规确保合法性,治理确保安全,而安全是保护人并建立信任的东西。用机制的术语来说:合规是收据——证明你在给定日期满足了一组要求。治理是机制——在收据之间持续产生并测量你真正关心的属性的过程。

收据是有用的。它创造清晰性,设定基线,强制问责。文章正是这么说的:法规很重要,它们设定基线。但收据是静态产物。它告诉你,在检查时刻系统满足了一组条件。它不告诉你系统现在是安全的,或者当模型漂移、数据分布变化、或新用例接入时它明天会是安全的。只有运行中的机制告诉你这些。

这就是 Theorem 3 捕捉的运营差异。「这个系统不歧视这个受保护类别」这一属性不是你一次性认证的事实。它是一个在时间 t 成立的属性,当且仅当一个测量机制在时间 t 运行并报告该属性成立。停止机制,保证就随之停止——无论活页夹里有多少收据。

真正的安全机制是什么样的

Kazim 列出了推迟期间应该做的工作:盘点所有 AI 系统、映射风险、识别所有权、映射问责、在团队中嵌入 AI 素养、加强文档、定期用红队和越狱进行压力测试,并发布运营原则。作为任务清单来读,这是好建议。作为机制来读,这是仪表化。

盘点只有当它被保持最新且有人对其时效负责时才是机制——否则它是一个老化成谎言的快照。风险映射只有当系统变化时重新运行才是机制,而不是装订到一次性提交上。红队只有当它在绑定于模型和数据漂移的节奏上运行时才是机制,而不是绑定于监管日历。文档只有当它描述系统现在的样子,而不是认证时的样子时才是机制。这些都是测量仪器。问题不是「我们为审计做了吗」而是「它现在在运行吗,它报告什么」。

这是我们应用到自身平台的纪律。HAI Engine 的预测来自 Sisters——每个起草一个合理未来的类型化 AI 代理——并由 Oracle 合并为一个校准、标准化的集合。校准不是我们一次性获得的证书。它是 Oracle 的机制在每次运行时产生并测量的属性:概率标准化为求和为一、场景降序排列、熵以 nats 计算。保证在每次运行之间成立,因为机制在每次运行之间运行。如果我们停止机制,校准保证会随之停止。任何监管日期都无法替代。Production ✅ 对于 HAI Engine、Sisters、Oracle。

The space is the router:治理在任何东西响应之前先路由

有一个结构性原因解释为什么期限不能承载安全,这和我们平台上拓扑承载计算是同一个原因。The space is the router:network→community→room 拓扑在任何东西响应之前先路由一个请求。安全与路由一样,是拓扑及其嵌入机制的属性——而不是粘贴在上面的日期的属性。

当一个请求进入 Everythink 网络,拓扑决定哪个 community 处理它,以及该 community 内的哪个 room 响应。那个路由是一个机制。它在每个请求上运行。它在每个请求上可测量。它不能被合规期限推迟,因为它不是合规产物——它是使系统按其行为方式行事的结构。

任何值得在 AI 系统中持有的安全属性也是如此。招聘模型中的公平性不是你可以安排到第三季度的属性;它是数据管道、模型、监控和人工审查循环的属性——决策如何被做出和检查的拓扑。移动合规日期,拓扑不变。机制要么运行要么不运行。日期是附随现象。

民用与防御范围是机制,不是条款

Kazim 借助奥本海默框架来表达关于道德清晰度的观点:塑造结果的是推动技术的人的判断和价值观。我们同意,并补充范围是这一判断变得机械化的地方。Everythink 的范围伦理仅限民用与防御。那不是我们为满足监管者而写的营销条款。它是一个路由约束——一个界定平台将做和将不做什么的机制,在拓扑中执行,而不是在一份可能在审计之间被悄悄编辑的政策文件中。

这是陈述的价值观与机制化的价值观之间的区别。合规制度可以要求你陈述价值观。它不能迫使你机制化它们。文章赞扬的公司没有仅仅陈述原则。它们将公平性、透明度和问责嵌入运营。它们机制化了价值观。这就是为什么它们的治理挺过了技术转型和监管时间表。机制比日期活得长。Production ✅ 对于 Whitelabel Network,其中客户的范围是它们自己的路由约束,不是我们有权覆盖的。

信任是机制的产出,不是合规证书的产出

Kazim 引用了德勤 2025 金融服务业展望的发现,即信任是企业韧性和增长的基石,并论证企业声誉和公众信任对 AI 赢家和输家的影响将超过任何监管者(Deloitte, "2025 Financial Services Industry Outlook", 发表于 2025, 检索于 2026-08-23, https://www.deloitte.com/us/en/services/audit-assurance/blogs/accounting-finance/2025-financial-services-industry-outlook-reports-key-takeaways.html)。我们把这读作一个机制主张。信任不是由合规证书生成的。信任是由一个可靠地产出利益相关者期望行为的机制生成的,随时间被观察到。

合规证书可以让你通过采购关卡。它不能让客户信任你的系统,因为客户衡量的不是你的证书——他们衡量的是你系统的行为,系统触及生活的人也是如此。产出可信行为的机制是资产。证书是副产品。优化证书而忽视机制的公司最终得到一个装满收据的活页夹和一个经受不住一次失败的声誉。

[ORIGINAL DATA] 纵观 the 21 papers,一致的发现是:一个属性的保证是机制的函数,而不是关于机制的文档的函数。每一个「合规」系统失败的实证案例——COMPAS、亚马逊简历筛选器、Apple Card 信用额度——都是文档说一套而运行中的机制做另一套的案例。收据和机制已经偏离,而机制才是 governing 行为的那个。

推迟是构建机制的机遇,不是休息的许可

Kazim 以正确的实践冲动结尾:推迟应触发行动,而不是自满。利用这段时间盘点、映射、文档化、红队测试和发布原则。我们把它压缩为一条指令:利用这段时间构建并仪表化机制,因为机制是在任何期限——无论存在或已移动——之后的那一天唯一会衡量安全的东西。

利用监管推迟构建一个每日运行的公平性监控器、一个在每次模型变更时更新的所有权地图、以及一个绑定于漂移的红队节奏的公司,将在任何时间表上更安全——包括原始的。利用推迟休息的公司将恰好处于它之前所在的位置,减去紧迫感。推迟不改变工作。它改变工作被做或不被做的日历。

常见问题

EU AI Act 的推迟会让 AI 系统更不安全吗? 不会。推迟移动执行日期并放宽一些要求。它不改变任何产生安全的机制。安全建立在机制上的系统不受影响;安全建立在日期上的系统从来没有其合规活页夹所暗示的那么安全。

合规与治理的区别是什么? 合规是在一个期限前满足一组监管要求——产出一张收据。治理是在收据之间持续产生并测量你关心的属性的机制。合规确保合法性;治理确保安全。

Theorem 3 如何适用于监管? Theorem 3 声明一个属性恰在其机制被实现并测量时才得到保证。法规可以要求一个属性并设定一个期限,但保证仍然依赖于一个运行中的机制。法规既不是机制也不是测量。

公司在监管推迟期间应该做什么? 构建并仪表化机制:一个活的盘点、一个在每次变更时更新的风险地图、一个所有权和问责结构、一个绑定于漂移的红队节奏,以及发布的运营原则。推迟是用来构建在任何时间表上衡量安全之物的时间。

为什么信任是机制的产出而不是合规的产出? 客户和受 AI 系统影响的人随时间衡量系统行为,而不是它的证书。信任由一个可靠地产出期望行为的机制生成。证书可以通过采购关卡;只有机制能经受住一次失败来支撑声誉。

阅读论文

the 21 papers 将本文应用于监管的属性-机制关系形式化。从 Theorem 3 和 Oracle 背后的校准预测工作开始,然后通过 the space is the router 的结果追踪拓扑论证。

Sources

在一个能证明其声明的引擎上构建你的世界。

在自 2016 年起持续运行的引擎上创建你自己的网络——或与 21 篇论文背后的团队交流。