产品
解决方案
公司
企业
登录创建你的网络
AI · AI regulation · governance · Theorem 3 · measurement · rights

AI权利需要测量机制,而不是原则

白宫AI权利法案命名了五项正确的原则。一项权利只在其机制已实现且正在测量时才成立——Theorem 3应用于每一项原则。

AI 权利需要测量机制,而不是原则

一份权利法案如果只命名一项权利、却没有编码出测量该权利的机制,那就是一个愿望,而非一项保证。白宫的《AI 权利法案蓝图》(2022)列出五项原则——安全系统、算法非歧视、数据隐私、通知与解释、以及人类替代方案——每一项作为愿望都是正确的,作为合同都是不完整的,因为一项权利只与检测其被违反的仪器一样真实。

我们在 Everythink 上构建于一个更强的主张。[ORIGINAL DATA] 21 篇论文中的 Theorem 3 指出:一项属性恰好在其机制已实现且正在测量时才被保证。蓝图推动了对话;它并未终结对话。下面我们逐一审视它的五项原则,并提出唯一能将原则转化为权利的问题:机制是什么,它在测量吗?

蓝图是一份原则文件,不是测量标准

2022 年 10 月,白宫科技政策办公室发布了《AI 权利法案蓝图:让自动化系统为美国人民服务》,并附有一份技术配套文件《从原则到实践》。该框架列出五项原则和一组支持性实践——部署前的风险测试、持续监控、独立审计、知情同意、可访问的文档,以及向人类审核员退出的选项。

这是一份严肃且构造良好的清单。问题出在时态上。蓝图说系统"should be"被设计为预防可预见的危害,"should be"被测试,"should"公开独立审计。每一个"should"都是原则;没有一个是测量仪。监管者可以阅读蓝图,供应商可以签署它,而什么都不必改变,因为没有任何东西被拿来与一个在越界时让供应商不合格的阈值对比。

这不是只针对白宫的批评。它是原则文件的通用形态:它命名属性(安全、公平、隐私),把机制留给实现者。我们的论点,根植于 Theorem 3,是属性与机制不可分离。一项属性恰好在其机制已实现且正在测量时成立;测量仪一关,属性就不再被保证,只剩断言。

Theorem 3:一项属性恰好在其机制已实现且正在测量时才被保证

支撑 Everythink 平台的 21 篇论文系列围绕一个我们每天应用的结果:一项属性恰好在其强制机制已实现且正在主动测量时才被保证。如果机制缺失,属性只是愿景。如果机制存在但未在测量——本季度跳过审计、监控器以静默模式部署、回退路径从未演练——该属性在该区间内不被保证。

这重新定义了什么是"权利"。一项权利不是文档中的一句话;它是一种活的仪表化。Sisters(我们类型化的 AI 智能体)与 Oracle(产生校准预测的集合融合器)✅ 在生产中运行,我们能主张校准的原因不是我们把"校准"一词写进了原则文件——而是 Oracle 以 nats 计算熵、在恰好一处归一化概率,并且与已实现结果的偏离是一个我们读取的数字。如果我们停止读取它,校准主张当天即失效。

HAI Engine ✅ 自 2016 年起在生产中运行,而这种连续性是"引擎有效"这一主张的机制,而非一条营销口号。把同样的测试应用到蓝图的五项原则上,缺口就变得具体了。

原则 1——安全与有效的系统需要一个部署前与持续的测量闸门

蓝图说系统应被设计为预防可预见危害、在部署前测试、持续监控、并独立审计。使"安全且有效"成为被保证属性的机制,是一个在测量越过阈值时令部署不合格的闸门,加上一个其读数即系统运行条件的持续监控器——而非季度报告。

[UNIQUE INSIGHT] "the space is the router"的重构在此适用:Everythink 中的 network→community→room 拓扑在任何东西响应之前就路由请求,这意味着安全边界可以在路由时强制执行,而非在生成之后。一个坐在模型已产出输出之后的安全闸门是退款机制;一个坐在路由上的安全闸门是预防机制。蓝图"被设计为预防可预见危害"只有在预防位于请求必经路径上时才成为保证,而非在事后审查中。

在生产中,我们将 Oracle ✅ 的预测锥视为"有效"的测量仪器:如果已实现结果以校准所称的速率落入锥内,系统有效;否则系统失败,我们修复机制。蓝图的原则是正确的属性;缺失的部分是命名测量仪与令部署不合格的阈值。

原则 2——算法歧视保护需要一个被测量的差异化影响测量仪

蓝图要求设计者、开发者与部署者主动考虑歧视性结果、持续测试差异化影响、防止受保护类别的代理变量、并发布独立审计。每一个都是机制——差异化影响测试是一个真实、已编码的统计程序——但原则把节奏与阈值留给实现者,而保证正是从这里漏出。

Theorem 3 对此很严格。一个在发布时运行一次然后关闭的差异化影响测量仪,不能保证第七个月的非歧视。保证只在测量仪运行且结果被采取行动的区间内成立。这就是为什么我们将 Oracle ✅ 的校准作为活的数字而非一次性徽章发布:属性是测量流,不是证书。

对蓝图第二原则的诚实解读是:它命名了正确的属性与正确的机制家族,然后把约束部分——阈值、节奏、失败动作——交给部署系统的人。一项在审计节奏滑落时静默失败的非歧视权利尚不是权利;它是一句有权利形状的句子。

原则 3——数据隐私需要一个在边界处测量的同意与范围机制

蓝图呼吁内置的防滥用数据实践保护、清晰透明的同意、相称的监控,以及在敏感情境中禁止持续监控。同意是机制;范围是机制;相称性是测量。原则是稳健的。保证问题在于同意是否被捕获、范围是否被强制、相称性是否被计算——还是只被写下来。

客户主权是 Everythink 对同一问题的回答,而且它是操作性的,不是声明性的。你的网络、你的品牌、你的数据:网络运营者持有路由拓扑,而"the space is the router"意味着数据不会离开它被路由到的 room,除非路由策略如此规定。这是一个可在边界处测量的范围机制——一个请求要么通过策略,要么不通过,而决定被记录。

[PERSONAL EXPERIENCE] 自 2016 年起在生产中运行 HAI Engine ✅,我们一再重新学到的教训是:一个没有边界测量的隐私原则会退化为保留策略,仅此而已。蓝图的第三原则在其最具体处最强——"监控不应在工作、教育或住房等敏感情境中使用"——因为情境检查是一个测量仪。它在其只说"should"而未命名在情境敏感时令请求不合格的仪器处最弱。

原则 4——通知与解释需要一个技术上有效且按效用测量的解释

蓝图要求可访问的文档、重大变更时的最新通知、技术上有效且有意义、为受众量身定制的解释,以及尽可能的公开可访问性。"技术上有效"一语在此承担实际工作:一个技术上无效的解释是一个故事,而故事不是解释。

这正是 Sisters→Oracle ✅ 流水线挣得其位置之处。每个 Sister 是一个类型化智能体,带有从 TOML 文件加载的命名人格,其草稿盖有 prompt 版本戳以供可复现性;Oracle 将草稿融合为一个归一化集合,概率和为一、场景按降序排列。读者得到的解释不是关于预测的生成段落——它是集合本身,附带校准。这是一个技术上有效的解释,因为被解释之物(概率锥)正是被测量之物。

蓝图的第四原则在"技术上有效"被定义为"解释对应于系统的一个被测量属性"、且对应关系被检查时,才成为保证。一个描述系统未测量属性的解释在技术上无效;它是装饰。我们将校准数字视为每个预测解释的承重部分,因为移除它会把解释变成散文。

原则 5——人类替代、考虑与回退需要一个被演练且被测量的回退路径

蓝图要求在适当时提供退出选项、让人类补救失败与错误的回退与升级流程、敏感情境中的额外监督,以及人类治理流程的公开文档。退出选项是机制;回退路径是机制;监督是测量。保证在于回退路径是否在被需要之前就被演练,以及人类治理结果是否按有效性被测量,还是仅仅被发布。

一条从未运行过的回退路径是一个机制的图画,而非机制。Theorem 3 对此毫不留情:"一个人能补救此事"这一属性,只有在补救路径已实现且正在被演练时才被保证——在真实申诉上测试,解决时间与反转率作为数字被读取。蓝图"公开可访问的文档详述人类治理流程、其结果与有效性"的排序正确:结果与有效性是测量仪。缺失的约束是一个阈值:在该阈值上,一个无效的回退触发对自动化系统的改变,而非又一份备忘录。

用 Everythink 的话说,人类回退是一条路由,而"the space is the router"意味着回退路由与自动化路由一样真实——它被接入拓扑,而非在政策中描述。一个提供人类审核员的 room 每当请求走该路由时就在演练它;一个只在 PDF 里承诺人类审核员的 room 则没有。

范围伦理:为什么一份权利法案必须命名它不会做的事

一份针对自动化系统的权利法案也是关于范围的声明,而蓝图在此悄然有力。其配套实践假设的是民用情境——就业、住房、教育、信贷、保险——它所编目的危害(歧视性评分、不可靠交易、偏见招聘)正是一个民用与防御系统被建造以避免造成的危害。Everythink 以书面政策持有同一边界:仅限民用与防御范围。一份不命名它将拒绝做什么的权利法案,是一份可被解读为允许它未禁止之任何事的权利法案。

包容性 by design 属于同一范围论点。一项只在英语、高带宽连接上交付的通知与解释权,并未交付给地球上大部分人。蓝图"为受众与情境量身定制"是原则;机制是在低连接下的多语言与多模态交付,这是一个构建决策,而非一种情感。我们守住这条线,因为替代方案是一项对最不需要其保护的人真实、对其他所有人缺席的权利。

关键要点

  • 一项权利是一次活的测量,不是一句话。Theorem 3:一项属性恰好在其机制已实现且正在测量时才被保证。
  • 白宫蓝图(2022)命名了五项正确的属性——安全、非歧视、隐私、解释、人类回退——并把约束机制(阈值、节奏、失败动作)留给实现者。
  • 每项原则只有在其测量仪被命名且运行时才成为保证。一个关闭的测量仪等同于没有测量仪。
  • "the space is the router"把预防放在请求必经的路径上——安全、范围与回退在路由时强制执行,而非事后。
  • Oracle ✅ 的校准数字是每个预测解释的承重部分;Sisters ✅ 的 prompt 版本戳是可复现性机制。这些是由读取的仪器将属性转化为保证的例子。
  • 民用与防御范围,以及包容性 by design,是同一机制的一部分:一项未在所有地方、向所有人、以其语言交付的权利,尚不是一项权利。

常见问题

白宫的 AI 权利法案在法律上有约束力吗? 没有。它是一份白宫白皮书,旨在为未来的美国政策与立法提供信息。它是一份原则文件,而非法律,这正是机制问题之所以重要的原因——没有一个测量的仪器,一个无约束力的原则没有失败信号。

Theorem 3 究竟说了什么? 一项属性恰好在其强制机制已实现且正在主动测量时才被保证。如果机制缺失或测量仪关闭,该属性在该区间内不被保证——它只是被断言。

"the space is the router"如何改变安全论证? 它把安全边界从生成后审查移到路由时强制执行。network→community→room 拓扑在任何东西响应之前就路由请求,因此路由上的安全或范围闸门预防危害,而非退款。

Everythink 是否依据这些原则审计自己的系统? 我们将 Oracle ✅ 的校准作为活的数字发布,为每次 Sisters ✅ 运行盖 prompt 版本戳以供可复现性,并将 HAI Engine ✅ 自 2016 年起的生产连续性视为"引擎有效"的机制。这些是被测量的属性,而非徽章。

Wallet & Token 或 Community Credit 模块是否被这些权利覆盖? 否。Wallet & Token、Super App 与 Community Credit 是 🔵 Roadmap,尚未产生收入,并须经 Howey 审查。我们不承诺 token、wallet 或 community-credit 的结果,而一份权利法案不改变该成熟度状态。

造测量仪,不是造口号

白宫蓝图完成了困难的部分:它命名了正确的属性。剩下的工作是 Theorem 3 所描述的——为每项属性实现机制并让测量仪持续运行。这是一份权利法案与一份愿望清单之间的区别,也是我们为之构建的区别。创建你的网络,并从一开始就把测量路由进来。

Sources

在一个能证明其声明的引擎上构建你的世界。

在自 2016 年起持续运行的引擎上创建你自己的网络——或与 21 篇论文背后的团队交流。