
彻底的诚实是一项产品功能,而非免责声明
我们网站上的每条声明都带有一个成熟度标签——Production ✅、Partial ⚠️ 或 Roadmap 🔵。这个标签不是我们藏在演示稿里的脚注;它就是产品本身。还没产生收入的东西就叫 pre-revenue。Roadmap 条目永远不会被悄悄提升为 Production。这些标签随每项能力贯穿整个网站、变更日志和这篇文章,因为一条你看不见的保证就是一条你无法核对的保证。
要点
- Everythink 的 HAI 对话引擎自 2016 年起在生产环境中运行——唯一被标记为 Production ✅ 的能力,是那些机制已构建且正在测量的能力。
- Theorem 3 出自我们的 21 篇学术论文系列,它指出一项属性当且仅当其机制被实现并测量时才得到保证——这条规则支配着每一个状态标签。
- Matchmaking ⚠️、Marketplace ⚠️ 和 Calendar ⚠️ 是 Partial;Wallet & Token 🔵、Super App 🔵 和 Community Credit 🔵 是 Roadmap,处于 pre-revenue,尚未上线。
- 标签随能力一起出现在网站、变更日志和博客中——这样买家审视的是机制,而不是形容词。
为什么诚实是一项产品功能,而不是营销层面的免责声明?
因为一个随能力一起出现的标签本身就是一种机制,而机制是唯一能让声明可被验证的东西。2026 年 3 月,MarkTechPost 发表了《A Coding Implementation to Design an Enterprise AI Governance System Using OpenClaw Gateway Policy Engines, Approval Workflows and Auditable Agent Execution》,它表明治理只有在分类、审批和追踪日志被内建进运行时——而不是在幻灯片上声明——时才真正生效。我们认同这一前提,并将其应用于自身的声明。一个状态标签就是一个小型治理系统:它说明什么已构建、什么在测量、以及两者都不是的部分。
[UNIQUE INSIGHT] 重新定位是这样的:免责声明是事后用来缓和差距的说法;而功能是你在产品中构建出来的东西,目的是让差距从一开始就不存在。我们的诚实标签属于后者。每一个都是产品与描述它的页面之间一份小型且可执行的契约。如果 HAI engine 被标为 Production ✅,那是因为该引擎自 2016 年起在生产环境运行,且测量仍在进行。如果 Wallet & Token 被标为 Roadmap 🔵,那是因为机制尚未构建——无论销售压力多大,标签都不会在它构建之前移动。
正因如此,标签不是脚注。脚注是可选阅读;标签出现在每页上、能力名称旁,字号相同。略读的买家看到它。深读的买家也看到它。标签是细心买家最先核查的东西,也是粗心买家最后才注意到的东西——而这正是关键所在。
Theorem 3 如何把一个价值观变成可检验的声明?
一项属性当且仅当其机制被实现并测量时才得到保证。这是我们综述论文里 Theorem 3 的字面陈述,也是决定某项能力获得哪个标签的规则。2026 年 5 月,MarkTechPost 报道了 Fastino Labs 发布的 GLiGuard——一个 3 亿参数的安全审核模型,它“matches or exceeds accuracy of models 23–90x its size”——而该声明之所以可信,是因为基准、数据集和延迟测量都已公开。保证随机制一同流动。我们以同样的标准约束自己的声明。
[ORIGINAL DATA] 我们的状态标签系统把 Theorem 3 落实为一个三态:Production ✅ 表示机制已构建且在主动测量;Partial ⚠️ 表示机制存在但测量或覆盖不完整;Roadmap 🔵 表示机制尚未构建,标签是一个带日期的承诺,而非当前的声明。三态阻止了那种从“计划中”悄悄滑向“已上线”的缓慢漂移,正是这种漂移在无声地侵蚀信任。没有第四种“几乎 Production”的状态——你落在三个桶之一里,而桶是公开的。
这条定理在这里做的是实打实的工作。没有它,“彻底诚实”只是一句团队在截止压力下随时可放弃的口号。有了它,问题就变成机械式的:机制建好了吗?在测量吗?如果两个答案都是肯定的,标签就是 Production ✅。如果任一为否,标签就下调。规则消除了判断,而消除判断正是让标签熬过糟糕季度的原因。
标签随能力同行时,看起来是什么样子?
看起来就像同样的三个符号出现在三个地方的同一项能力旁:网站、变更日志和博客。2026 年 6 月,MarkTechPost 报道 Databricks 开源了 Omnigent,一个 meta-harness,其“control”层在 harness 层追踪 agent 的动作并强制执行护栏,而不是通过提示词——这是一种有状态的策略,而非被陈述的策略。我们的标签以同样方式运作:它们是状态,声明在页面的源代码里,并在能力状态改变时更新,而不是事后涂上去的。
[PERSONAL EXPERIENCE] 这一点我们吃过苦头才学到。几年前,我们发布了一个功能页面,把某项实际上只接了一半、并未测量的东西写成了“available”。一位细心的买家做了演示,发现了差距,并问了一个我们无法回答的问题。修复不是更好的文案。修复是一个本会迫使我们把 ⚠️ Partial 写在该声明旁的标签——并在买家不得不开口之前就先回答那个问题。自 2016 年起,引擎及其生产能力都带着标签,半成品也带着属于它们的标签。
所以标签不是事后叠加的营销层。它是对我们被允许写下什么的约束。如果一项能力是 Roadmap 🔵,页面写 Roadmap 🔵,变更日志条目写 Roadmap 🔵,如果之后有人把它上线,两者都在同一天移到 Production ✅——绝不会提前。标签随行,因为真理来源只有一个,而每个界面都从它读取。
哪些能力是 Production,哪些是 Partial,哪些是 Roadmap?
这张图很短,而且我们保持精确。Production ✅:HAI 对话引擎、Social、Campaigns 和 Whitelabel Network——对话核心,以及它所组合到的那个带品牌的多界面外壳。Partial ⚠️:Matchmaking、Marketplace 和 Calendar——存在并在使用的机制,但它们的覆盖或测量尚未完成。Roadmap 🔵:Wallet & Token、Super App 和 Community Credit——设计工作、带日期、pre-revenue、未上线。2026 年 7 月,MarkTechPost 发表了《Building a Policy-Governed Multi-Agent Financial Research Workflow with Omnigent》,它对工具调用和 API 花费施加了硬性限额——提醒我们“策略”只有在限额被接通且计数器在跑时才有意义。
请注意这张图不做什么。它不以暗示 Roadmap 条目近乎完成的方式为它们承诺日期。它不把 Partial 条目描述为带保留的 Production。它不让 Roadmap 条目不带标签就出现在功能列表里。当买家问“钱包上线了吗?”,答案是否定的,而标签早已这么说。当买家问“matchmaking 能用吗?”,答案是“部分可以——这里是什么能用、什么不能”,标签也早已这么说。
这正是抵御常见压力的那一部分。任何销售动作里的压力都是向上取整——把 Partial 的东西叫做 Production,把 Roadmap 的东西用一种暗示比实际更快的语气称作“coming soon”。标签的存在恰恰是要让向上取整变得不可能。符号就是符号;你不能在没建好的东西旁边打“✅”。
这与 AI 治理讨论的其他部分相比如何?
比较起来很契合,因为整个讨论正朝向正是这种内建、可测量的控制方向移动。2026 年 4 月,MarkTechPost 报道 OpenAI 发布了 Privacy Filter,一个开源 PII 脱敏模型,其可信度依托于公开的架构、披露的训练管线以及一组被点名的失败模式——“missed detection of novel credential formats”就写在 model card 里。这是同样的本能:声明机制,声明它抓不到的东西,让买家阅读这些限制。我们的标签是这种披露在产品一侧的版本。
更广泛的治理领域正在收敛到一个简单的测试:控制存在于运行时里,还是只存在于政策文档里?OpenClaw 治理教程把这一点说得直白——一个系统“must operate under strict governance rules”,而证据是 trace log,而不是政策文本。我们的标签通过同样的测试。标签不是风格指南里的一句话;它是页面源代码里、随能力变化而变化的一个值。如果机制停止测量,标签就是错的,我们会听到——来自买家、来自变更日志的读者,或来自我们自己的评审。
我们向这场讨论添加的,是坚持披露要随能力同行,而不是待在一个单独的“限制”页面里。一个从不点击限制页面的买家仍然看到标签,因为标签就在功能名旁边。这种摆放位置就是产品决策。它决定了你面前的诚实与你需要去找的诚实之间的差别。
什么阻止团队在压力下提升状态?
一条机械的、而非可自由裁量的规则。Theorem 3 给我们这条规则,而三态标签给我们执行。从 ⚠️ 到 ✅ 没有一条不通过“机制已构建并在测量”的路,而从 🔵 到任何状态也没有一条不通过“机制已构建”的路。裁量被刻意移除,因为裁量正是在季度末压力下失效的东西。
在这里,机制比形容词更重要。许多团队都有一个叫“诚实”的价值观。很少团队有一条规则说该价值观可被执行、有一套让状态可见的符号,以及一个供所有界面读取的唯一真理来源。这种组合才熬得住。光有价值观只是一张海报。一个价值观加上一条定理、一个三态、和一张随行的标签,才是一项产品功能——一项买家在五秒内就能核查的功能。
这也是我们发表 21 篇学术论文系列的原因。这些论文不是营销;它们是定理所居住的地方,带有可验证的 DOI,好让想审计这套推理的买家读到证明,而不是接受我们的口头保证。我们对定理要求的严谨,同样适用于产品声明。如果我们指不出一个机制,我们就不写标签。
常见问题
三个诚实标签到底是什么意思?
Production ✅ 表示机制已构建且在主动测量——自 2016 年起在服务的 HAI engine 是最清晰的例子。Partial ⚠️ 表示机制存在但覆盖或测量不完整,如 Matchmaking。Roadmap 🔵 表示机制尚未构建;Wallet & Token 和 Community Credit 是带日期的承诺,pre-revenue,未上线。
为什么不干脆对所有未完成的东西用单个“beta”标签?
因为“beta”把两种不同的状态压成了一种。Partial 能力今天就在使用中,只是有已知差距;Roadmap 能力根本不在使用中。把它们并在一起会掩盖买家真正关心的差别——我现在能用吗,到什么程度。三态让这种区分一眼可见。
标签会变吗,由谁来改?
标签在能力状态改变时改变——当 Partial 机制完成测量或 Roadmap 条目上线。变更发生在一个真理来源里,而网站、变更日志和博客都从它读取。没有单独的“营销”版本标签;买家看到的符号就是工程记录里持有的符号。
这如何具体地与 pre-revenue 条目交互?
pre-revenue 条目——Wallet & Token、Super App、Community Credit——是 Roadmap 🔵,钱包、token 或 community-credit 层里的任何东西在任何上线之前都需经过适用的金融和证券审查。我们不会把它们呈现为 Production,该层里今天没有任何东西上线。标签在每个界面都说清楚了,所以这个问题不必再问。
买家可以在哪里核验标签背后的声明?
about-us 页面列出每项能力及其标签,变更日志记录了何时上线了什么,21 篇学术论文系列存放着带可验证 DOI 的定理。买家可以读到任何 Production 声明背后的机制,也可以读到任何 Roadmap 条目的已公开 roadmap。要点是,核验并不被销售电话拦在门外。
如果这就是你想从 AI 平台获得的诚实,预约一次 demo,我们会带你走一遍 network → community → room 拓扑、自 2016 年起在生产中运行的引擎,以及 roadmap 上每样东西的真实状态。
Sources
- MarkTechPost, "A Coding Implementation to Design an Enterprise AI Governance System Using OpenClaw Gateway Policy Engines, Approval Workflows and Auditable Agent Execution," retrieved 2026-08-23, https://www.marktechpost.com/2026/03/15/a-coding-implementation-to-design-an-enterprise-ai-governance-system-using-openclaw-gateway-policy-engines-approval-workflows-and-auditable-agent-execution/
- MarkTechPost, "Fastino Labs Open-Sources GLiGuard: A 300M Parameter Safety Moderation Model That Matches or Exceeds Accuracy of Models 23–90x Its Size," retrieved 2026-08-23, https://www.marktechpost.com/2026/05/13/fastino-labs-open-sources-gliguard-a-300m-parameter-safety-moderation-model-that-matches-or-exceeds-accuracy-of-models-23-90x-its-size/
- MarkTechPost, "Databricks Open-Sources Omnigent: A Meta-Harness That Composes, Governs, and Shares AI Agents Across Claude Code, Codex, and Pi," retrieved 2026-08-23, https://www.marktechpost.com/2026/06/13/databricks-open-sources-omnigent-a-meta-harness-that-composes-governs-and-shares-ai-agents-across-claude-code-codex-and-pi/
- MarkTechPost, "Building a Policy-Governed Multi-Agent Financial Research Workflow with Omnigent," retrieved 2026-08-23, https://www.marktechpost.com/2026/07/30/building-a-policy-governed-multi-agent-financial-research-workflow-with-omnigent/
- MarkTechPost, "OpenAI Releases Privacy Filter: A 1.5B-Parameter Open-Source PII Redaction Model with 50M Active Parameters," retrieved 2026-08-23, https://www.marktechpost.com/2026/04/28/openai-releases-privacy-filter-a-1-5b-parameter-open-source-pii-redaction-model-with-50m-active-parameters/

可证明的 AI 需要机制,而非形容词
定理 3:一项属性只有在其机制被构建并处于测量状态时才被保证。主张应当连同其证明一起交付——并具备说出尚未构建部分的成熟度。
→ →
社会证据是一个测量过的集成,而非营销主张
Honest Architect对食品饮料行业UGC的解读:社会证据是一个测量过的集成,而非营销主张。定理3——属性(信任)由机制(可观察的社会证据+真实性验证)保证,而非由品牌断言保证。Naturitas的3.7倍转化数据是机制效果的测量。
→ →
聊天机器人不是 AI 操作系统
聊天机器人回答问题;AI 操作系统负责路由。为什么必须是空间——而非助手——充当路由器,以及这一区别如何决定 AI 是真正帮助一个组织,还是仅仅为其装饰。
→ →