製品
ソリューション
会社情報
エンタープライズ
サインインネットワークを作成
AI · MCP · Agents · Mechanism · Theorem 3

行動ループこそがメカニズムであり、ツール一覧ではない

MCP は Claude Code に手を与えるが、ツール一覧は能力ではない。行動ループ——意図から測定された効果へ——こそがメカニズムであり、スコープがその安全である。

行動ループこそがメカニズムであり、ツールの一覧ではない

ツールを列挙する AI は、ツールを使う AI と同じではない。典拠記事——「Claude Code + MCP: Give Your AI Real Tools」(AI Engineers Academy、2026年6月)——はその溝を率直に描く:Claude Code は「手のない優秀な頭脳」であり、MCP は「欠けていたその手」である。意味を持つ主張はコネクタの規格ではなく、それが閉じるループ——理由づけられた意図から、現実のシステム上の現実の効果へ——である。そのループ、そしてその境界が測定されているかどうかこそがメカニズムである。あとはすべてカタログにすぎない。

Claude Code は手のない頭脳であり、それはメカニズムの表明である

記事は多くの開発者が認識する考えで始まる:Claude Code はコードベースを読み、ターミナルを実行するが、出荷状態のままでは「本番データベースにも内部 API にも、あなたのビジネスが実際に依存している SaaS ダッシュボードにも届かない」。これは機能の欠落をアーキテクチャに見せかけたものではない——メカニズムの表明である。テキストを出力するモデルは、正しい行動を記述するテキストであっても、実行のメカニズムを持たない。「エージェントがあなたのシステムに作用できる」という性質は、モデルがその行動の名前を言えるだけで真にはならない。モデルの出力が呼び出しに変換され、呼び出しの効果が観測されてフィードバックされる境界があって初めて真になる。

これは the 21 papers の Theorem 3 そのものである:性質は、そのメカニズムが実装され測定しているときにのみ保証される。「ツールを使える」は人々がモデルについて絶えず主張する性質である。それは、ツール呼び出しの境界が実装され(呼び出しが現実のシステムに対して実際に発火し)、測定し(結果が戻り、次のステップで推論される)ているときにのみ保証される。その境界なしでは、「モデルはどのクエリを走らせるべきか知っている」と「エージェントはクエリを走らせた」はトランスクリプト上で区別がつかない——そしてその混同こそが、ほとんどの「AIエージェント」のデモがひっそりと棲んでいる場所である。

[UNIQUE INSIGHT] 記事の誠実な読み方は、頭脳/手の比喩がメカニズムの地図であり、飾りではないということである。頭脳は推論関数であり、手は実行の境界であり、神経系は意図を効果へ、効果を意図へ運ぶ経路である。手を取り除けばチャットボットになる。神経系を取り除けばフィードバックのないロボットになる。ほとんどの「AIアシスタント」のピッチが交換可能に聞こえる理由は、頭脳だけを記述し、残りに手を振るからである。

正しいクエリを記述できるモデルは有用な機能を果たすが、それは買い手が通常支払う対象の機能ではない。買い手はクエリが現実のデータベースに対して走り、現実の行が戻ることに支払う。この二つの間の距離——行動を記述することと行動を取ること——が、記事が閉じようとする距離のすべてである。記事は、功績として、両方を「ツール使用」とは呼ばない;記述するエージェントをチャットボット、行動するエージェントをエージェントと呼び、その溝を MCP が対処するものとして扱う。

MCP が変えるのは行動ループであり、ツールの一覧ではない

記事は MCP を「AIエージェントが一つの統一インターフェースを通じて外部ツールと話すためのオープン標準」と呼び、USB-C の類推を出す:一つのコネクタ、多数のデバイス。その類推は有用だが不完全である、なぜならプラグを記述し、ループを記述しないからである。コネクタの規格はツールを交換可能にする;それ自体はエージェントを行動させない。コネクタをメカニズムに変えるのは往復である:モデルが構造化された呼び出しを出し、サーバーがそれを現実のシステムに対して実行し、結果が戻り、モデルが同じセッションで結果を推論する。この往復が行動ループであり、「AIツール」が「これらの API を使える」というプロンプトを意味していたときに欠けていたものである。

記事は一行で区別を鋭くする:「チャットボットは何をすべきかを記述する;MCP を備えたエージェントはそれをする」。することがメカニズムである。記述はテキ生成である;することは測定された結果を伴う実行である。違いは、エージェントのあなたのデータに関する主張が真かどうかを問う瞬間に現れる。記述するエージェントは「顧客テーブルにはおそらくこの id の行がある」と言う。行動するエージェントは読み取り専用クエリを走らせ、現実の行、あるいは現実の不在を報告する。一方は信頼度の付いた推測であり、もう一方は測定である。

本当の仕事をする最小構成

だから記事の最小構成は見た目以上に重要である:

{
  "mcpServers": {
    "my-db": {
      "command": "npx",
      "args": ["-y", "@my/mcp-postgres", "--readonly"]
    }
  }
}

--readonly フラグが興味深い部分である。それは行動ループ上のスコープ境界である——「エージェントが行動できる」が「エージェントが書ける」になるのを防ぐメカニズムである。スコープのないツールレジストリは能力の主張である。スコープが強制されたツールレジストリはメカニズムである、なぜならスコープが「エージェントは読むだけ」という性質を測定可能にするからである。スコープを取り除いても、より能力のあるエージェントはできず、その行動を監査できないエージェントができるだけである。記事はエージェントが「安全に、あなたの条件で」運用されると言う——条件がスコープであり、スコープが測定である。

頭脳/神経系/手の三つ組は測定されたメカニズムの地図である

記事のメンタルモデルは簡潔である:「Claude は頭脳。MCP は神経系。あなたのツールは手。」解剖学として読めば比喩であり、制御系として読めば仕様である。頭脳が提案し;神経系が提案を手へ運び;手が世界に作用し;神経系が世界の応答を運び戻し;頭脳が改訂する。このループの各脚は実装されなければならず、各脚は測定されなければならない、さもなくばループは開いており、あなたが持っていると思った性質はあなたが持っている性質ではない。

開いたループは「AIツール」デモの既定の失敗モードである。モデルがクエリを提案し;デモはクエリが走ったと仮定し;モデルはもっともらしく聞こえる答えを生成し;誰も答えをデータベースと照合しない。行動ループは、現実のシステムからの応答がモデルが推論する対象——その言い換えではなく、その推測ではなく——であるときにのみ閉じる。記事はエージェントが「それらの中で、安全に、あなたの条件で運用される」と言うとき、これに言及する。「あなたの条件」がスコープであり;「それらの中で」が閉じたループであり;「安全に」が境界の測定である。これらはいずれも買い手がデモ映像から検証できる形容詞ではない——それらはメカニズムが動いている間だけ存在する性質である。

[PERSONAL EXPERIENCE] HAI Engine は 2016 年から本番で動いており、最も繰り返される教訓は、測定された実行の境界のない推論関数はエージェントの名を冠したチャットボットであるということである。我々が出荷するすべての能力は、まさにこの理由でタグ付けされる——Production ✅、Partial ⚠️、Roadmap 🔵——なぜならタグはマーケティングではなく、今日どのメカニズムが実装され測定しているかについての表明だからである。モジュールは、モデルが何をするかを記述できるときではなく、そのループが現実のトラフィックで閉じ観測されているときに Production である。

開いたループのデモは、閉じたループより構築しやすく、録画では同一に見えるため生き残る。「私は今 SELECT * FROM customers WHERE id = 42 を走らせるだろう」と言うモデルは、スクリーンショットではエージェントに見える。スクリーンショットはクエリが走ったかを示せない。Honest Architect のあらゆるエージェントデモへの応答は、モデルが使うと主張する各ツールについて、呼び出しが発火したか、何を返したか、モデルの次の文がその返りで条件付けられたかを問うことである。三つのいずれかが「いいえ」なら、そのツールは記述であり、メカニズムではない。

することと記述することは Theorem 3 の性質であり、感覚ではない

記事の最も鋭い一行——「チャットボットは何をすべきかを記述する;MCP を備えたエージェントはそれをする」——は平易な英語による Theorem 3 の表明である。性質は「システムが行動を取る」である。その性質は、メカニズム(ツール呼び出しの境界、スコープ付き、結果の返却付き)が実装され測定しているときにのみ保証される。モデルが賢いこと、プロンプトが長いこと、ツール一覧が印象的であることでは保証されない。閉じたループと観測された境界によって保証される。

だから長いツール一覧は能力ではない。スコープの強制のない五十のツールのレジストリを持つモデルは、取り得る五十の行動を名指せるが、一つも測定されていないモデルである。三つのツールを持ち、それぞれにスコープ(読み取り専用、冪等、監査済み)のあるモデルは、検証できる三つの行動を取るモデルである。前者はパンフレットであり、後者はメカニズムである。Honest Architect の規則は、ツール一覧を主張のカタログとして扱い、行動ループをそれらの主張が真か偽かになる唯一の場所として扱うことである。

[ORIGINAL DATA] the 21 papers はこれを Theorem 3 として形式化する:性質は、そのメカニズムが実装され測定しているときにのみ保証される。エージェントに適用すると、定理は「エージェントがあなたのシステムに作用できる」のはモデルの性質ではなく、境界の性質だと言う。モデルは必要である;モデルは十分ではない。境界が性質を真にし、測定がそれが真であることを知らせる。境界のないツール一覧は、まだ保証されていない性質の一覧である。

記事は MCP が許す四つのことを挙げる:あなたのデータを照会する、あなたの API を呼ぶ、あなたの文書を検索する、ブラウザやあなた自身のアプリを駆動する。それぞれは、対応する境界が実装され測定されるときにのみ真になる主張である。「あなたのデータを照会する」は読み取り専用の呼び出しが発火し現実の行が戻るときに真である。「あなたの API を呼ぶ」はエンドポイントが打たれ応答が次のステップを形作るときに真である。一覧は意図について正直である;メカニズムが意図を現実にする。

ルーティングは行動に先行する:the space is the router

記事が到達しないより深い層があり、それが本番システムにとって最も重要である。エージェントが行動できるようになる前に、行動する正しい場所へルーティングされなければならない。Everythink では the space is the router である:network → community → room トポロジーが、何かが応答する前に、リクエストがどこに着地するかを決める。ツールを呼べるがルーティング層のないエージェントは、誤った文脈で行動するエージェントである——誤ったテナントに対してクエリを走らせ、誤った room に投稿し、誤ったチームにエスカレートする。行動ループは意図から効果への溝を閉じ;ルーティングは文脈から行動への溝を閉じる。両方が実装され測定されなければならない。

だから我々は World Monitor ✅ と Sisters → Oracle calibrated forecast ✅ をモデルの能力ではなく Production のメカニズムとして扱う。World Monitor はスケジュールで区切られたゲートウェイを通じて地理シグナルをルーティングし、上流の呼び出し量がクライアント数ではなく我々のスケジュールで区切られるようにする;各 Sister が imagine() で草案を作り、Oracle が merges() でそれらを確率が一に合計する正規化されたアンサンブルにする。「予測が較正されている」という性質は、マージのメカニズムが実装されその正規化が観測されているから真であり、モデルが説得力があるからではない。それらを公開する MCP サーバーは、モデルではなくメカニズムを公開するだろう。

ルーティング優先の原則は「あなたの AI に本物のツールを与える」が何を意味するかを再枠組みする。記事は手が重要だと言う点で正しい。だが手は神経系が送る場所で行動し、神経系はルーティングトポロジーが決める場所へ送る。ルーティングのないツールは、手の届く範囲の何でも掴める手である。ルーティング付きのツールは、正しい room で正しいものを掴む手である。Social ✅ と Campaigns ✅ モジュールは、行動が発火する前に正しい community と room へルーティングするから Production である——投稿できるからではなく、トポロジーが投稿せよと言う場所に投稿するからである。

なぜスコープが安全のメカニズムであるか

記事の --readonly フラグは、安全の論拠全体を担う小さな詳細である。スコープは「エージェントが行動する」を安全にする測定である。スコープがなければ、あなたのデータベースを呼べるエージェントはそれを削除もできる。スコープがあれば、同じエージェントは読むことしかできない。スコープはエージェントの制限ではなく、「エージェントが安全に行動する」という性質が真である条件である。条件を取り除けば、モデルがどれほど慎重に聞こえても性質は真ではない。

スコープの倫理もここに入る。Everythink の文書化された方針は民生・防衛のみである——攻撃ではなく、標的化ではない。これはメカニズムが何をするために作られるかについてのスコープ境界であり、マーケティングの姿勢ではない。能力を公開するツールプロトコルは、それ自体この境界を運ばない;境界はサーバーに実装され、ループで測定されなければならない。

主要な要点

  • 行動ループがメカニズムであり、ツール一覧ではない。 コネクタの規格はツールを交換可能にする;意図から測定された効果への往復こそがエージェントを行動させる。
  • 「ツールを使える」は Theorem 3 の性質である。 ツール呼び出しの境界が実装され測定しているときにのみ保証される——モデルが行動の名前を言えるときではない。
  • スコープは「エージェントが行動する」を安全にする測定である。 記事の最小構成の --readonly フラグは制限ではなく、行動を監査可能にする条件である。
  • することと記述することが本当の分岐線である。 チャットボットは記述する;エージェントはする。することがメカニズムであり、記述はテキスト生成である。
  • ルーティングは行動に先行する。 The space is the router——network → community → room トポロジーが、行動ループが発火する前にエージェントがどこで行動するかを決める。
  • すべての能力の主張は成熟度タグを帯びる。 Production ✅ はループが現実のトラフィックで閉じ観測されていることを意味する。タグのないツール一覧は主張のカタログである。

よくある質問

MCP は新しいモデルの能力か? いいえ。MCP はプロトコルである——ツール呼び出しのための統一インターフェースである。モデルの推論は変わらない;変わるのは、モデルが提案した行動が現実のシステムに対して実行され、結果がフィードバックされるかどうかである。それはメカニズムの変更であり、モデルの変更ではない。

MCP サーバーを追加すれば私のエージェントは本番対応になるか? 行動ループが閉じスコープ付きの場合のみ。スコープ(読み取り専用、ユーザーごと、fail-closed)なしでツールを公開するサーバーは、エージェントに境界のない手を与える。Production ✅ はループが現実のトラフィックで実装・測定・スコープ付きであることを意味する——コネクタが存在することではない。

これは通常の API 統合とどう違うか? 通常の統合はシステムごとの特注の接着剤である。MCP は能力を一度公開し、MCP 対応クライアントなら誰でも呼べる。メカニズムの区別は依然として当てはまる:価値は測定されたスコープ付きの閉じた行動ループであり、コネクタの形ではない。

「the space is the router」はツールと何の関係があるか? ルーティングは行動ループが発火する前にエージェントがどこで行動するかを決める。ルーティングのないツールは誤った文脈で行動し;ルーティング付きのツールは正しい network、community、room で行動する。ルーティングは文脈から行動へのメカニズムであり、行動ループは意図から効果へのメカニズムである。

Everythink のシステムはこうして公開できるか? これらのメカニズム——World Monitor、Sisters → Oracle forecast、network トポロジー——は測定された境界を持つ Production ✅ メカニズムである。ツールプロトコルでそれらを公開すれば、モデルではなくメカニズムを公開することになる。token、wallet、community-credit の成果は一切約束されない;それらは Roadmap 🔵、pre-revenue、Howey 審査の対象のままである。

Sources

正しい行動を記述するだけのエージェントではなく、正しい文脈で行動するエージェントが欲しいなら、あなたの network を作成——the space is the router、そして行動ループがメカニズムである。

自らの主張を証明するエンジンの上に、あなたの世界を築く。

2016 年から稼働し続けるエンジンの上に、あなた自身のネットワークを作る——あるいは 21 本の論文を書いたチームに話しかける。