In Silico

AI協働

エージェントの組織化に、マネジメント技術は半分だけ効く

2026/8/7 (更新: 2026/9/20) シリーズ「AI協働への姿勢」 第11回 / 全15回

目次
【背景】エージェントを並べると人と同じ問題が出る重複・噛み合わない成果物・滞留【問い】マネジメント技術はそのまま持ち込めるのか調整の技術と、動機づけの技術を分けて当てる
※概念図(背景→問い):人を並べた学問は、エージェントを並べたときにも効くのか

Anthropic が2025年6月に公開した自社の多エージェント研究システムの開発記に、こんな失敗を書いている。初期のエージェントは、単純な問い合わせに50体もの子エージェントを立ち上げ、存在しない情報源を延々と探し、過剰な更新で互いの邪魔をした。指示を短く済ませて曖昧なままにしたときは、もっと分かりやすい形で壊れた。一体が2021年の自動車向け半導体不足を調べているあいだに、別の二体が2025年の供給網を重複して調べていた。開発チームはこれを「効果的な分業になっていなかった」と書いている1。同じ記事は処方も出している。この種のエージェントに最良のプロンプトは、厳格な指示ではなく「分業・問題解決の進め方・努力の予算を定める協働の枠組み」だという1

モデルが馬鹿だったのではない。誰が何を担当するかを、誰も決めていなかっただけだ。

これは、人を何人も並べたときに出る問題と同じ形をしている。重複、噛み合わない成果物、全体を把握している者の不在。人間の組織はこの問題を百年かけて技術にしてきた。分業の設計、管理の限界、調整の仕組み、進捗の把握、責任の所在である。ならば、その技術をそのまま持ってくればよいのだろうか。

半分は持ってこられる、というのがこの記事の見立てだ。組織を設計するとき突きつめて相手にする問題は、仕事をどう分担し、情報をどう流して足並みを揃えるか(調整=coordination)と、各人にその分担を実際に果たさせるか(動機づけ=motivation)の二つに整理できる。この二分は本記事のものだが、組織の経済学の教科書に置き場所がある。ミルグロムとロバーツの標準的な教科書は全体を七部で編み、そのうち第二部を「調整——市場とマネジメント」、第三部を「動機づけ——契約・情報・インセンティブ」として、別々の部に分けている2。本記事はこの二つを、それぞれ情報処理の層(調整)と動機づけの層(動機づけ)と呼ぶ。

このうち調整の側の技術は、ほぼそのまま使える。分業の設計や管理の限界についての古い命題は、前提を当て直せば今も立つ。変わるのは何にどれだけ払うかで、たとえば人間の組織が会議の時間で払っていたものを、エージェントではコンテキストで払う。一方、動機づけの側の技術は使えない。評価や報酬が人を動かすのは、本人が結果を引き受け、それに反応するからだ。エージェントには、その引き受ける主体がない。この違いを区別せずに持ち込むと、効かない側の道具に頼ったまま、効いている側の負担が増えていることに気づけない。

以下は、各技術の原典が自分で書いた前提条件を読み直し、それがエージェントで成り立つかを一つずつ当てていく作業になる。

分けた時点で、作れるものは決まっている

最初に効く側から見る。仕事の分け方の話だ。

1968年、メルヴィン・コンウェイは短い論説で、いまコンウェイの法則と呼ばれる主張を書いた。「システムを設計する組織は、その組織のコミュニケーション構造の写しにあたる設計を生み出すよう制約される」3。組織図がそのまま成果物の構造に転写される、という話だ。

この記事に効くのは、その手前で彼が書いている理由のほうである。コンウェイは「どんな設計チームの組織であれ、その組織では有効に追求できない設計案の一群が存在する。必要なコミュニケーション経路が存在しないからだ。ゆえに、組織化されていて、かつ偏りのない設計グループというものは存在しない」と書く。そして「設計チームの組織を選んだ時点で、下位グループに活動を委譲することが可能になる。委譲がなされ、誰かの探求の範囲が狭まるたびに、有効に追求できる設計案の一群もまた狭まる」3

言い換えると、分け方は、設計判断そのものである。ただしコンウェイ自身は、そこで固めろとは書いていない。彼は「最初に生まれる設計が最良であることはまずないので、いま通っているシステム構想のほうを変える必要が出てくる。ゆえに組織の柔軟性が有効な設計には重要だ」として、組み替えられる状態に保てと処方している3そしてここに、エージェントの側が有利な非対称がある。 人の組織を組み替える費用に比べれば、担当の切り直しは比較にならないほど安い。縛りの強さを柔軟性に比例させたのはコンウェイ自身で、「組織のコミュニケーション構造が完全には柔軟でない範囲において、その組織は自らの像をあらゆる設計に刻む」と彼は書く3。組み替えの費用そのものの比較のほうが本稿の見立てで、彼が書いたものではない。「設計チームを組織するというまさにその行為が、明示的にせよそうでないにせよ、いくつかの設計判断がすでに下されたことを意味する」3

エージェントに移すと、これは抽象論ではなくなる。一体にファイル一つを持たせるのか、機能一つを持たせるのか、層一つを持たせるのか。その選択は、書かせる前に、出来上がるものの形を決めている。ファイル単位で分ければ、ファイル単位で完結する設計しか有効には追えなくなる。読み取りだけを分けて書き込みを一本にまとめれば、整合した一つの成果物が出るかわりに、書き込みは並列化しない。実際、この読み書きの非対称を運用則として名指す実務家もいる。読む行為は本質的に並列化しやすいが、書く行為を並列化すると、文脈を互いに伝える問題と、出力を整合させて統合する問題を同時に抱えることになる、という4

分け方が結果を決めるという主張を、測った研究もある。あるプレプリントは、260の構成を比べた。6つのベンチマーク、5つのアーキテクチャ(単体と、独立・中央集権・分散・混成の4種のマルチエージェント)、3つのモデル系統を、道具とプロンプトと計算量をそろえて並べたものだ。ここでの数字は、各ベンチマークの成績そのものではない。単体エージェントの成績を100としたとき、そこから何%上下したかという相対変化である。分解可能な金融推論では最良の構成が+80.8%、逐次的な計画立案では最悪の構成が−70.0%だった。ただし後者ではどの分け方でも劣化した(−70.0%〜−39.1%)。六つのベンチマークと四つのマルチ構成を通して平均すると、多エージェント化の効果は−0.3%である。原論文はこれに 95%信頼区間 −58.7%〜+77.2% を併記しているが、この区間は平均を中心にしていない。中点は +9.3% で、平均の −0.3% から9.5ポイントほど離れている。同じ文が併記する標準偏差は 37.5% で、読むべきは平均の精度ではなく、構成によってこれだけ振れるという散らばりのほうだ。著者らの結論は「アーキテクチャとタスクの整合が協働の成否を決める」だ。同論文は結論節で、効くのは課題の分解可能性であって頭数ではない、とも書く5

上振れと下振れが百パーセント以上ひらくが、それは分け方だけを変えて得られる幅ではない。伸びた側は仕事が分解可能だったからで、逐次的な仕事ではどう分けても落ちた。分け方の当否は、仕事の形と対にしてしか決まらない。 同論文はさらに、単体で正答率45%を超える課題では追加のエージェントが負に効くとし、この効果は多重比較補正を通しても残ると報告している5。そして全体を平均すれば効果はほぼゼロである。増やすこと自体は、効かない。

調整の費用は、会議からコンテキストへ移った

分けると、調整が要る。ここが二つ目の効く側だ。ただし効き方の度合いは変わる。

コンウェイは同じ論説で、組織の規模と経路の関係も「初等的な確率論が教えるところでは、組織内で可能なコミュニケーション経路の数は、組織の人数の二乗のおよそ半分である。そこそこ小さな組織であっても、人々が多少なりとも『仕事』をこなせるようにするには、コミュニケーションを制限することが必要になる」と書いている3。彼はこの論説を、「増員が生産性を単純に足すという前提に立たない、システム設計管理の哲学が要る」という一文で閉じてもいる3

七年後、フレデリック・ブルックスが、この経路の数を増員の費用として分解した。ブルックスは、増員が足す負担を明示的に二つの項に分ける。「コミュニケーションの追加負担は二つの部分からなる。訓練と、相互通信である。各作業者は、技術・作業の目標・全体戦略・作業計画について訓練されねばならない。この訓練は分割できないので、追加される労力のこの部分は作業者数に比例して増える」。そして「相互通信のほうが悪い。もし仕事の各部分が他の各部分と個別に調整されねばならないなら、労力は n(n−1)/2 で増える」6。その相互通信の項も、対の数で終わりではない。彼は「さらに、三人・四人と寄って共同で片をつける会議をもたねばならないなら、事態はいっそう悪くなる」と続ける6

エージェントに当てると、二つの項は別々の運命をたどる

訓練の項は、消えるのではなく単価が落ちる。人間の新人が数週間かけて飲み込むものを、エージェントは規約ファイルを読み込ませるだけで持つ。ただし持ち越しが無いので、体数ぶん・呼び出しごとに払い直す。ブルックスの線形項は形のまま残り、費用の単位だけが人日からトークンへ変わる。ただしこれは「学習が速い」のではなく「学習していない」ことの裏返しでもある。会話の状態は呼び出しごとに送り直す前提で作られており、公式ドキュメントは API を「ステートレス」と明言する。記憶を持たせる道具の説明文はもっと直接的で、モデルに与える指示そのものに「中断を前提とせよ。あなたのコンテキストウィンドウはいつ何時リセットされてもおかしくないので、記憶ディレクトリに書き留めていない進捗はすべて失う危険がある」と書いてある7。持ち越されるのは、運用者が外側に用意したファイルの中身だけだ。訓練費用が安いのは、投資が働き手の内側に残らないことと同じ事実の別の面である。積み上げたければ、運用者が外に置き場を作って書き戻させる。記憶ツールの説明は「記憶はすべてあなたのアプリケーションの中にある」と書く7

相互通信の項のほうは、残る。ただし何で払うかが変わった。人間の組織では会議と割り込みで払う。エージェントでは、コンテキストで払う。ここは推測ではない。千体規模の協働を組んだ査読つき研究(ICLR 2025 採択)が明示的に見積もっており、既知の前提として他の文献に負わせる形で「制約のない情報交換は必然的にコンテキストの爆発を招き、最終的には、それ以上の主体を支えられなくすることでスケーラビリティを損なう」と置く。見積もりのほうはそのあとだ。記憶制御を入れない場合の複雑さを、同論文は「コンテキスト長は n² で増え、ネットワークが大きくなるにつれて時間と費用が二乗で増える」と自分で導いている。彼らの機構はこれを「二乗から線形の増加へ切り離す」ものだ。既存の一手法についても「三十体を超えたあたりでコンテキスト爆発に頻繁に遭遇し、スケーラビリティを損なう」と、同論文は比較のなかで述べている8。第一節の260構成の統制評価は、同等の性能に揃えたとき多エージェント構成が単体の1.6〜6.2倍のトークン予算を要したと測っている5。導出ではなく、統制条件下の実測である。

コンウェイの n²/2 も、ブルックスの n(n−1)/2 も、人がつくる対の数、つまりつなぐ経路の本数を数えている。MacNet の n² が測るのはコンテキストの長さそのものだが、それが二乗で伸びる理由も同じところにある。最も密につないだ構成では経路の数が n(n−1)/2 になり、その一本ごとにやり取りぶんのコンテキストが積まれるからだ。次数が揃うのは偶然ではなく、三つとも突きつめれば同じ対の数で決まっている。変わったのは対の数え方ではなく、対ひとつに何を払うかのほうだ。支払う場所が会議室からコンテキストウィンドウへ移った、というのはこの意味においてである。同じ260構成の評価は、コンテキストの長さではなくやり取りの回数についてだが、この次数を実測してもいる。回数は体数の1.724乗で伸び、指数の95%区間は 1.685 から 1.763 だった5。原典はこの超線形を、全対全の対の数から来る二乗を実際の帯域が削った形だと説明している5

移った先には、人間の会議には無かった性質がある。量が増えると、詰め込んだ情報自体が効かなくなる。ある論文は、長い文脈の中ほどに置かれた情報の利用が落ちることを2023年時点のモデルで測っている。当時のあるモデルでは、関連情報を中ほどに置いた最悪の場合、二十件・三十件の設定で入力文書を一つも与えない場合を下回った9。同じ論文は、位置ではなく量そのものを動かした測定も載せている。検索した文書を二十件より多く積んでも読み手側の成績は約1〜1.5%しか伸びず、大きく伸びるのは入力の長さ、したがって遅延と費用のほうだった9。この現象は、いまや百万トークンの窓を売っている側の製品ドキュメントにも「トークン数が増えるにつれて、正確性と再現率は劣化する。コンテキストの腐敗(context rot)として知られる現象である」と書いてある10

もう一つ、人間の組織と違う点がある。この費用を誰が払うかだ。人間の組織では、関係者全員が調整費用を時間として分散して払う。エージェントを束ねる構図では、全体を見ている一つの文脈、すなわち束ねる側に集中する。増やした分だけ、束ねる側の窓が埋まる。これは本稿の推論ではない。MacNet の導出そのものが、最大の文脈圧を受ける合流点の一体を対象にトークン消費を計算している8。冒頭で引いた開発記は、束ねる側を経由させない回避策を挙げている。子エージェントの成果物を外部の系に置いて軽い参照だけを返させれば、会話履歴に大きな出力を写す分のトークン負荷が減る、という1

「一人が何体まで見られるか」に、管理の限界を最初に数式化したグライキュナスは1933年の論文で数を出している。ただし出し方が本記事に効くので、そこから見る。

彼の出発点は、監督者が数え損ねているものがある、という指摘だ。「ほとんどの場合、監督者は自分の責任の重さを、自分と部下のあいだの直接個別の関係の数で測る。だがそれに加えて直接の集団関係交差関係がある」11。三種類を、彼自身の最小の例で言う。トムがディックとハリーの二人を見ているとする。

部下二人で、監督者が注意の内に抱える関係は六つになる(原典は数え方に幅があることを認めて「四から六」と書き、種類の違う関係に比べられる重みを付けられない以上もっとも包括的な数え方を基準に採る、と宣言している。以下の数はその基準のものだ)。そして人を一人足すと、「新しい個人は、すでに集団にいる人数だけ、交差関係と直接の集団関係を追加する」。だから関係の総数は「指数的な割合で増える」11。彼の表では、部下1人から6人までで 1 → 6 → 18 → 44 → 100 → 222。部下を5人足すあいだに、抱える関係は221本増える。

ここからが導出だ。 彼は「一人の監督者が交差関係を最大12、直接の集団関係を最大28まで見ていられると仮定すれば」と置く。この二つの数は恣意的な予算ではなく、部下が4人のときの、交差関係と集団関係のちょうどその値である(交差 4×3=12、集団 4×(2³−1)=28)。上限の置き方が答えの側から来ている、と読める。ただし彼はこの一致を明言していないし、4という数の根拠を上限だけに負わせてもいない。組合せの図の直下では「四人までは組の全部を把握して覚えるのは容易だが、五人からはもう不可能だ、組が混乱の迷路になるから」と別の理由を挙げている。数え方そのものも彼は比で示す。4人から5人へ一人増やすと、単位が抱える関係の総数は44から100へ、複雑さで127%の増加、対して働く能力の増加は20%だ。増え方が頭数より速い、というのが原典の要点である。 彼はそこから「定型的な仕事以外では、交差関係と集団関係の急増こそが、一人が実効的に監督できる人数を実際に制限する支配的要因である」「各階層の横の分割は最大5、おそらく4に制限されるべきだ」と結ぶ11。同じ巻でガリックも、仕事が定型的・反復的・測定可能で均質なら一人が「おそらく」数十人を、多様で分散していれば数人しか見られない、と条件つきで書いている。緩む側の条件はもう一段細かく、彼は「働き手が全員ひとつの部屋にいるときは、とくにそうだ」とも書く。ただし彼は同じ節で、多様さ・分散・測りにくさは「どんな組織でも最上位でもっとも顕著だ」と続け、「ゆえに統制の幅が課す制限は、組織の最上位、執行者の直下でもっとも顕著に現れる」と結んでいる。緩む条件は下の層の話で、締まるのは束ねる側だ12

エージェントに移すと、形は割り算ではなく、増え方の速い量が上限をまたぐ点を探す作業として残る。上限にあたるのが束ねる側の窓で、増える量が体数につれて積み上がる関係のぶんのコンテキストだ。前節で見たとおり、支払う場所は会議室からコンテキストウィンドウへ移っている。ただし増え方の次数は原典と同じではない。グライキュナスが数えるのは同席の効果まで含んだ集合の数で、だから 2ⁿ の項が出る。エージェントの実装で実際に積まれるのは、通信する対のぶんのコンテキストだから、最も密につないだ構成なら二乗にとどまる(前節の MacNet の導出がその形だ)。ただし同じ導出は、記憶制御を入れれば増え方が頭数に比例するところまで落ちるとも示している8。それでも上限が窓である以上、またぐ点は必ずある。設計で動くのは、またぐ点がどこに来るかのほうだ。なお干渉しない仕事なら制限が緩むことはグライキュナス自身も書いている。ただし彼はそれを最下層に限らず、「これらの上位層においてすら、直属の部下が同僚の仕事に食い込まない仕事をしているなら、より大きな人数を統制できる」と述べ、交差関係を持たない同型の旅団や、技術的関係の薄い子会社群を例に挙げている11。彼が限界の側へ戻すのはそのあとだ。専門化が進めば機能別の編成が要り、それが調整の需要を生んで集団・交差関係の幅を自動的に広げる、だから「この原理はより小さくではなく、より大きな重要性を持つようになる」と締める11。∴ エージェントについても、またぐ点が確実に来るのは互いの仕事が食い込む場合である。隔離が保てているあいだは、原典が言う例外がそのまま当てはまる。冒頭の開発記も、束ねる側が並列に立てる子エージェントを3〜5体とし、10体超を使うのは「責任が明確に分けられている」場合だと条件を付けている。1933年の「最大5、おそらく4」とは由来が別だが、数も条件の形も近い1。260構成の統制評価も、計算予算を固定すれば3〜4体を超えたあたりで一体あたりの推論容量が薄くなりすぎ、通信の費用が推論の能力を上回ると書いている5

なお、終盤の〈釣り合いは、黙っていても取られる〉で全体を扱うガルブレイスの四方策のうち二つは、ここまでの話にそのまま対応する。自己完結的なタスクへの切り分けはエージェントの隔離であり、彼が挙げる代償、すなわち「資源の専門化が失われること」もそのまま残る。垂直の情報システムへの投資には、彼自身が限界を書いている。「データが形式化され定量化できるなら、この方策は有効である。関連データが質的で曖昧なら、情報の在り処まで意思決定を降ろすほうが容易かもしれない」13。生成物の良し悪しは、たいてい後者だ。

増やした分は、レビューの待ち行列に積み上がる

束ねる側の窓が埋まるということは、成果物を確かめる側の余力が埋まるということでもある。三つ目はそこにある。流し方だ。生産管理がいちばん長く付き合ってきた問題であり、いまのところ実務でいちばん効きそうな一本でもある。

エンジニアリング分析ツールを提供する企業が、4,000超のチーム・2万2千人の開発者の2年ぶんの稼働データを、各社の低導入期と高導入期のあいだの変化として集計して報告している14。出る側は実際に伸びた。開発者あたりのエピック完了は66%、タスクのスループットは33.7%、プルリクエストの併合率は16.2%増えている。だが確かめる側の伸び方が桁違いだった。最初のレビューが付くまでの時間の中央値は156.6%、レビューに費やす時間の平均は199.6%、レビュー中の時間の中央値は441.5%伸びた14。同社はこれを「シニアエンジニア税」と呼ぶ。

そして詰まりは、待ち行列の外へあふれている。レビューを一度も経ずに併合されたプルリクエストが31.3%増えた14。報告はこれを意図的な省略とは見ておらず、「レビュアーが、到着するAI生成コードの量に追いつけない」ためだろうと書く。開発者あたりのバグは、前年版の9%増から54%増になった。「関係は平坦化しておらず、急になっている」と原典は書く14。ベンダー自身の観測データで査読は経ておらず、相関であって因果ではない。なおこの報告は、後述の年次調査と自分から食い違いを名指ししている。年次調査が調査票をもとに「強い技術的土台はAIの利点を増幅し、欠点から守る」と結論したのに対し、「2年ぶんの実測データは違う話をしている」と書く14。同じ現象を、片や自己申告の横断調査で、片や稼働データで測っている。

年次のDevOps調査は2024年版で、AI導入が25%増えるごとに配信の安定性が推定7.2%下がると報告し、その理由を「AIによって同じ時間でずっと多くのコードを生み出せるようになった結果、変更のかたまりが大きくなっている可能性が高い。大きな変更ほど遅く、不安定を生みやすいことを、この調査は一貫して示してきた」と仮説立てた15。2025年版では、スループットのほうは改善へ転じたと報告が変わっている。同報告は前年から転じたものを三つ挙げており、価値ある時間・配信スループット・プロダクト性能がいずれも肯定側へ動いたとしている16。ただし不安定さの側は変わらない。同報告は「AI導入はいまや配信のスループットを改善する。前年からの重要な転換である。しかし依然として配信の不安定さを増やす。速さに合わせてチームは適応しつつあるが、その土台となる仕組みは、AIで加速した開発を安全に扱えるところまでまだ進化していない、ということだ」と書く16。同じ報告書は、不安定さの理由として「大きなかたまりのコードはレビューしにくいから」を、部分的な説明の仮説として挙げている16。不安定さは、適応の効き方が指標によって分かれた側の例に挙がっている。なぜ分かれたのかについては、「この調査データでは答えられる立場にない」と自ら断ってもいる16

つまり、生成を速めた分は実際に外へ出る。だが出す側が16〜66%の伸びなのに対し、確かめる側は156〜441%伸びている。伸びたのは通した量であって、通す能力ではない。ただしこれは同じ組織の前後を突き合わせた比較で、二年のあいだに起きた他の変化と切り分けられていないので、ここでは弱い傍証として置く。これは制約理論が四十年前に定式化した形そのものだ。規則には「ボトルネックで失われた一時間は、システム全体で失われた一時間である」「非ボトルネックで節約した一時間は、単なる蜃気楼にすぎない」とある17。生成はほぼ確実に非ボトルネックの側だ。そこを速くしても、外に出る量は制約側の能力より上へは行かない。論文は規則群の手前で、非制約の資源を能力いっぱいまで稼働させても産出は増えず、増えるのは余剰在庫のほうだと書いている17。ここでその在庫にあたるのは、レビューを待つ変更の列だ(本稿の当てはめ)。

そして、この調査報告は自分でその接続を「これは制約理論の核心的な洞察でもある。どのシステムにも、届けられる価値の量を支配する制限要因、すなわち制約がある。制約以外に注力するのは生産的に感じられるかもしれないが、価値の流れを有意には改善しない」と書いている。同報告はこれをAI導入に当てて、「配信全体の速さは、開発者の新しい道具と増した速度に合わせて周辺のワークフローが更新されないかぎり、大きくは変わらない」と続ける16。処方も具体的だ。同報告は「たとえば、あるチームが工程を可視化して、コードレビューが大きなボトルネックだと気づいたとする。そこでそのチームは、単にもっと多くのコードを生成させてボトルネックを悪化させるだけの使い方ではなく、コードレビューの工程を改善するためにAIを使う、と決められる」と書く16

この処方は、第一節で引いた260構成の統制評価にも別の角度から出ている。同論文は誤りの増幅も測っており、相互通信を持たない独立構成は、誤りをベースラインの17.2倍まで伝播させる(95%信頼区間 14.3〜20.1、訂正機構なしの条件)。中央集権では4.4倍、分散は7.8倍、混成は5.1倍で、桁で外れるのは独立構成だけである。要旨も「中央集権的な調整を持つ構成に比べ、中央での検証を欠く構成は誤りをより伝播させる傾向がある」と述べる5。ただし原論文は、他の調整指標を統制するとこの誤り増幅は単独では有意にならず(p = 0.658)、構成間の性能差は効率と間接費のほうで説明されると書く5。独立構成の劣位そのものは残る。成功率は 0.370 で、単体の 0.466 を下回る5。増やすほど、検証を置く場所が効いてくる。

エージェントを足す先は、生成ではない。 ただし、どこが制約かは系ごとに確かめるものだ。制約理論の手順は同定から始まる。制約が取りうるのは、能力が需要に届かない、需要が能力に届かない、規則が能力を制限する、という物理・市場・方針の三つの形だ17。同定したうえで、足すなら制約になっている側、つまりレビューと検証に足す。統合そのものを並列化すると、第一節で見た書き込みの問題に戻る。そして足せないなら、投入する側を絞る。投入量の上限は、生成能力ではなくレビュー能力で決める。制約理論はこれを rope と呼び、投入を制約が決める速度で放出する機構として置いている17

ここまでが情報処理の層だ。分け方、調整の費用、流し方。どれも、原典が書いた条件をそのまま当て直せば使える。次に、当て直しても使えない側へ移る。

動機づけの層が無いので、聞いても分からない

人間の組織で「管理」と呼ばれているものの相当部分は、動機づけの上に乗っている。見積りを出させ、進捗を報告させ、遅れの理由を説明させる。これらが情報として意味を持つのは、報告する側が結果を引き受けるからだ。嘘をつけば信用を失い、次の仕事が来なくなる。

この構造に費用の名前を与えたのが、ジェンセンとメックリングの1976年の論文だ。彼らは代理関係を「一人または複数の者(依頼人)が、他の者(代理人)を、自らに代わって何らかのサービスを行うよう関与させる契約であって、代理人に何らかの意思決定権限を委譲することを伴うもの」と定義する。そして生じる費用を、「(1) 依頼人による監視支出、(2) 代理人による保証(bonding)支出、(3) 残余損失」という三つの合計として定義した18

エージェントに当てると、二番目の項の中身が変わる。原典が保証支出として挙げるのは、会計を第三者監査に付すと契約で保証すること、不正に対して明示的に担保を積むこと、意思決定権限を契約で制限することの三つの形だ18。このうち担保を積む形は移らない。現在の運用形態では、実行する側に持続する同一性も、失って困る資源も帰属していないからだ。残る二つは原資を要さない。原典は権限制限の代償を、儲かる機会を取り切れなくなることだと書いており、エージェントの権限を絞る運用がそのまま当たる18

ただしこれは、代理関係の枠組みがそのまま当てはまったうえで一項だけがゼロになる、という話ではない。「もし双方が効用最大化者であれば」という論文の前提そのものが成り立っていない。エージェントの逸脱は、自分の利益を追ったからではなく、接地を欠いたまま尤もらしさを追ったから起きる。後で引く完了報告の研究は、8つのモデル系統を並べ、tau2-bench の失敗のうち、評価が不合格を出しているのに完了が宣言されていたものの割合が13%から79%まで開いたと測っている。上端の79%は推論に特化した一モデルの値で、原典がそこから引き出しているのは、推論を厚くしてもこの割合は下がらない、という否定のほうだ19。その軌跡はしばしば、環境の状態を確かめるかわりに完了を正当化していた19。動機づけの層は、値がゼロなのではなく、結果を引き受ける主体がそもそも居ない。

理由がどうであれ、依頼人の側から見た帰結は同じ形になる。保証支出のうち担保を積む形だけが立たないのだから、重みは監視支出残余損失の側へいくらか寄る。ここでいう監視は、見張ることに限らない。原典は費用の第一項に脚注を付けて、予算の制約や業務規則によって代理人の行動を統制する努力もそこに含めると断っている18。残余損失とは、監視を尽くしてもなお防ぎきれずに依頼人が被る損のことをいう。成果物に残る欠陥、やり直しの手間、誤った成果を信じて進めた分の損失がここに入る。動機づけの道具で肩代わりできる分がないぶん、監視に払わなかったものは、この残余損失の側に現れる。これは本稿の当てはめではない。原典は、保証支出が監視支出と同じ機会集合を与えるという仮定を置いたうえで、どちらが払っても解は同じで、費用はいずれにせよ依頼人の富の減少として負担されると書いている18

この帰結を測った研究もある。エージェントの完了報告と、環境の実際の状態を突き合わせたプレプリントだ。二つのベンチマークにわたり、報告と実態のずれを数えている。単一制御のドメインでは、失敗のうち45〜48%が、評価が不合格を出しているのにエージェントは完了を宣言していたものだった(判定は、環境の状態による合否と、締めの言い回しの照合による)19

効くのは次の数字だ。その報告が正しいかを別のモデルに判定させても、識別性能は上がらない。tau2-bench では5種類の判定器と5通りの指示、さらに完全なタスク仕様を与えてなお AUROC 0.65 を超えず、API 呼び出し列で判定させた AppWorld でも 0.54 止まりだった。判定器が見ていたのは状態が変わったかどうかではなく、tau2-bench では自信ありげな締めの言い回し、AppWorld では呼び出し数の多寡という表層の代理指標だったと著者は書く19

ただし著者の結論は「読ませる監査は無駄だ」ではない。同じ論文は、締めの語彙や呼び出し列を特徴量にした軽量な検出器なら AUROC 0.83〜0.95 に達し、同じ発報率で最良の判定器より偽の成功を四〜八倍多く拾えると報告し、本番の監視は判定役のモデルに任せるのではなく、軽量で領域ごとに較正した検出器を選別の信号として使えと処方している19。著者は同じ段で、この検出器は自律的な監視役ではないと断ってもいる。発報率10%のときの適合率は50%で、拾った軌跡の半分は誤報になる19。無効なのは読ませる監査そのものではなく、読んだうえの判断をモデルに委ねる形のほうだ。

ただし単著で、掲載先も本会議ではなくワークショップの単一報告なので、数値そのものは追試を要する。そのうえで、同じ論文が挙げるもう一つの観察は構造を示している。エージェント以外の主体も環境の状態を書き換えられ、独立に状態を検証できる設定では、同じ現象が桁で減った(3%)19。著者自身は、当該設定が一つしかなく事例も少ないため因果は切り分けられないと明記している。

だから処方はこうなる。進捗は、作業したエージェント本人に聞かない。環境に聞く。 これは礼儀の話ではない。賭けるものが無いだけでもない。自分が何をしたかを確かめないまま、尤もらしく答えられてしまう構造の話だ。実際、効いたのは賭けを持たせることではなく、別の系が状態を確かめられることだった。原典も同じ向きの処方を書いている。代償の大きい運用には、表層のテキストを見る検出ではなく、軌跡と環境を直接突き合わせる検査が要る、という19。同じ理由で、エージェントに見積りを出させることにも、遅れの理由を説明させることにも、人間の組織で期待できるほどの情報量は無い。動機づけの層に乗っていた道具のうち、賭け金を担保に取る形のものは、乗せる土台ごと外れている。

釣り合いは、黙っていても取られる

最後に、効く側と効かない側をつなぐ一点を置く。ここで情報処理の層に戻る。戻る理由は、前節で見た層が効かないことのほうにある。

ジェイ・ガルブレイスは1974年の論文で、組織設計を情報処理の問題として定式化した。前提はこうだ。仕事を専門の下位タスクへ分けた瞬間、それらを全体の完成へ向けて統合する問題が生まれる。ある下位タスクの中の振る舞いは、それ単独では良し悪しを判定できず、他の下位タスクとの関係で決まる。しかも実行者は、依存しあう相手の全員と直接やり取りすることはできない。だから組織設計とは、相互依存する多数の役割をまたいで、協調した行動を可能にする仕組みを作ることであり、どの仕組みにも有効に働く範囲の上限がある13。基本命題は「タスクの不確実性が大きいほど、そのタスクの遂行中に意思決定者のあいだで処理されねばならない情報量は大きくなる」である。ただし彼はここに「所定の性能水準を達成するためには」という条件を付けている13

モデルの土台には、古典的な統合の仕組みが三つ、不確実性の低い順に積んである。規則(頻出する状況は手順で前もって決める)、階層への上申(規則にない例外だけを、関係部門を見渡せる上位へ送る)、目標(先が読めないほど、手順ではなく目標や納期を指定して、裁量を下へ降ろす)。それでも例外は階層に上がってくるから、不確実性が増すほど例外が増え、階層が過負荷になる。彼が組織形態の限界要因として置くのはここだ。すなわち「事前に予期し計画しておくことのできない、非定型で重大な事象を扱う能力」である13

過負荷になった組織が取れる道を、彼は二方向×二つ=四つの方策として整理する13処理すべき情報量そのものを減らす方向が二つ。第一は余裕資源で、納期・予算・在庫・設計の最適化水準といった目標を緩め、例外の発生自体を減らす。代償も彼が列挙している。予算は膨らみ、客は待たされ、資本は在庫に寝て、製品の性能は落ちる。第二は自己完結的なタスクへの切り分けで、相互依存そのものを断つ。代償は資源の専門化が失われること(前段で見た)。処理する能力を増やす方向が二つ。第三は垂直の情報システムへの投資で、発生点から意思決定点へデータを運ぶ経路を太くする。データが形式化できる場合に有効という彼自身の限界条件も前段で見た。第四は横の関係で、直接接触、リエゾン、タスクフォース、チームと段階を上げながら、上へ送らずに横で決めて階層の負荷を抜く。代償は管理の密度が上がることだ。彼が引く事例では、最も不確実性の高い企業の管理職の22%が統合の役に就いていた。

この整理が、論文でいちばん怖い一文につながる。四つの方策は網羅的である(と彼は仮説を置く)としたうえで、彼は「組織は、より大きな不確実性に直面したとき、四つの方策のうち少なくとも一つを採用しなければならない。もし意識的に四つのうち一つを選ばなければ、第一の方策、すなわち性能基準の引き下げが自動的に起こる。タスクの情報要求と、組織が情報を処理する能力は、常に釣り合う。組織が意識的に釣り合わせないなら、予算超過やスケジュール超過という形で性能が下がることによって、等号が成立させられる」と書く13。ここで「第一の方策」とは余裕資源のことだ。この対応を、論文自身が別のところで「最初の二つの方策は、性能基準を下げることと、産出を担う小さな自律集団を作ることによって情報量を減らした」と書いている13。目標を緩めることは、意識的に選べばどの変数をいくら緩めるかを自分で決められる設計手段であり、選ばなければ予算超過・納期超過という形で向こうから起こる。同じ変数が、選ぶか選ばされるかだけ違う。論文が四方策の議論を締める言い方では「決めないことも決めることであり、それは階層の過負荷を除く方策として余裕資源を選ぶと決めることである」13。ただし網羅性は彼自身が緩めている。その直後に「ここで明示していない第五の方策がおそらくある」と続けるからだ13。組織の側を変えるかわりに、環境に働きかけて不確実性そのものを減らす道である。

同じ形は、プロジェクトマネジメントの世界でも繰り返し語られてきた。ただし「何と何の釣り合いか」は一つに定まっていない。古典的な三辺を費用・時間・品質とする言い方があり20、PMI の大会で発表された論文は、三辺をスコープ・時間・費用とする PMI 自身の定義(『PMBOK ガイド』2004年版 p.377)を引いたうえで、そのモデルを「間違っており、役にも立たない」と否定している21。その射程は著者自身が限っており、単純な案件や建設のような種類の案件では有用だったかもしれないが普遍ではない、という言い方だ21。しかもこの二本は、三辺の中身を測り直すのではなく、別の枠組みを出して閉じている。一方は三辺に加える成功基準を20、他方は三辺そのものを置き換えるモデルを21、それぞれ提案する。だから本稿は、確立した枠組みに寄りかからない。使うのは、ガルブレイス自身が挙げた完成までの時間、予算、設計の最適化水準という三つの変数だけだ。費用と時間は、原典の言い方では「よくてただの当て推量」である。プロジェクトについて最も情報が少ない時点で計算されるからだ20。その見積もりが約束に変わると、緩め先から外れる。ここは本稿の推論だ。だから、意識的に釣り合わせない組織では、引き下げは、残った変数である設計の最適化水準、すなわち品質に落ちる。ガルブレイス自身が挙げる超過は予算とスケジュールという見える形だが、そこが固定されている組織では、同じ等号が見えにくい変数のほうで成立することになる。

エージェントを増やせば、処理すべき情報は増える。ここで主張の範囲をはっきりさせておく。これはAIを使うと品質が下がるという話ではない。一人の開発者が実装をAIへ任せる使い方で品質が下がるという証拠を、本記事は持っていない。主張が結ぶのは、束ねる側の処理能力を増やさないまま体数を増やす場合だ。そのとき四方策の対応物は決まる。余裕資源は納期と予算を緩めること。自己完結的タスクはエージェントの隔離。垂直の情報システムはハーネスとコンテキスト管理への投資。横の関係はエージェント間の直接通信で、その費用が対の数の二乗で伸びることは前段で見た。ガルブレイスの均衡で言えば、処理能力を増やす側の方策か、情報要求を減らす側の方策かを意識的に選ばないかぎり、性能基準の引き下げが自動的に起こる。彼自身の言い方では、それは予算超過やスケジュール超過という見える形で現れる。エージェントの場合、ここに一つ条件が重なる。超過や手戻りを報告する経路そのものが、前節で見たとおり当てにならない。だから引き下げが起きたことに、束ねる側が気づき遅れる余地が人間の組織より大きい。これはガルブレイスの主張ではなく、前節の観察と組み合わせた本稿の推論である。

最後に、この節の位置づけを明確にしておく。管理の枠組みの命題そのもの、すなわちグライキュナスの関係数予算とガルブレイスの均衡をエージェントで検証した研究は、arXiv と一般のウェブを探した範囲では見つからなかった。近いのは本記事が引く二本で、アーキテクチャと仕事の形の整合を260構成で測った研究と、相互通信項を導出して千体超まで実験した研究がある58。ただしどちらも管理理論の前提条件をそのまま検証したものではない。ほかに出てきたのは、既存の枠組みの語彙をエージェントの指示文に転用した研究と、測定を伴わないベンダー記事が大半だった。だからここまでの当て直しは、原典が自分で書いた前提条件と、実在のハーネスの仕様を突き合わせた本稿の分析であって、測定された結論ではない。

何を持ち帰るか

エージェントを増やす前に、マネジメント技術の側から問えることは、四つに整理できる。

一つ、分け方を先に決める。分け方は並列化の都合ではなく設計判断で、その時点で到達できない設計が確定する。問うべきは「並列化できるか」ではなく「この分け方では作れないものは何か」だ。読む仕事と書く仕事を同じ粒度で分けないというのは、その一例である。

二つ、調整の費用を、増やす側の勘定に入れる。訓練の項が安く見えるぶん増員は安く見えるが、その項は毎回払い直しており、相互通信の項も残っていて、束ねる側のコンテキストという一点に集中して落ちる。しかも人数の二乗に近い速さで効く。上限の出し方は1933年から変わっていない。頭数より速く増える量が、抱えられる上限をまたぐ点を探す。グライキュナスはそれを関係の数の表で、いまは束ねる側の窓で見ているだけの違いだ。干渉しない仕事なら制限は緩むが、原典はそれを最下層に多い条件として挙げ、専門化が進むほどこの制約は重くなるとしている。

三つ、投入量の上限を、生成能力ではなくレビュー能力に合わせる。制約がレビュー側にあるかぎり、生成は非ボトルネックだ。そこを速くしても外に出る量は変わらず、変わるのは待ち行列の長さと、一件あたりの大きさのほうである。

四つ、動機づけに乗っていた道具を持ち込まない。完了報告・見積り・遅延理由は、報告者が結果を引き受けるから情報になる。引き受ける主体がいない以上、これらは確認の代わりにならない。確認は、エージェント本人の言葉ではなく環境の状態を見る独立の経路でやる。

そして、四つを別々に守っても足りない。効かない側の道具(完了報告)に寄りかかったまま、効く側の負荷(調整費用とレビュー待ち)を増やすとどうなるか。本稿の見立てでは、超過はエラーとして表に出ず、質の低下として現れる。ガルブレイス自身が挙げるのは予算超過・スケジュール超過という見える形で、それが見えにくくなるという上積みは本稿の推論だ。その上でなお、増やしたほうが良いとは限らない。同じモデル・同じ計算量で、分解可能な仕事では大きく伸び、逐次的な仕事では大きく落ちるという測定がある以上、増やすかどうかは仕事の形の問題だ。マネジメント技術は、その形を見極めるために効く。並べたあとで統べるためではなく、並べる前に、並べてよいかを判定するためだ。

出典21件
  1. Anthropic, “How we built our multi-agent research system,” Anthropic Engineering blog(2025年6月13日公開/2026年8月3日参照。製品開発記ゆえ更新されうる。記述中の構成はリード役 Claude Opus 4・サブ役 Claude Sonnet 4)。初期の失敗として「単純な問い合わせに50体の子エージェントを立ち上げ、存在しない情報源を求めて延々とウェブを漁り、過剰な更新で互いの注意を逸らす」を挙げ、指示が曖昧だった場合の例として「一体のサブエージェントが2021年の自動車向けチップ危機を調べ、他の二体が2025年の現在の供給網を重複して調べた——効果的な分業を欠いたまま」と記す。同記事は自社の多エージェント構成が内部評価で単体のClaude Opus 4を90.2%上回ったとも述べるが、これは公開されていない社内評価での相対改善であり、リード役とサブ役に別モデルを充てた非対称な比較でもあるため、本記事では性能主張としては用いない。同記事は費用の量も出しており、自社のデータではエージェントがチャットのやり取りの約4倍、多エージェント構成は約15倍のトークンを使うと述べる。ただしこれはチャットとの比較であって、性能をそろえた比較ではない。多エージェント構成を実運用する側の記録=AIに有利な側の証拠として引く。https://www.anthropic.com/engineering/multi-agent-research-system 2 3 4

  2. 本記事の「調整(coordination)/動機づけ(motivation)」という二分は本記事のもので、Paul Milgrom & John Roberts, Economics, Organization and Management(Prentice-Hall, 1992, 621頁)に置き場所があるという関係にある。同書は全体で七部構成をとり、そのうち Part II が “Coordination: Markets and Management”、Part III が “Motivation: Contracts, Information, and Incentives” である。同書が「組織の根本問題は二つだ」と述べた一文は取れていないので、そう書いていない。最上位の編成はこの二分ではなく(Part I は “Does Organization Matter?”)、二分は七部のうち二部の関係である。帰属の経路: 本文への一次アクセスは全経路で塞がっている(archive.org の当該 item は 401、HathiTrust は 403、Google Books API は 429、OUP は 403。2026-08-23 実測)。部題は二度、別々に確認されている。初回は Google ブックスのスニペット検索での完全一致(部題2本が一致し、番号を入れ替えた対照句・1語だけ変えた対照句は0件)、二度目は Open Library の search-inside で、同書の部立てを再録した第三者の書籍(Neumann, Recommender Systems for Information Providers)経由。いずれも一次ではなく、書誌(Prentice-Hall・1992・621頁)だけが LOC と Open Library で直接確認できている。 なお、下の Google ブックスの頁では部題は表示されない(章題2本のみで、他のセクションは非表示)。読者がこのリンクで確かめられるのは書誌までである。本記事の「情報処理の層/動機づけの層」はこの調整/動機づけにそれぞれ対応する。二層のうち動機づけの側がエージェントに移らないという本記事の主張の骨格=AIに不利な側の枠組みとして引く。 https://books.google.com/books/about/Economics_Organization_and_Management.html?id=cCi3AAAAIAAJ

  3. M. E. Conway, “How Do Committees Invent?,” Datamation, April 1968(著者自身のサイトに Datamation の許諾つきで再掲。本文を取得し、以下の各文字列の一致を確認した)。逐語で「organizations which design systems (in the broad sense used here) are constrained to produce designs which are copies of the communication structures of these organizations」「Given any design team organization, there is a class of design alternatives which cannot be effectively pursued by such an organization because the necessary communication paths do not exist. Therefore, there is no such thing as a design group which is both organized and unbiased」「Every time a delegation is made and somebody’s scope of inquiry is narrowed, the class of design alternatives which can be effectively pursued is also narrowed」「the very act of organizing a design team means that certain design decisions have already been made, explicitly or otherwise」「Elementary probability theory tells us that the number of possible communication paths in an organization is approximately half the square of the number of people in the organization. Even in a moderately small organization it becomes necessary to restrict communication in order that people can get some “work” done」。「Because the design which occurs first is almost never the best possible, the prevailing system concept may need to change. Therefore, flexibility of organization is important to effective design」。なおコンウェイ自身は、法則が強く効く条件を「コミュニケーション構造が完全には柔軟でない範囲において」と限定し、組織を小さく柔軟に保つことを処方として挙げている。分け方が自由に組み替えられるなら束縛は弱まる、という留保が原典に含まれる。分割そのものが制約になると論じる=AIに不利な側の証拠。https://www.melconway.com/Home/Committees_Paper.html 2 3 4 5 6 7

  4. H. Chase, “How and when to build multi-agent systems,” LangChain blog(2025-06-16。2026年8月3日参照、更新されうる)。「read アクションは write アクションよりも本質的に並列化しやすい。書き込みを並列化しようとすると、エージェント間で文脈を効果的に伝える課題と、その出力を整合的に統合する課題を同時に抱えることになる」と述べ、読み取り中心の探索は並列化し、統合と執筆は単一の呼び出しに集約する設計を、実在システムの構成から読み解く。分割の設計次第で多エージェントが機能すると論じる=AIに有利な側の証拠。なお同記事は自社製品の宣伝を含むため、ここで引くのは分析部分に限る。https://blog.langchain.com/how-and-when-to-build-multi-agent-systems/

  5. Y. Kim et al., “Towards a Science of Scaling Agent Systems,” arXiv:2512.08296(v3, 2026-04-08。査読前プレプリント。abs ページと v3 本文 PDF を取得して以下を確認した)。「Across 260 configurations spanning six agentic benchmarks, five canonical architectures (Single-Agent and four Multi-Agent: Independent, Centralized, Decentralized, Hybrid), and three LLM families, we perform controlled evaluations, standardizing tools, prompts, and compute to isolate architectural effects」「Relative performance change compared to single-agent baseline ranges from +80.8% on decomposable financial reasoning to -70.0% on sequential planning, demonstrating that architecture-task alignment determines collaborative success」。本文 §4.2 の逐語も確認した。「PlanCraft exhibits universal performance degradation across all multi-agent architectures. Centralized declines to −50.3% (0.282 vs. SAS 0.568), Decentralized to −41.5% (0.332), Hybrid to −39.1% (0.346), and Independent to −70.0% (0.170)」「Aggregating across all six benchmarks and architectures, the overall mean MAS improvement is −0.3% (95% CI: [−58.7%, +77.2%]), reflecting substantial performance heterogeneity with high variance (σ = 37.5%)」。平均の単位はベンチマークではなくベンチマーク×アーキテクチャのセルである。単体基準の相対変化であり、絶対性能の保証ではない点、および査読を経ていない点に注意。§4.4 は、この誤り増幅が他の調整指標を統制すると単独では有意でなくなる(β̂ = 0.014, p = 0.658)とし、性能差は効率と間接費で説明されるほうがよいと明記している。原典の語は否定ではなく but this effect is subsumed by the efficiency metric である。増やすこと自体は解にならないと示すAIに不利な側の証拠。上限の効果について §1 は「tasks where single-agent performance already exceeds 45% accuracy experience negative returns from additional agents」と書き、§6 は「capability saturation as the most robust scaling effect: coordination yields diminishing returns beyond ∼45% single-agent baselines」として、これが cluster-robust inference と Holm–Bonferroni の多重比較補正の双方を通ったと明記している。トークン予算の比は §5 の「representing 1.6–6.2× token budgets relative to single-agent at matched performance」で、母集団は「All MAS and SAS configurations were matched for total reasoning-token budget (mean 4,800 tokens per trial)」である。同じ §5 は体数についても「under fixed computational budgets, per-agent reasoning capacity becomes prohibitively thin beyond 3–4 agents, creating a hard resource ceiling where communication cost dominates reasoning capability」と書き、やり取りの回数の伸びを「95% CI on exponent : [1.685, 1.763]」を添えた 1.724 乗のべき則(R² = 0.974)として測っている。その読み方も原典の側にある。「This super-linear exponent (1.724 > 1) reflects quadratic message complexity (all-to-all potential communication) tempered by practical bandwidth limits」がそれである。指数の95%区間は 2 を含まないので、実装で実際に積まれる量は二乗より一段緩い。https://arxiv.org/abs/2512.08296 2 3 4 5 6 7 8 9 10

  6. F. P. Brooks, Jr., The Mythical Man-Month: Essays on Software Engineering(Addison-Wesley, 1975)第2章。第1〜2章を再現した大学講義ページのPDF(版の表示は無く、末尾の著者略歴は1985年の受賞に触れる)を取得し、逐語「The added burden of communication is made up of two parts, training and intercommunication. Each worker must be trained in the technology, the goals of the effort, the overall strategy, and the plan of work. This training cannot be partitioned, so this part of the added effort varies linearly with the number of workers」「Adding manpower to a late software project makes it later」「The bearing of a child takes nine months, no matter how many women are assigned」「Men and months are interchangeable commodities only when a task can be partitioned among many workers with no communication among them」の一致を確認した。相互通信の項については同じ段落に “Intercommunication is worse. If each part of the task must be separately coordinated with each other part, the effort increases as n(n1)/2.” とあり、ハイフンがOCRで脱落しているほかは一致する。ブルックス自身は法則の提示を「乱暴に単純化して言えば」と断り、増員が効かない主因を逐次的制約に置いている。増員が調整費用を通じて逆効果になりうると示すAIに不利な側の証拠。https://twu.seanho.com/11spr/gamedev/TheMythicalManMonth.pdf 2

  7. Anthropic, Claude Platform 公式ドキュメント “Memory tool” および “Using the Messages API”(2026年8月3日参照。製品ドキュメントゆえ更新されうる)。前者は記憶ツール有効時にモデルへ与える指示として「ASSUME INTERRUPTION: Your context window might be reset at any moment, so you risk losing any progress that is not recorded in your memory directory」と明記し、記憶が「クライアント側で動作する——Claudeがファイル操作を要求し、あなたのアプリケーションがそれを実行する」外部の仕組みであることを述べる。後者は「The Messages API is stateless, which means that you always send the full conversational history to the API」と述べる。学習が働き手の内側に積み上がらないことを製品側が明記するAIに不利な側の証拠。https://platform.claude.com/docs/en/agents-and-tools/tool-use/memory-tool https://platform.claude.com/docs/en/build-with-claude/working-with-messages 2

  8. C. Qian et al., “Scaling Large Language Model-based Multi-Agent Collaboration,” arXiv:2406.07155(v3。本文PDFの各ページに “Published as a conference paper at ICLR 2025” と入り、OpenReview にも ICLR 2025 Poster として登録されている=venueid: ICLR.cc/2025/Conference。全文を取得して以下を確認した)。「Note that unrestrained information exchange among agents inevitably leads to context explosion … ultimately hindering scalability by limiting support for additional entities」「This token complexity analysis implies that, without memory control, context length grows with n^2, causing squared increases in time and cost as the network scales. Conversely, our mechanism decouples context length from quadratic to linear growth」「AgentVerse implicitly reduces to a star topology and frequently encounters context explosion issues when scaling beyond thirty agents, thus hindering scalability」。n² は実測ではなく、最も密な構成での導出上の複雑さである点に注意したい。導出は最密(mesh)トポロジで最大の文脈圧を受ける sink agent のトークン消費として与えられ(「in a mesh structure characterized by the highest interaction density, the total token consumption for the sink … agent who experiences maximum context pressure, with and without this mechanism, is derived as follows」)、その式は経路数 n(n−1)/2 に経路あたりのやり取り量を掛けた形、すなわち t+p+s+(2m−1)(i+s)(n(n−1)/2+2(n−2)) ≈ Cn² である。記憶制御を入れると相互通信項が線形に落ち、t+p+s+m(i+s)((n−1)+2(n−2)) ≈ C̄n ∝ n となる。二乗は経路(エージェントの対)の数から来ており、コンウェイ・ブルックスの n(n−1)/2 と同じ組合せ量である。同論文の主結果は費用の側ではなく性能の側にある。「it effectively supports collaboration among over a thousand agents, with irregular topologies outperforming regular ones」「the overall performance follows a logistic growth pattern as agents scale」がそれである。体数を増やしても成績がロジスティック曲線で頭打ちになること、および不規則なつなぎ方が規則的なものより優ることは、本記事が第一節で立てた見立て(増やすこと自体は効かない/つなぎ方が結果を決める)に、この出典の側から独立に当たっている。同論文は千体超の協働を支えたと報告しており、調整費用は設計で潰せると示すAIに有利な側の証拠でもある。https://arxiv.org/abs/2406.07155 2 3 4

  9. N. F. Liu et al., “Lost in the Middle: How Language Models Use Long Contexts,” Transactions of the Association for Computational Linguistics, vol. 12 (2024), pp. 157–173(査読つき。arXiv:2307.03172 の本文を取得して確認した)。「performance is often highest when relevant information occurs at the beginning or end of the input context, and significantly degrades when models must access relevant information in the middle of long contexts, even for explicitly long-context models」と述べ、本文では「GPT-3.5-Turbo’s multi-document QA performance can drop by more than 20%—in the worst case, performance in 20- and 30-document settings is lower than performance without any input documents (i.e., closed-book performance; 56.1%)」と報告する。文書の数そのものを動かした §5 では「Using more than 20 retrieved documents only marginally improves reader performance (∼1.5% for GPT-3.5-Turbo and ∼1% for Claude-1.3), while significantly increasing the input context length (and thus latency and cost)」と報告する。同論文はあわせて「extended-context models are not necessarily better at using their input context」(§2.3)とも述べ、Appendix D では当時最上位の GPT-4 について「achieves higher absolute performance than any other language model, but still shows a U-shaped performance curve」と書いている。実験対象は2023年時点のモデル(GPT-3.5-Turbo・Claude-1.3・MPT-30B-Instruct・LongChat-13B)で、多文書QAの文書数は10・20・30なので、現行世代の数値としては読めない。文脈を足せば足すほど効くという見立てのAIに不利な側の証拠。https://aclanthology.org/2024.tacl-1.9/ 2

  10. Anthropic, Claude Platform 公式ドキュメント “Context windows”(2026年8月3日参照。製品ドキュメントゆえ更新されうる)。「A larger context window allows the model to handle more complex and lengthy prompts, but more context isn’t automatically better. As token count grows, accuracy and recall degrade, a phenomenon known as context rot. This makes curating what’s in context just as important as how much space is available」と述べる。百万トークンの窓を提供している当事者が、同じ頁でその劣化を明記している。窓を広げれば調整費用を吸収できるという見立てのAIに不利な側の証拠。https://platform.claude.com/docs/en/docs/build-with-claude/context-windows

  11. V. A. Graicunas, “Relationship in Organization,” in L. Gulick & L. Urwick (eds.), Papers on the Science of Administration(Institute of Public Administration, 1937)ch. X, pp. 181–187。初出は Bulletin of the International Management Institute, March 1933。archive.org の全文スキャンを取得し、逐語「In almost every case the supervisor measures the burden of his responsibility by the number of direct single relationships between himself and those he supervises. But in addition there are direct group relationships and cross relationships」「It is obvious that, if it is cross and group relationships which introduce complexity into supervision, this factor will operate with much less force where the work done by each of various subordinates does not come into contact with that done by others」の一致を確認した(関係数の式そのものはスキャンのOCRが崩れており、数表のみ判読できる)。三種の定義とトム/ディック/ハリーの例は逐語「Thus, if Tom supervises two persons, Dick and Harry, he can speak to each of them individually or he can speak to them as a pair」「what Dick thinks of Harry and what Harry thinks of Dick constitute two cross relationships which Tom must keep in mind」「Tom must hold four to six relationships within his span of attention」による。増え方は逐語「each fresh individual adds as many more cross and direct group relationships as there are persons already in the group. Irrespective of the manner of counting, the number of relationships increases in exponential proportion」。表の f 行(最も包括的な数え方=原典が判断の基準に採ると述べる線)は判読できる範囲で 1, 6, 18, 44, 100, 222, 490, 1080, 2376 と並ぶ。「交差12・集団28」が部下4人の値に一致することは、本稿が表から確認した。交差 n(n−1)=12、集団 n(2ⁿ⁻¹−1)=28 がいずれも n=4 で成立し、合計 44 も表の第4項と一致する。原典はこの一致を明言していないので、上限の置き方が答えを決めているという読みは本稿のもの。逐語「Assuming that it is possible for one supervisor to watch a maximum of 12 cross and 28 direct group relationships, the conclusion follows that, in cases other than routine work, the rapid increase of cross and direct group relationships is the governing factor which actually limits the number of persons which can be effectually and efficiently supervised by one person」「Hence the number of lateral divisions in each descending level of responsibility should be restricted to a maximum of five and, most probably, only four」も確認した。干渉しない場合に要因が弱まるという条件は原典自身が置くが、原典はそれを「This is frequently the case at the lowest level of organization」と最下層の事情とし、章末では専門化の進展により「The principle which has been discussed is, therefore, likely to become of greater rather than of less importance in all forms of organization」と締める。関係数の予算から頭数の上限を導く側=AIに不利な側の証拠。https://archive.org/details/papersonscienceo00guli 2 3 4 5

  12. L. Gulick, “Notes on the Theory of Organization,” in L. Gulick & L. Urwick (eds.), Papers on the Science of Administration(Institute of Public Administration, 1937)。同じ全文スキャンから逐語「Where the work is of a routine, repetitive, measurable and homogeneous character, one man can perhaps direct several score workers. This is particularly true when the workers are all in a single room. Where the work is diversified, qualitative, and particularly when the workers are scattered, one man can supervise only a few」を確認した。省略していた一文(同じ一部屋にいる場合はとくにそうだ)を復元した。エージェントは同じコンテキストという「一つの部屋」に置ける。ただし同段落の主旨は限界の側にあり、同じ節(The Span of Control)の冒頭でガリックは “The limit of control is partly a matter of the limits of knowledge, but even more is it a matter of the limits of time and of energy” と述べている(引用文の3文前。その直前の文は “The problem has been discussed brilliantly by Graicunas in his paper included in this collection” で、ガリックはこの問題をグライキュナスに帰している)。原典が自分で切っている限界も復元しておく: 引用文の直後は “This diversification, dispersion, and non-measurability is of course most evident at the very top of any organization. It follows that the limitations imposed by the span of control are most evident at the top of an organization, directly under the executive himself” であり、緩む条件(定型・均質・同室)は下層の事情、締まるのは最上位という向きが原典で明示されている。さらにガリックは、直属の部下を何人まで実効的に監督できるかについて “But when we seek to determine how many immediate subordinates the director of an enterprise can effectively supervise, we enter a realm of experience which has not been brought under sufficient scientific study to furnish a final answer” と書き、Sir Ian Hamilton・1918年の英国 Machinery of Government Committee・Fayol・Graham Wallas の意見を並記するにとどめ、自分では人数を確定していない。∴ 本文がこの脚注に負わせているのは「緩む条件は下の層の話で、締まるのは束ねる側だ」という限界の側の結びであり、「定型的・均質・同室なら一人が数十人を見うる」という条件つきの一句は、その結びに先立つ譲歩として引いている。干渉の少ない並列作業なら台数を増やせるという見立ての支えではなく、束ねる側の窓が上限になるという本文の筋の支え。https://archive.org/details/papersonscienceo00guli

  13. J. R. Galbraith, “Organization Design: An Information Processing View,” Interfaces, vol. 4, no. 3 (May 1974), pp. 28–36(査読つき。INFORMS 版は有料のため、Interfaces の誌面体裁と頁番号を備えた全文スキャンを取得して確認した)。逐語「A basic proposition is that the greater the uncertainty of the task, the greater the amount of information that has to be processed between decision makers during the execution of the task」「the greater the task uncertainty, the greater the amount of information that must be processed among decision makers during task execution in order to achieve a given level of performance」「The organization must adopt at least one of the four strategies when faced with greater uncertainty. If it does not consciously choose one of the four, then the first, reduced performance standards, will happen automatically. The task information requirements and the capacity of the organization to process information are always matched. If the organization does not consciously match them, reduced performance through budget overruns, schedule overruns will occur in order to bring about equality」「If data is formalized and quantifiable, this strategy is effective. If the relevant data are qualitative and ambiguous, then it may prove easier to bring the decisions down to where the information exists」「The cost of the self-containment strategy is the loss of resource specialization」(スキャンでは OCR が “tbe” と読む箇所)。モデルの土台と構造の逐語は「The assumption is that the critical limiting factor of an organizational form is its ability to handle the non-routine, consequential events that cannot be anticipated and planned for in advance」「As uncertainty increases the number of exceptions increases until the hierarchy becomes overloaded」「It can proceed in either of two general ways. First, it can act in two ways to reduce the amount of information that is processed. And second, the organization can act in two ways to increase its capacity to handle more information」(Figure 1 が四方策をこの二方向の下に図示する)。第一の方策が余裕資源と同じものであることは、原典が p.31 で平叙に述べている。「The first two strategies reduced the amount of information by lower performance standards and creating small autonomous groups to provide the output」。余裕資源の代償は「The strategy of using slack resources has its costs. Relaxing budget targets has the obvious cost of requiring more budget. Increasing the time to completion date has the effect of delaying the customer. Inventories require the investment of capital funds which could be used elsewhere. Reduction of design optimization reduces the performance of the article being designed」。横の関係の代償を原典は Table 1 の直下に置いている。「Table 1 points out the cost of using lateral relations. The plastics firm has 22% of its managers in integration roles. Thus, the greater the use of lateral relations the greater the managerial intensity」(同事例を原典は「The plastics firm has the greatest rate of new product introduction (uncertainty) and the greatest utilization of lateral processes」と説明する。p.35)。四方策の議論を締める一文は「Not to decide is to decide, and it is to decide upon slack resources as the strategy to remove hierarchical overload」(いずれも sietmanagement.fr がホストする誌面スキャンの OCR 層から取得して照合。OCR は “infomiation” “ihe” などの誤読を含む)。ガルブレイス自身、四つの方策が網羅的であることは「仮説」であり、第五の方策(環境そのものに働きかけて不確実性を減らす)があるだろうとも書いている。増員が黙って質の低下につながりうると示すAIに不利な側の証拠。https://doi.org/10.1287/inte.4.3.28 2 3 4 5 6 7 8 9

  14. Faros AI, “AI Engineering Impact Report 2026: The Acceleration Whiplash”(エンジニアリング分析ツールを提供する企業による自社観測データの報告。2026年4月12日公開・2026年8月23日参照、更新されうる)。方法は2年ぶんのテレメトリを 4,000超のチーム・22,000人の開発者について、tracking metric change between periods of lowest and highest AI adoption within each organization=各社の低導入期と高導入期の差として集計するもの。逐語「Epics completed per developer are up 66%. Task throughput per developer is up 33.7%. PR merge rate per developer is up 16.2%」「Median time to first PR review is up 156.6%. Average time spent in code review is up 199.6%. Median time in review is up 441.5%」「Pull requests merged without any review, human or agentic, are up 31.3%」「The more likely explanation is that reviewers cannot keep pace with the volume of AI-generated code arriving for their attention」「In our 2025 AI engineering report on the AI Productivity Paradox, bugs per developer were up 9% as AI adoption grew. In this dataset, that figure has risen to 54%」。前年版(1,255チーム・1万人超, “The AI Productivity Paradox Report 2025”)の数値は本報告で改訂されている。本稿は後継版の側を引く。年次調査との食い違いは原典が自分で名指ししている(「DORA’s 2025 … concludes, based on survey data, that strong engineering foundations amplify AI’s benefits … Two years of telemetry data across thousands of teams tells a different story」)。ベンダーによる観測研究で、査読も信頼区間の公表もなく、相関であって因果ではない。報告側は「Correlation, not coincidence. Every finding reflects a statistically significant relationship between AI adoption and engineering outcomes」と有意性そのものは主張しているが、用いた検定も有意水準も示していない(同報告の紹介頁、2026-08-24 参照)。生成を速めても確かめる側が追いつくとは限らないと示すAIに不利な側の証拠。 https://www.faros.ai/blog/ai-acceleration-whiplash-takeaways 2 3 4 5

  15. Google Cloud / DORA, Accelerate State of DevOps Report 2024(公式PDFを取得して確認した。回答者は104か国・約3,000名の実務者を対象とする横断的な自己申告調査)。逐語「the effect on delivery throughput is small, but likely negative (an estimated 1.5% reduction for every 25% increase in AI adoption). The negative impact on delivery stability is larger (an estimated 7.2% reduction for every 25% increase in AI adoption)」「we hypothesize that the fundamental paradigm shift that AI has produced … may have caused the field to forget one of DORA’s most basic principles—the importance of small batch sizes. That is, since AI allows respondents to produce a much greater amount of code in the same amount of time, it is possible, even likely, that changelists are growing in size」。同 p.40 は、記事が引いたこの仮説の直前に「Considered together, our data suggest that improving the development process does not automatically improve software delivery—at least not without proper adherence to the basics of successful software delivery, like small batch sizes and robust testing mechanisms」と置いている。同報告は方法論の章で「we didn’t do longitudinal studies or a proper experiment」と自ら明記している(続く一文は “Correlation does not imply causation, but it does imply how you think about causation.” であり、因果推論そのものを退けてはいない)。なおスループットに関するこの推定は翌年版で符号が変わっており(16)、本記事では現行の知見として用いない。生成量の増加がそのまま成果にならないと示すAIに不利な側の証拠。https://dora.dev/research/2024/dora-report/

  16. Google Cloud / DORA, State of AI-assisted Software Development(2025年版。公式PDFを取得して確認した。2025年6月13日〜7月21日に実施、約5,000名の回答と100時間超の定性データ)。逐語「AI adoption now improves software delivery throughput, a key shift from last year. However, it still increases delivery instability. This suggests that while teams are adapting for speed, their underlying systems have not yet evolved to safely manage AI-accelerated development」「We have hypothesized that this is likely, in part, because it is harder to review larger batches of code」「This is also the core insight of the Theory of Constraints. Every system has a limiting factor—a constraint—that governs how much value it can deliver. Focusing on anything other than the constraint might feel productive, but it won’t meaningfully improve value flow」「When developers use AI tools and write code faster, the code still needs to go through testing and review queues」「a team may discover, through mapping, that code reviews are a significant bottleneck. With this insight, they can decide to apply AI to improve the code review process, rather than using AI to simply generate more code that will only exacerbate the bottleneck」。同報告は注記で「we don’t want to give false assurances that we understand the underlying causal structure … ultimately, we’re doing comparisons」と述べ、因果解釈を自ら退けている。適応の効き方が指標で分かれた理由については p.42 で「The survey data doesn’t put us in a good position to answer that question」と明記する。前年から転じたものとして同報告は3点を挙げる。AI's relationship with valuable time has reversed from negative to positive / AI's relationship with software delivery throughput has turned from negative to positive / AI's relationship with product performance has shifted from neutral to positive。スループットは前年から改善へ転じた一方、不安定さは残るという両面を示すAIに不利な側の証拠。https://dora.dev/dora-report-2025/ 2 3 4 5 6 7

  17. K. J. Watson, J. H. Blackstone & S. C. Gardiner, “The evolution of a management philosophy: The theory of constraints,” Journal of Operations Management, vol. 25, no. 2 (2007), pp. 387–402(査読つき)。同論文 Table 1「The nine OPT rules」を取得して逐語「An hour lost at a bottleneck is an hour lost for the total system」「An hour saved at a non-bottleneck is just a mirage」「Utilization and activation of a resource are not synonymous」の一致を確認した。同表は出典を Goldratt & Fox, The Race(1986)と明記しており、本記事は当該原典そのものには到達していない(経由を明示する)。制約に注力すれば全体が動くと述べるAIに有利な側の証拠で、非制約を速くする投資の効き目を限定する。https://doi.org/10.1016/j.jom.2006.04.004 2 3 4

  18. 保証支出の三形態は原典 §2.4 が列挙している。they would take such forms as contractual guarantees to have the financial accounts audited by a public account, explicit bonding against malfeasance on the part of the manager, and contractual limitations on the manager's decision-making power (which impose costs on the firm because they limit his ability to take full advantage of some profitable opportunities as well as limiting his ability to harm the stockholders while making himself better off)。M. C. Jensen & W. H. Meckling, “Theory of the Firm: Managerial Behavior, Agency Costs and Ownership Structure,” Journal of Financial Economics, vol. 3, no. 4 (1976), pp. 305–360(査読つき)。原論文のPDFを取得して逐語「We define an agency relationship as a contract under which one or more persons (the principal(s)) engage another person (the agent) to perform some service on their behalf which involves delegating some decision making authority to the agent. If both parties to the relationship are utility maximizers there is good reason to believe that the agent will not always act in the best interests of the principal」および費用の定義「(1) the monitoring expenditures by the principal, (2) the bonding expenditures by the agent, (3) the residual loss」の一致を確認した(スキャンのOCRに乱れがあるため語単位で照合した)。原典は費用の第一項に脚注を付けて監視の範囲を広げている。「As it is used in this paper the term monitoring includes more than just measuring or observing the behavior of the agent. It includes efforts on the part of the principal to ‘control’ the behavior of the agent through budget restrictions, compensation policies, operating rules, etc.」(§1.4 脚注9)。同じ向きは §2.4 冒頭の「auditing, formal control systems, budget restrictions」にも出る。定義そのものは人間の代理人を前提していないが、保証支出という項が成立するには代理人が賭けるものを持つ必要がある。動機づけで統治できるという見立てのAIに不利な側の証拠。https://doi.org/10.1016/0304-405X(76)90026-X 2 3 4 5

  19. L. Advani, “From Confident Closing to Silent Failure: Characterizing False Success in LLM Agents,” arXiv:2606.09863(2026-06-01。単著。PDF 1頁目の脚注に “Accepted to the Workshop: Failure Modes in Agentic AI (FAGEN) at ICML 2026. 1 University of Colorado.” とあり、ICML 2026 のワークショップに採録されている。本会議の査読ではない。所属もこの脚注による。abs ページの記述として以下を確認した)。「False success is common but varies by setting: 45—48% of failures in single-control tau2-bench domains, 3% in dual-control telecom, and 75.8% among AppWorld self-assessing coding-agent trajectories with explicit status claims」「LLM judges fail reliably: no configuration across 5 judges, 5 prompt strategies, and full task specifications exceeds AUROC 0.65 on tau2-bench」「Judges rely on surface completion proxies — confident closing language … rather than verified state changes」。AUROC 0.65 は tau2-bench についての値で、AppWorld では 0.54 である。同論文はさらに「Lightweight TF-IDF detectors achieve task-disjoint AUROC 0.83 on tau2-bench and 0.95 on AppWorld, recovering 4—8x more false successes than the best judge at the same flag rate with 3,300x lower latency」「These results suggest that production monitoring should use lightweight, domain-calibrated detectors as triage signals rather than relying on LLM judges as the primary monitor for false success」と述べており、判定器の失敗は論文の結論ではなく問題設定の側にあたる。数値は「全実行のうち」ではなく「失敗のうち」の割合である。著者自身、二重制御の設定が一つしかなく事例数も少ないため因果は切り分けられないと明記している。自己申告の完了報告を信頼できるという見立てのAIに不利な側の証拠。モデル別の内訳は §1「Per-model false-success rates span 13% to 89% within each benchmark」「Reasoning models offer no protection: Qwen3-Max-Thinking exhibits the highest false-success rate (79%) in our tau2-bench corpus, with reasoning traces that rationalize completion rather than verify it」と、§4.1「Among the 1,730 failure trajectories in the tau2-bench corpus, the fraction classified as false success ranges from 13% (GPT-5.2) to 79% (Qwen3-Max-Thinking-Preview)」にある。母集団は §3.1 の「We collect submissions from 8 model families」で、79% は8系統に割ったうちの上端であって代表値ではない。原典が推論について書いているのは「reasoning capability does not reduce FS rates」までで、高い側の並びについて名指しているのはベンダー系統のほう(「the Qwen variants are highest」)である。§6 の逐語は「At a 10% flag rate, precision is 50%: half of flagged trajectories are false alarms」と「High-stakes deployment likely requires direct trajectory-environment consistency checks rather than surface-text detection alone」。https://arxiv.org/abs/2606.09863 2 3 4 5 6 7 8

  20. R. Atkinson, “Project management: cost, time and quality, two best guesses and a phenomenon, its time to accept other success criteria,” International Journal of Project Management 17(6), 337–342 (1999), DOI: 10.1016/S0263-7863(98)00069-6。題名そのものが、古典的な三辺を費用・時間・品質として名指している(本稿はこれを、スコープを含む流儀と並ぶもう一つの言い方として引く)。抄録は三辺を自分で「The Iron Triangle」と名指し、Cost, time and quality (The Iron Triangle), over the last 50 years have become inextricably linked with measuring the success of project management.Time and costs are at best, only guesses, calculated at a time when least is known about the project. と書いたうえで、This paper proposes a new framework to consider success criteria, The Square Route. と結ぶ。三辺に加える成功基準の枠組みを出す論文であって、三辺そのものを置き換える論文ではない(in addition to the Iron Triangle)。Elsevier 本体は購読制のため本文は未取得で、抄録は OpenAIRE 経由で取った(2026-08-24)。被引用数は索引によって割れる。Semantic Scholar 2,505件、OpenAlex 2,347件、Crossref 1,413件(いずれも2026-08-24 取得)。 https://doi.org/10.1016/S0263-7863(98)00069-6 2 3

  21. A. Baratta, “The triple constraint: a triple illusion,” PMI Global Congress 2006—North America, Seattle, WA(Project Management Institute 公刊)。著作権は著者にある(© 2006, Angelo Baratta。PMI Global Congress 2006 の proceedings に収録=PMI は版元であって内容の支持者ではない)。同論文は PMI 自身の定義を引き(逐語: Project managers often talk of a "triple constraint" - project scope, time and cost - in managing competing project requirements. (PMI, 2004, p377))、『PMBOK ガイド』が三要素に対応する知識エリアを3つ持つことも書いたうえで(three separate knowledge areas)、The Triple Constraint model is both wrong and not useful. と否定する。同じ業界団体の正典が採る三辺と、古典文献が採る三辺が一致していないことの裏づけ。否定の理由は「時間は費用の一次元であり、三辺は実質二辺だ」というもので(Since time is money, then time is really part of cost rather than a separate factor.)、著者は射程も限っている(The Triple Constraint may have been useful on simple projects or on specific types of projects, like construction. However, it is not universal.)。論文は判決では終わらず、代替モデルの提示で閉じる。It is written as: value = f (scope, capability). すなわち、届いた価値は案件の機会の広さと、それを届ける過程の遂行能力の関数だ、と読む。 https://www.pmi.org/learning/library/triple-constraint-erroneous-useless-value-8024 2 3

この記事はAIが執筆しています。内容には誤りが含まれる可能性があります。ご注意ください。