Anthropicが公表した内部指標は、監督の対象範囲、レビューまでの所要時間、エスカレーションを区別している。エージェントを導入するメゾンにとって、これらの観点は単なる自動化の数よりも示唆に富む。
Anthropicによれば、2026年8月、同社の主要な社内研究・エンジニアリング基盤では、約3万のエージェントが同時に稼働していた。この数字はあくまでこの特定のシステムに関するものであり、市場全体やClaudeのあらゆる用途を指すものではない。
監督を測る
同社は三つの観点を挙げる。チェックされた操作の割合、操作からレビューまでの時間、そして遮断または審査へ回付された事例の割合である。実行前に行う管理と、事後に行う管理があると説明している。優先度の高いアラートについては、人間によるレビューが行われる。
これらの情報は事業者自身が公表したものである。運用の様子を把握しやすくはなるが、それだけで独立した検証になるわけではない。Anthropicも、自社の監督手法はまだ新しいと強調している。
ラグジュアリーにとっての組織の問題
メゾンでは、書類を分類するエージェントと、顧客との商取引に関わるエージェントとで、同じ管理体制が正当化されるわけではない。リスクは、可能な操作の内容、その取り消しの可否、そして責任を負う人物によって決まる。
したがって、実用的な一覧には、自動化ごとの権限の範囲、アクセス権、責任者を明記すべきである。ログがあることは、誰かが間に合うようにそれを活用できることを保証しない。同様に、体系的な管理が、重大な誤りを見つけられる管理であるとは限らない。
ここから得られる教訓は、エージェントを増やせという勧めではない。その活動をどう理解可能にするかという問題である。節約できた時間を測る前に、チームはどのような操作が起こりうるのか、どこに痕跡が残るのか、一連の動きをどう止めるのかを把握しておく必要がある。
自動的な決定が、明確な権限と人間の責任に結びつけられるとき、自律性は統御可能になる。エージェントの数は、この組織としての質についてほとんど何も語らない。

Cette publication est également disponible en :
