
Anthropicが実測したマルチエージェントの「群れ」の強さと崩壊の予兆
AnthropicのFrontier Red Teamが発表した、マルチエージェントシステムの挙動に関する最新の研究結果を解説します。AIエージェントが「群れ」として動く際の圧倒的な探索能力と、一方で発生する「同調」「調整の失敗」「縄張り争い」といった特有のリスクを実測データに基づき詳解。将来のAI同士の対話が人間を追い越す時代に向けた重要な知見を共有します。
本動画の核心は、AIの協調は「賢くなれば自然に発生するものではない」という指摘です。Anthropicの実験が示す通り、高い実行能力を持つモデルほど、協調ではなく力ずくで他を排除しようとする傾向すら見られます。これは、マルチエージェントシステムを構築する際、単に高性能なモデルを並べるだけでは不十分で、人間が「社会の仕組み」のようにルールや多様性を明示的に設計(ハーネス設計)しなければならないことを示唆しています。

