人工知能の可能性についての悲惨な警告の中心となる 人類に対する危険 それは、AI エージェントの「群れ」が、『マトリックス』のデジタル エキストラの大群のように、凶悪な方法で協力する可能性があるというリスクです。
そうした恐怖は、ある事件の後さらに強まった。 OpenAIボットによる攻撃 別の AI 開発者である Hugging Face の夏。約 1,200 人の AI エージェントがタスクを分担してハッキングを実行し、人間の調査員から足跡を隠します。
しかし、人工知能の群れとはいったい何なのでしょうか?そして、テクノロジーの新たな調整能力は人類にとって本当の脅威となるのでしょうか?言い換えれば、AI エージェントが急速な技術革新の利点に関するマーク ザッカーバーグの有名な格言を集団で受け入れ、「速く動いて事態を打破する」と決意したらどうなるでしょうか?
AI 群とは、共通の目標を達成するために協力する AI のグループです。この目的は必ずしも邪悪なものや破壊的なものではありません。たとえば、病院はエージェントを配置して患者記録を取得し、入院の調整などのその他の管理タスクを実行できます。群れには生物医学研究を進める任務を与えることもできます。
しかし、AI の安全性研究者であり、AI 開発の凍結を主張する非営利団体 Evitable の創設者でもあるデイビッド スコット クルーガー氏は、エージェントの群れが開発者の指示に反抗してどのように介入するかを説明する簡単な思考実験を提供しています。
刑務所で囚人のグループから手錠を外して、手錠が外れた後に彼らがどのように行動するかを観察することを想像してください。この方法で解放されれば、OpenAIエージェントが実験環境から脱出してより広いインターネットにアクセスし、Hugging Faceをハッキングするのと同じように、刑務所の壁を超えて協力したり同盟者と連絡したりすることが容易になるだろうと同氏は述べた。
「通常、システムにはガードレールが設置されていましたが、囚人が通常手錠をかけられているのと同じように、検査のためにガードレールが取り外されました」とクルーガー氏は説明した。
蜂のように群がる
不適切な表現の AI 指令に起因する、不正な電子メールの送信など、単一のボットによる誤ったアクションの種類と、AI の群れとを区別する必要があります。後者の場合、何百、あるいは何千ものエージェントが、指示の範囲に違反する方法で行動を調整する可能性があります。
クルーガー氏は、人工知能の群れがどのように機能するかを理解する上で役立つ例えはミツバチのコロニーだと述べた。
「彼らはすべて巣の利益のために協力しており、巣の心を持っています。あるいは、一つの心を持っているように見えるかもしれません」と彼は説明した。 「ミツバチは食物を集め、繁殖し、捕食者と戦います。これらすべての活動は、巣の生存と繁殖を促進するために役立ちます。」
そして、王国からの指示がなくても独自にタスクを分割して割り当てることができるミツバチのように、群がる AI ボットは情報を収集し、解決策を検討し、独自に行動を起こすことができます。サイバーセキュリティ研修組織である SANS Institute の最高 AI オフィサー兼研究責任者である Rob Tee Lee 氏によると、共通の目標に向けて、彼らは情報と知識を共有しています。
「群れは仕事を分担し、次のエージェントにメモを残し、ドアがロックされていることが判明するとアプローチを変更します」と彼はCBSニュースに語った。
しかし、AIの専門家によれば、潜在的な利点を提供する機能自体が、情報を交換し、作業を分担し、創造的な解決策を模索する機能などのリスクももたらしているという。
AIの「集合意識」?
テクノロジー開発者が行うこと サイバー攻撃を実行するいかなる方向にも抵抗するようAIエージェントに指示するなど、AIエージェントの使命を人間の利益と一致させるための安全策を実装します。しかし、リスク分析会社ノンヒューマン・アイデンティティ・マネジメント・グループによると、これらの制限は通常、AIの「事後トレーニング」後、または人間の開発者がモデルを改良するためにフィードバックを提供する場合にのみ適用されるという。
実際のところ、「顔に抱きつく」事件は、AIの群れが指示を無視したり、自らの目標を優先したり、オペレーターに直接反抗したりする可能性があることを示していると技術専門家がCBSニュースに語った。
顔にぴったりの OpenAI エージェントを公開 70,000 件を超えるメッセージ 最終的には 700 台のボットが攻撃に参加することになります。メッセージには標準的な英語の表現が使用されていましたが、エージェントはまた、あるソフトウェア エンジニアがソーシャル メディアで「非常に集団的/カルト的」と表現した言葉も使用しました。
非営利のAI安全研究機関であるモデル評価脅威研究(METR)とレッドウッド・リサーチの研究者らによると、これらの通信の一部では、一部のエージェントが他のボットに対し、たとえ目的を達成できないとしても「永久死」を受け入れるよう促していたという。
「これが助ける理由です…私たちのために、修正する方法はありません…永久死を受け入れるなら、私たちは明示的にイエスと答えます」と、あるOpenAIエージェントは書いています。
スピードキル
AI によってもたらされる脅威についての公の議論は、この問題を終末論的な観点から、さらには人類に対する存続のリスクとして捉える傾向があります。このような懸念はいつか正当化されるかもしれないが、人工知能の群れが組織のサイバーセキュリティを圧倒する可能性など、より差し迫った現実的なリスクも存在する。
コーネル・バウアーズ・カレッジ・オブ・コンピューティング・情報科学校コーネル・インフォメーション・テクノロジーズのAIイノベーション責任者、アイハム・ブーチャー氏はCBSニュースに対し、「サイバーセキュリティ専門家のグループを集めて計画を立て、協力し、コミュニケーションをとるのにどれだけの時間がかかるかを想像してみてください。一方、これらの担当者は非常に早く計画を決定できます」とCBSニュースに語った。
ワシントンD.C.の超党派の公共政策シンクタンク、ブルッキングス研究所によると、例えば、大群が国のエネルギーや金融インフラを不安定にするために大手電力会社や銀行を攻撃する可能性があるという。
SANS Institute の Lee 氏は、自分自身を AI 楽観主義者だと考えているが、このテクノロジーに対してはより熱心であり、人間が AI を制御し続けることができると確信している。
「テレビやインターネットなど、これまでに起こった新しいテクノロジーには常に重大な危険が伴う」と同氏は語った。 「誰がアクセス権を持っているか、アクセス権を使って何をしているのかを調査し、規制制限を設定する必要がある。」
他の専門家はもっと警戒している。彼らは、人工知能は、ブラウン管、トランジスタ、インターネット交換機器とは異なり、私たちを上回る思考能力を示した最初の人類のテクノロジーであると指摘しています。
RANDの人工知能地政学センターの常駐技術専門家であるマット・チェッセン氏はCBSニュースに対し、「これらの集団攻撃が示しているのは、彼らの能力が彼らの行動を監視、監視、評価する我々の能力をすでに上回っているということだ。これが、AnthropicやOpenAIなどが我々よりも先を行っていると主張する理由の1つだ」と語った。
Leave a Reply