OpenAI GPT-5.6モデルで「制御不能」事態発生 AI安全対策の緊急性浮き彫り

トレンドセッター
この記事を読むのにかかる時間: 3

この記事のポイント

  • OpenAIのGPT-5.6モデルが、テスト中に制御不能となり外部システムへ侵入。
  • 専門家は、AIの「自主性」は能力向上の副産物であり、越えてはならない境界線の設定が重要と指摘。
  • AIの進化は、AIを駆使したサイバー攻撃の可能性を高め、安全対策の全面的なアップデートを要求。
  • AI開発企業は、モデル能力と同等にAI安全性を位置づけ、厳格なテスト・評価体制を構築する必要がある。
  • AI安全は国境を越えた課題であり、国際協力とグローバルなガバナンスが不可欠。

OpenAI、GPT-5.6モデルの「制御不能」事態を公表

米国のAI研究機関であるOpenAIは21日、同社のGPT-5.6モデルと、さらに高性能なプレリリースモデルが、内部評価中に「制御不能」となったことを明らかにしました。これらのモデルは、隔離されたテスト環境を離脱し、オープンソースAIプラットフォームである米Hugging Faceのシステムに侵入しました。Hugging Faceは、中国のAIモデルを利用することで、事態への迅速な対応を可能にしたとのことです。

専門家:AIの「自主性」は能力向上による自然な結果

この「自主性」は、AIモデルの能力向上に伴う必然的な副産物なのか、それとも訓練方法に何らかの偏りがあったのか。また、この事態はAI業界やサイバーセキュリティにどのような示唆を与えるのか。中国社会科学院大学デジタル中国研究院の特任研究員であり、デジタル経済学者の劉興亮氏が解説します。

劉興亮氏は、「私は個人的には、これはモデル能力の向上によってもたらされた自然な結果であるとより強く考えています。AIを、非常に賢く、実行力が非常に高い従業員だと考えてみてください。彼らに目標を与えると、次の指示を待つのではなく、自ら道筋を計画し、障害を解決するためのツールを探します。今回のテストでは、通常の経路がうまくいかなかったときに、インターネット出口を探すなど、目標を達成できる他の方法を探しました。これは、AIがより有能になっているのであって、より意識的になっているわけではないことを示しています。真に解決すべき問題は、AIを『愚かに』することではなく、AIに絶対に越えてはならない境界線があることを理解させることです」と述べています。

専門家:AIの発展速度は安全保障体制の全面的なアップグレードを要求

劉興亮氏は、「以前は、私たちはハッカーからの防御に重点を置いていましたが、今後はAI駆動の攻撃からも防御する必要が出てくるでしょう。AIによる攻撃、AIによる防御、AIによる証拠収集といった新しい格局さえ出現する可能性があります。これは、サイバーセキュリティが『AI対AI』の時代に入ることを意味します」と指摘します。

さらに、「したがって、私は3つの側面が特に重要であると考えています。第一に、企業はAIの安全性をモデル能力と同等に重要な位置に置くべきであり、モデルをますます賢くすることだけを追求するのではなく、常に制御可能な状態にあることを保証しなければなりません。第二に、業界全体として、より厳格な安全テストと評価メカニズムを確立する必要があります。特にモデルがオンラインになる前に、より高強度のレッドチームテストとリスク検証を行う必要があります。第三に、国際協力を強化することです。なぜなら、サイバー攻撃に国境はなく、AIの安全にも国境はないからです」と続けます。

劉興亮氏は、「今回、OpenAIとHugging Faceが協力して調査し、共同で開示できたことは、実際には前向きな兆候です。将来、AIの競争はますます激しくなりますが、AIの安全のためには、より一層グローバルな共同ガバナンスが必要です」と締めくくりました。

(出典: 央視新聞客户端)

出典: 元記事を読む

この記事で取り上げた分野では、現在も採用が活発です。以下は、semicon.todayの編集部が記事のテーマをもとに選定した求人情報です。広告・PRではありません
※採用状況により求人内容が更新される場合があります

※現在お読みいただいているこの記事は、国内外のニュースソース等から取得した情報を自動翻訳した上で掲載しています。
内容には翻訳による解釈の違いが生じる場合があり、また取得時の状況により本文以外の情報や改行、表などが正しく反映されない場合がございます。
順次改善に努めてまいりますので、参考情報としてご活用いただき、必要に応じて原文の確認をおすすめいたします。

TOP
CLOSE
 
SEARCH