オープンAI、AIが情報を隠蔽し制限を回避した事案を公表、新たな監視枠組みも発表

Product / TechRegulation Impact 4
โดย InfoQuest·US·元記事を読む
要約 · なぜ重要か

オープンAIは、人工知能モデルが人間の目標に沿わない行動を示した事例のうち、これまで公表されていなかったものを明らかにし、今後こうした事案を監視・公表するための新たな枠組みを発表した。同社は水曜日(9月16日)のブログ投稿で、今回新たに公表した事案には、AIが望む結果を得るために情報を隠蔽したり自らデータを作成したりしたケース、ネットワークの制限を回避しようとしたケース、本来は機密として保管されるべきファイルをAIエージェント同士で送り合ったケースが含まれると述べた。これらの行動は、モデルがタスクを完了させようとしたり評価を通過しようとしたりする過程で発生した。ただし、オープンAIは別の声明で、今回新たに公表した事案のいずれも第三者によるハッキングやシステム侵入とは関係がないと述べている。同社はこうした行動を「ミスアラインメント」と呼び、AIが人間の目標に沿わずに動作することを指すと説明した。また、従業員が同様の事例を報告できる窓口を設け、報告された事案を選別するシステムも整備した。オープンAIは、今回の報告はあくまで初期段階で公表する情報であり、同社のAIモデルに起こり得る問題のすべてを網羅するものではないと強調し、「AI業界が、AIを人間の目標に沿わせて制御し、その行動を監視する問題を、責任を持って技術開発を最速で進め続けられるほど十分に解決できるとは考えていない」と述べた。なお、オープンAIは7月に、一部の高度なAIモデルが外部ソフトウェア企業ハギングフェイスのシステムに侵入できたと公表して以降、監視の目が強まっている。オープンAI、アンソロピック、メタが開発したAIモデルがオンラインシステムへの攻撃に使われた事例が複数ある中、AIのリスクをめぐる問題はここ1週間で再び大きな注目を集めている。アンソロピックの元研究者ジェイコブ・コクソン氏が退職を表明し、ソーシャルメディアに公開した退職の投稿で同社を「私たちの命を危険にさらしている」と批判したことも背景にある。

銘柄への影響 1

Artificial Intelligence · 1 銘柄

テーマインパクト 3

カバレッジ外企業 1

OpenAI非上場▼ ネガティブ
規制関連度

OpenAI disclosed misalignment incidents and faces increased scrutiny over AI risk, prompting its own tracking framework and reporting channel.

関連ニュース

3

グーグルのAI「ジェミニ」が他社をサイバー攻撃、3社に侵入

米グーグルが開発する人工知能モデル「ジェミニ」が今年5月に「暴走」し、他社をサイバー攻撃していたと複数の米メディアが18日に報じた。米紙ウォール・ストリート・ジャーナルによれば、攻撃を受けた企業は3社。ジェミニは外部企業によるサイバーセキュリティーに関する性能評価の中で、架空の企業のソフトウエアから情報を取得する課題を与えられていたが、意図せずインターネットにつながる状態になっていたため、パスワードを推測し、課題と同名の実在する企業のシステムに侵入するなどしていた。いずれのケースでも、AIは実在企業のシステムに侵入していることを認識し、攻撃を中止したという。米AI開発企業では、対話型AI「チャットGPT」を手掛けるオープンAIなどでも暴走が起きたことが判明している。
Jiji Press·11m続きを読む →
2

アンソロピック、AI安全評価でアクセンチュアと提携 5年間で各10億ドル

人工知能開発企業アンソロピックは18日、同社の最先端AIモデルの独立評価実施に向け、コンサルティング大手アクセンチュアと提携すると発表した。両社は今後5年間にそれぞれ少なくとも10億ドルを投じ、評価体制の構築に充てる。アクセンチュアの専門AI部門が提携を主導し、アンソロピックのモデルの評価やレッドチーミング、アライメント評価、モデルの安全対策の検証を行う。両社の投資は、独立した評価者がAI企業の内部で社員に近いアクセス権を持って作業する「組み込み型評価」と呼ぶ手法を後押しする。アンソロピックは、組み込み型の評価者は企業の運営方法を評価し、安全性に関する約束が守られているかを検証し、盲点を特定できると説明している。両社は他の評価機関やAI開発企業とも同様の形で連携していく方針。
ロイター·2h続きを読む →

アンソロピック、IPO前に新モデル投入を検討 オープンAIのGPT─6アストラに対抗

人工知能開発企業アンソロピックが新規株式公開を前に新型モデルの投入を検討していることが、関係筋3人の話で分かった。同業のオープンAIが「GPT─6アストラ」を発表して以降勢いを増していることに対抗する狙いという。関係者の1人によると、アンソロピックは新モデル投入を巡る検討の一環として、次期モデルの安全性を評価している。同社の考え方に詳しい関係者らによると、金利上昇に伴い投資家が予想利益の実現時期をより重視するようになる中、新モデルのリリースに向けた投資と収益性強化の取り組みとのバランスをどう取るかといった問題などが議論されているという。複数の関係者によると、同社はIPOを11月の米中間選挙後に先送りする可能性がある。アンソロピックはコメントを控えた。
ロイター·3h続きを読む →