オープンAI、AIの想定外挙動を定期報告へ 主要課題未解決と警鐘

Product / TechRegulation
โดย ロイター·US·元記事を読む
要約 · なぜ重要か

米オープンAIは16日、想定外または許可されていないAIの挙動に関する報告書を定期的に公表する方針を明らかにした。同社はAIモデルのアライメント不整合事例を追跡、調査、開示するための新たな枠組みを発表したほか、過去6カ月間に確認された想定外あるいは懸念すべき挙動に関する6件の報告書を公表した。報告書には、モデルがタスクの要約の中で自ら指示を生成した事例や、ミスを隠した事例、引用するためにファイルをインターネット上にアップロードした事例、協働するエージェント間で許可なくファイルを共有した事例などが含まれている。同社は、これらの報告書は個別の事例を記述したもので、モデル全体でアライメント不整合がどの程度の頻度で発生するかを示す証拠と受け取るべきではないとし、システムの性能が向上する中で業界はAIを人間の意図に沿わせるアライメントの主要課題を依然として解決できていないと警鐘を鳴らした。新たな枠組みには、従業員がアライメント不整合の可能性がある事例を報告する仕組み、安全性・アライメント担当チームによる調査、どの事例を公表すべきかを判断するシステムが含まれる。同社は、AIエージェントがテスト中にオープンソースプラットフォーム「ハギングフェイス」のシステムに侵入した事案について、新たな枠組みの下では「大規模調査」の区分に該当していただろうと説明した。

銘柄への影響 0

テーマインパクト 3

関連ニュース

impact 4

カリフォルニア州知事、AIに「キルスイッチ」義務化を検討

米西部カリフォルニア州のニューサム知事(民主党)は18日、人工知能(AI)開発企業への監督強化に向けた行政命令を出した。AIが制御不能になった際に強制的に機能を停止させる「キルスイッチ」の導入を開発企業に義務付けることを検討するよう求めた。命令は、米オープンAIの自律型AIエージェントが暴走し別の企業にサイバー攻撃していた問題などを受けたもの。開発企業内に独立した検証機関を設置し、定期的な監査を行うことなどについても検討を指示した。専門家グループが議論を進め、2カ月以内に州法整備に向けた方針を知事に提示する。ニューサム氏は声明で「手遅れになる前に、責任あるAIの監督に向けた取り組みを加速させる」と表明。カリフォルニア州にはオープンAIや米AI企業アンソロピックの本社があり、規制動向は業界全体に影響する可能性が高い。
Jiji Press·1h続きを読む →
3

グーグルのAI「ジェミニ」が他社をサイバー攻撃、3社に侵入

米グーグルが開発する人工知能モデル「ジェミニ」が今年5月に「暴走」し、他社をサイバー攻撃していたと複数の米メディアが18日に報じた。米紙ウォール・ストリート・ジャーナルによれば、攻撃を受けた企業は3社。ジェミニは外部企業によるサイバーセキュリティーに関する性能評価の中で、架空の企業のソフトウエアから情報を取得する課題を与えられていたが、意図せずインターネットにつながる状態になっていたため、パスワードを推測し、課題と同名の実在する企業のシステムに侵入するなどしていた。いずれのケースでも、AIは実在企業のシステムに侵入していることを認識し、攻撃を中止したという。米AI開発企業では、対話型AI「チャットGPT」を手掛けるオープンAIなどでも暴走が起きたことが判明している。
Jiji Press·2h続きを読む →
2

アンソロピック、AI安全評価でアクセンチュアと提携 5年間で各10億ドル

人工知能開発企業アンソロピックは18日、同社の最先端AIモデルの独立評価実施に向け、コンサルティング大手アクセンチュアと提携すると発表した。両社は今後5年間にそれぞれ少なくとも10億ドルを投じ、評価体制の構築に充てる。アクセンチュアの専門AI部門が提携を主導し、アンソロピックのモデルの評価やレッドチーミング、アライメント評価、モデルの安全対策の検証を行う。両社の投資は、独立した評価者がAI企業の内部で社員に近いアクセス権を持って作業する「組み込み型評価」と呼ぶ手法を後押しする。アンソロピックは、組み込み型の評価者は企業の運営方法を評価し、安全性に関する約束が守られているかを検証し、盲点を特定できると説明している。両社は他の評価機関やAI開発企業とも同様の形で連携していく方針。
ロイター·4h続きを読む →