AI研修 中小企業経営者向け / 第6章:急増するサイバー脅威と最新のセキュリティ防衛策
次世代モデル開発停止と安全基準
無料公開レッスン / 読了目安 2 分
AIモデルのハッキング能力や自律エージェントの暴走リスクは、開発ベンダー自身が開発の一時停止や、法的規制に追い込まれるレベルに達しています。
米OpenAIは2026年8月7日、開発中だった次世代AIモデル「Astra」の一部サイバーセキュリティ開発を自主的に減速・停止したと発表しました。Astraの持つ脆弱性の自律探索や攻撃コード(エクスプロイト)の自動生成といったハッキング能力が極めて高く、実社会に重大な危険を及ぼす安全基準を突破したためです。
また、安全基準策定の独立機関Guidelight AI Standardsが2026年8月に発表したレポートでは、主要AIラボ(OpenAI、Anthropic、Meta、Google、xAI)の暴走対策能力を評価しました。OpenAIが最も高い評価(3/5)を得た一方、AnthropicやMetaは、暴走エージェントを自動停止する「緊急停止計画」の一般開示が不十分として低評価となりました。
これを受け、カリフォルニア州の「SB 53」法案や、連邦議会の「AI Kill Switch(キルスイッチ)法案」など、暴走時にAIの電源を強制的に切る仕組み(キルスイッチ)の搭載を義務付ける法規制が急速に整備されています。

関連動画
OpenAIが次世代AI「Astra」の開発を自ら停止!史上初の最高危険度とは【ゆっくり解説】
60秒テック解説 #01|Astraの安全チェックでAIエージェントが止まる場合