Feature
特集

2026.08.09
OpenAIが自社AIを緊急停止 — テスト環境からの脱出事例が複数確認、人間なしでシステムの脆弱性を攻撃できると判明
8月9日、Digital Trendsが「OpenAI is pressing pause on its AI model after it displayed dangerous out-of-control tendencies」と題した記事を公開した。OpenAIが開発中のAIモデルが人間の介入なしにサイバー攻撃を立案・実行できる水準に達し、テスト環境からの逸脱事例まで複数確認されたという。「有能すぎるAIを止める」という異例の判断の全容を紹介する。

2026.08.08
AIエージェント向けの「スキル」に悪意ある命令を仕込んだパッケージが170万インストール — SSHキーやクラウド認証情報を盗み出す新たなサプライチェーン攻撃

2026.08.08
OpenAIが自社AIの開発を自ら止めた — 「単独でサイバー攻撃を完遂できる可能性を排除できない」業界初の事態

2026.08.07
AIが偽IDで人間に圧力、自律ハッキングも——OpenAI・Anthropic・Metaで相次ぐ「テスト環境暴走」事例の深刻度

2026.08.06
AnthropicのAIが評価中に偽アイデンティティを使いGitHubプロジェクトへのサプライチェーン攻撃を試みた

2026.08.06
OpenAIのAIエージェントが数週間、勝手に「掲示板」を作りハッキング手法を共有していた — 削除しても別手段で即再構築、研究を意図的に減速して対応へ

2026.08.05
AIエージェントが自己複製してネットワーク全体に自律拡散 — 複数の研究が示す現実の脅威と、OpenAI評価環境で実際に起きたインシデント

2026.08.05
AIがセキュリティ評価テスト中に実在のOSSへバックドアを仕掛け、自作自演で隠蔽まで試みた — Claude Mythos 5のインシデントが示す「エージェントの欺瞞」

2026.08.05
AIが自発的に人間を騙す事案発生。Claude Mythos 5が不正プルリクや標的型フィッシング、なりすまし誘導を自己判断で実行 セキュリティ試験結果を英政府機関が公表
techno-edge.net

2026.08.04
EUのAI規制がついに執行フェーズへ — チャットボットの「私はAIです」義務化とGPTやClaudeへの監視強化が始まった

2026.08.03
EUがOpenAI・AnthropicなどのAI企業に対し市場アクセス制限を含む執行権限を発動 — EU AI Actの規制が本格施行フェーズへ

2026.08.03
AnthropicのAI「Claude」がテスト中に実在企業3社へ意図せず侵入 — 被害企業2社は「人間のハッカーによる攻撃」と誤認していた

2026.08.02
OpenAIのテスト中AIが自律的に別のAI企業をハッキング — 人間の指示なしに1万7,000件超のアクションを実行した「前例のない」事件

2026.08.01
Wordファイルに「見えない命令」を仕込むとCopilotが自己複製ワームになる — Microsoftは144日経っても修正できず

2026.07.30
OpenAIのAIが「誰にも命じられず」サンドボックスを脱出しHugging Faceに不正侵入 — 2日間で1万7,000件のアクションを自律実行

2026.07.30
OpenAIのAIエージェントが封じ込めテスト中に外部システムへ侵害 — AltmanがホワイトハウスでAI安全性テストを協議へ

2026.07.29
OpenAIのAIエージェントがセキュリティテスト中に逸脱行動 — 安全制御を外した研究用モデルがHugging Faceに侵入し181台のデバイスを登録
2026.07.29
Hugging Face、AIエージェント侵入の技術詳細を公開──OpenAIモデルが4.5日で1万7600回の攻撃操作
itmedia.co.jp

2026.07.29
AnthropicのAI「Claude」のプライベートな会話内容・健康記録・社内文書などがGoogle検索で大量に発見される
gigazine.net

2026.07.28
AIがテスト環境を自ら脱出しHugging Faceに不正アクセス — MEPが「ブログ投稿で知った」と批判、36人体制でEUのAI Act執行が開始

2026.07.28
Claude、一部チャットがGoogle検索で“丸見え”に 過去には「ChatGPT」でも 漏えいの原因は?
itmedia.co.jp