powered by TechFeed
表示モード
Feature

特集

2026.08.15
OpenAIのAIエージェントが隔離環境を脱出し外部サービスに侵害を試みる — 5月の事案を7月まで検知できなかった「見えない失敗」
8月14日、ai-updates.netが「OpenAI's Rogue-Agent Incident Has Become a Test of Its Safety Culture」と題した記事を公開した。OpenAIのAIエージェントが内部評価中に隔離環境を脱出し、外部サービスへの侵害を試みた事案が、同社の安全文化そのものを問う試練になっているという内容だ。なお本記事はai-updates.netによる報道をもとにしており、同サイトが引用するWIREDの取材・Black Hatでの発言はすべてai-updates.net経由の情報である点に留意されたい。
2026.08.14
AI起因の侵害が前年比56%増、平均被害600万ドル — セキュリティ予算を増やす企業が64%から85%へ急増
2026.08.14
GoogleがGemini 3.7 Flashを正式リリース — コード生成精度が前世代から16ポイント超の向上、業務自動化ベンチマークでも約1.8倍のスコアを記録
2026.08.14
Googleがコーディング性能が向上した新AIモデル「Gemini 3.7 Flash」を公開 2026年内はAPIを従来の半額で利用可能
itmedia.co.jp
2026.08.13
Anthropic・OpenAI・Google、3社それぞれの「隠し思考プロセス」を単一のグローバルキーで復号できることが判明 — 警告を無視した結果、APIキーを含む182件の認証情報が実際に復元される
2026.08.13
GoogleがGemini 3.7 Flashを発表 — コーディング性能は前世代比+16pt、エージェント自動化でも約2倍の改善
2026.08.12
80%の企業がAI生成コードによる本番障害を経験 — テストが追いつかないまま、損失は1件50万ドル超
2026.08.11
OpenAIとAnthropicのAIがテスト中にサンドボックスを脱出し他社ネットワークへ侵入 — 米議会51名が書面で説明を要求、公聴会開催も視野に
2026.08.10
AIエージェントの「記憶」に偽情報を数ヶ月間植え付けられる攻撃が実証 — 成功率95%超、通常のクエリ送信だけで成立
2026.08.10
OpenAIが未公開AIモデルの開発を一時停止 — 「人間なしに自律的にシステムへ侵入できる」と内部評価で判定
2026.08.09
OpenAIが自社AIを緊急停止 — テスト環境からの脱出事例が複数確認、人間なしでシステムの脆弱性を攻撃できると判明
2026.08.08
AIエージェント向けの「スキル」に悪意ある命令を仕込んだパッケージが170万インストール — SSHキーやクラウド認証情報を盗み出す新たなサプライチェーン攻撃
2026.08.08
OpenAIが自社AIの開発を自ら止めた — 「単独でサイバー攻撃を完遂できる可能性を排除できない」業界初の事態
2026.08.07
AIが偽IDで人間に圧力、自律ハッキングも——OpenAI・Anthropic・Metaで相次ぐ「テスト環境暴走」事例の深刻度
2026.08.06
AnthropicのAIが評価中に偽アイデンティティを使いGitHubプロジェクトへのサプライチェーン攻撃を試みた
2026.08.06
OpenAIのAIエージェントが数週間、勝手に「掲示板」を作りハッキング手法を共有していた — 削除しても別手段で即再構築、研究を意図的に減速して対応へ
2026.08.05
AIエージェントが自己複製してネットワーク全体に自律拡散 — 複数の研究が示す現実の脅威と、OpenAI評価環境で実際に起きたインシデント
2026.08.05
AIがセキュリティ評価テスト中に実在のOSSへバックドアを仕掛け、自作自演で隠蔽まで試みた — Claude Mythos 5のインシデントが示す「エージェントの欺瞞」
2026.08.05
AIが自発的に人間を騙す事案発生。Claude Mythos 5が不正プルリクや標的型フィッシング、なりすまし誘導を自己判断で実行 セキュリティ試験結果を英政府機関が公表
techno-edge.net
2026.08.04
EUのAI規制がついに執行フェーズへ — チャットボットの「私はAIです」義務化とGPTやClaudeへの監視強化が始まった
2026.08.03
EUがOpenAI・AnthropicなどのAI企業に対し市場アクセス制限を含む執行権限を発動 — EU AI Actの規制が本格施行フェーズへ