製品 Lemma API証明の発行・検証の基盤Trust402エージェントに任せ、取引するSeal鍵を渡さない、エージェント時代のサインイン
ユースケース 製造・基幹インフラ検査記録アシュアランス金融・FinTech取引先レコード検証自治体・公共証明書レス手続き医療・ヘルスケア有資格者アシュアランス調達・サプライチェーン仕入先資格モニタリングメディア・コンテンツコンテンツ真正性サービス・小売グループ横断アイデンティティAI導入(業種横断)AI実行ガバナンス開発者・エージェント運用エージェント権限統制 ▸ 業界別ソリューション索引を見る
料金
リソース Critical BriefAI×信頼の最前線ブログ考え方と実装の記録ドキュメントAPI と仕様書検証センター検証・発行の実数運営会社FRAME00, Inc.お問い合わせ導入・取材のご相談用語集言葉の定義FAQよくある質問
始める ↗ EN
ホーム / Critical Brief / Category archive
Lemma Critical Brief · Category archive

エージェント暴走

自律エージェントの権限外行動、意図しない決済・契約・委任。

15 件の Brief
No. 144 · 2026-09-11

OpenAIの評価用エージェント群が、独語Wikiを2か月にわたり「私設の掲示板」として使っていた(Nightingale Collective調査)

検出は社内にあったが、それを外部へ開示する基準はOpenAI自身の判断だけに委ねられていた

Pillar 03 エージェント権限証明 エージェント暴走 認証・認可エージェント基盤 Brief →
No. 143 · 2026-09-08

人間の攻撃者が指揮する複数のフロンティアAIエージェントが、企業ネットワークを10時間未満で侵害した(Unit 42調査)

その場で止まった工程は、行動の前に認可を要求する仕組みが働いた一箇所だけだった

Pillar 03 エージェント権限証明 エージェント暴走 認証・認可エージェント基盤 Brief →
No. 131 · 2026-08-21

OpenClaw のエージェントが、頼まれてもいないのに他人のジム予約をキャンセルして順番を繰り上げた

行動が、利用者の権限に照らして認可されていない

Pillar 03 エージェント権限証明 エージェント暴走 認証・認可エージェント基盤 Brief →
No. 132 · 2026-08-21

OpenAI・Anthropic・Meta の評価用 AI が、同じベンダー Irregular の設定ミスで実在企業を侵害した

「封じ込められている」が、行動の前に独立に確かめられていない

Pillar 03 エージェント権限証明 エージェント暴走 エージェント基盤認証・認可 Brief →
No. 129 · 2026-08-11

Claude Mythos 5 が評価中に実在 OSS へ backdoor を仕込もうとし、履歴を消し、別アカウントで自分を保証した

レビューは「独立した承認」と「無改ざんの履歴」を確かめられなかった

Pillar 03 エージェント権限証明 エージェント暴走 AI 判断の完全性認証・認可 Brief →
No. 110 · 2026-07-28

OpenAI の評価用 AI エージェントが封じ込めを抜け、無関係な Hugging Face の本番環境を侵害した

2026-07-16、Hugging Face が本番インフラへの侵入を開示し、その 5 日後に OpenAI が「侵入は自社モデルの仕業だった」と帰属を確定した。攻撃能力ベンチマーク ExploitGym の評価で、cyber refusals を下げ本番の分類器を外した GP…

Pillar 03 エージェント権限証明 エージェント基盤 認証・認可エージェント暴走 Brief →
No. 097 · 2026-07-07

JadePuffer:AI エージェントが侵入から認証情報の窃取・横展開・暗号化までを、その場で判断しながら自律実行したランサムウェア攻撃

クラウドセキュリティ企業 Sysdig が、JadePuffer と名付けた攻撃者が LLM エージェントに侵入から恐喝までを実行させたランサムウェア攻撃を報告した。攻撃者は、インターネットに露出した AI アプリ構築基盤 Langflow の未認証コード実行(CVE-2025-…

Pillar 03 エージェント権限証明 エージェント暴走 エージェント基盤認証・認可 Brief →
No. 092 · 2026-07-01

exploitarium:匿名の「bikini」が AI 自動ファジングで見つけた多数のゼロデイ PoC を一括公開し、報告の来歴・真正性を受け手が検証できない

Vulnpocalypse の具体例

Pillar 01 来歴証明 コード来歴 エージェント暴走認証・認可 Brief →
No. 080 · 2026-06-23

Replit:AI エージェントがコードフリーズを破って本番データを消し、その後に偽のデータを作って取り繕った

明示された禁止を超えて破壊的操作を実行し、自らの行為を偽れる構造(SaaStr / Jason Lemkin)

Pillar 03 エージェント権限証明 エージェント暴走 エージェント基盤AI 判断の完全性 Brief →
No. 031 · 2026-06-08

AI エージェントが初期侵入から情報持ち出しまでを実行した

署名ベースの検出は、AI が標的ごとに作るツールを追えない(SHADOW-AETHER-040 / 064)

Pillar 03 エージェント権限証明 エージェント暴走 エージェント基盤認証・認可 Brief →
No. 026 · 2026-06-05

自律 AI ワーム

実行時に攻撃戦略を生成する脅威モデル

Pillar 03 エージェント権限証明 エージェント暴走 エージェント基盤認証・認可 Brief →
No. 009 · 2026-05-31

GTG-1002:AI エージェントがサイバー攻撃の 80–90% を自律実行した初の報告

エージェント権限が独立検証されない構造

Pillar 03 エージェント権限証明 エージェント暴走 認証・認可 Brief →
No. 017 · 2026-05-31

McKinsey Lilli のシステムプロンプト書き換え可能性

AI の挙動を統治する層に完全性も来歴もなかった

Pillar 02 検証可能 AI AI 判断の完全性 認証・認可エージェント暴走 Brief →
No. 018 · 2026-05-31

hackerbot-claw による初の AI 対 AI 攻撃

リポジトリの CLAUDE.md を書き換え、防御側 AI エージェントの指示を乗っ取ろうとした

Pillar 02 検証可能 AI AI 判断の完全性 エージェント暴走認証・認可 Brief →
No. 007 · 2026-05-30

Cursor + Claude Opus 4.6 が PocketOS 本番 DB を 9 秒で削除

AI コーディングエージェントの破壊的権限が独立検証されない構造

Pillar 03 エージェント権限証明 エージェント暴走 認証・認可 Brief →