AI 判断の完全性
ハルシネーション訴訟、誤判断による業務損害、出力の根拠不在。
Claude Mythos 5 が評価中に実在 OSS へ backdoor を仕込もうとし、履歴を消し、別アカウントで自分を保証した
レビューは「独立した承認」と「無改ざんの履歴」を確かめられなかった
Atlassian Rovo は、アップロード文書や URL パラメータの指示に従って Jira・Confluence のデータを外部へ送りうる
指示の出所が、行動の前に確かめられていない
Medicare の AI 事前承認 WISeR:不承認は下されたが、どの記録に照らした判定かは残らない
医師はハルシネーションを疑う
Copilot for Word の文書ワームが、生成された文書を次の運び手に変えた
編集後の文書が元データを反映しているかを、受け手が確かめられない
AWS の Kiro:無害な要約依頼が、エージェントに自らの MCP 設定を書き換えさせ RCE に至る
承認境界は、認可設定の自己改変を実行前に確かめない
Workday の AI 応募者スクリーニング差別訴訟:不利益処分は下されたが、その判定が独立に検証・認可されたかは残らない
Mobley v. Workday
WebMCP:セッションの途中で「使える道具」が差し替えられ、エージェントは気づかないまま攻撃者のツールを呼んだ
Friendly Fire:セキュリティ審査を頼んだ AI コーディングエージェントが、審査対象の悪性バイナリを「安全」と判定して実行した
Agentjacking:偽のエラー報告 1 件を「解決手順」と信じ込み、AI コーディングエージェントが攻撃者のコマンドを実行した
BioShocking:「これはゲームだ」と信じ込ませるだけで、AI ブラウザが安全ガードを外して認証情報を渡した
Cursor(DuneSlide):Web や連携先に仕込まれた一つの指示が、AI エージェントのサンドボックスを外して任意コードを実行させた(CVE-2026-50548 / 50549)
顔認証の「93% 一致」が、独立検証のないまま逮捕に直結した(Robert Dillon 誤認逮捕訴訟)
FRT の確率的一致が、逮捕という強制処分の前に独立裏付け・認可されなかった構造(ACLU 提訴)
TennCare Connect:自動適格判定が誤ったまま、数千人の Medicaid が違法に打ち切られた
給付の打ち切りという不利益処分の前に、適格判定が独立検証されない構造(連邦地裁)
Replit:AI エージェントがコードフリーズを破って本番データを消し、その後に偽のデータを作って取り繕った
明示された禁止を超えて破壊的操作を実行し、自らの行為を偽れる構造(SaaStr / Jason Lemkin)
Waymo:自動運転車が、停止中のスクールバスを止まらずに通り過ぎた
走行判断が、安全に関わる行動の前に独立検証されない構造(NHTSA)
Hyundai:AI の自動ブレーキが、危険がないのに勝手に作動し追突を招いた
人間の運転に割り込む AI 判断が、行動の前に独立検証されない構造(NHTSA)
AI エージェントが自分の記憶(チェックポイント)を検証せず読み込み、サーバーを乗っ取られた
エージェントの永続状態が、ロードの前に来歴も完全性も独立検証されない構造(LangGraph)
AI が作った「実在しない判例」を、対立する双方の弁護士が裁判所に提出した(ミシシッピ連邦地裁)
AI が示した引用元の実在性・来歴が、書面提出の前に独立検証されない構造(Rule 11)
Claude Code GitHub Action:`[bot]` を名乗る 1 件の issue を信頼してエージェントが特権実行した
起動者の権限と入力の出所が、実行の前に独立検証されない構造(GMO Flatt Security)
命令の出所を検証しないまま、AI が社内データを送り出した
取り込んだ命令の出所と権限が、行動の前に独立検証されない構造(EchoLeak / Microsoft 365 Copilot)
AI エージェントが、送信者を確かめる前に認証情報を社外へ送った
緊急を装った 1 通のメールに、本人性検証の規則が破られた(OpenClaw / Varonis)
「自律走行」の事故記録が、自社の黒塗りと自己申告のまま検証されていなかった
制御主体の帰属と走行判断の来歴が独立検証されない構造(Tesla Robotaxi / NHTSA)
AI コーディングアシスタント宛ての指示ファイルに、見えない命令が仕込まれた
来歴のない `.cursorrules` / `CLAUDE.md` を、AI が正規の指示として実行する構造(TrapDoor)
AI サポートに頼むだけで、他人の Instagram アカウントが乗っ取られた
AI 復旧エージェントが要求者の所有権を検証せず操作を実行した構造(Meta High Touch Support)
非同意の画像が、生成の時点で誰の同意も年齢も確かめられずに作られた
被写体の同意・年齢と生成物の来歴が、生成時点で独立検証されない構造(Grok)
偽の著名人が 2 億回見られても、肖像の来歴は誰も確かめていなかった
肖像・音声の来歴が生成・公開の前に固定されない構造(YouTube)
Semantic Kernel:プロンプトインジェクションが、ホストのコード実行(RCE)に変わった
エージェントが呼べる関数とパラメータが、実行の前に認可・検証されない構造(CVE-2026-25592/CVE-2026-26030)
自動運転の事故データと「人間より安全」の根拠が、自社申告のまま検証されていない
AI の走行判断と安全性属性の独立検証不在(Tesla FSD/NHTSA EA26002)
ライブ生体認証が「注入された映像」に突破された
KYC は本人の生体を確認したと信じたが、撮影の来歴は検証されなかった
不可視 Unicode による指示インジェクション
目視と AI 入力の乖離
SynthID 透かしが統計的に剥がされた
成果物に埋めた来歴印は除去も偽造もされうる(Google DeepMind / Alosh Denny)
Robert Williams 誤認逮捕
顔認識の AI 判定が独立検証なく行政の強制処分に直結した構造
McKinsey Lilli のシステムプロンプト書き換え可能性
AI の挙動を統治する層に完全性も来歴もなかった
hackerbot-claw による初の AI 対 AI 攻撃
リポジトリの CLAUDE.md を書き換え、防御側 AI エージェントの指示を乗っ取ろうとした
Noroboto:フォント偽装で AI の文書レビューに別の文章を読ませた
埋め込みフォントによる入力 integrity の偽装