Pillar 02 検証可能 AI
AI 判断の過程を ZK で commit する層。
支払基金の「1 秒以上の目視」目標を、職員 290 人が自動遷移ツールで満たしていた
記録された達成率は、実態より大きな数値で報告されていた
Hugging Face Diffusers「FaceHugger」:モデルを読み込むだけで任意コードが実行された
安全ガードは最初の1回しか確かめていなかった(Zafran / CVE-2026-44827 他)
Medicare の AI 事前承認 WISeR:不承認は下されたが、どの記録に照らした判定かは残らない
医師はハルシネーションを疑う
Workday の AI 応募者スクリーニング差別訴訟:不利益処分は下されたが、その判定が独立に検証・認可されたかは残らない
Mobley v. Workday
偽の OpenAI モデルが Hugging Face のトレンド1位になった
発行者の来歴が、実行の前に独立検証されない
Agentjacking:偽のエラー報告 1 件を「解決手順」と信じ込み、AI コーディングエージェントが攻撃者のコマンドを実行した
Tenet Threat Labs が、AI コーディングエージェント(Claude Code・Cursor・Codex)を開発者のマシン上で攻撃者のコードを実行させる新しい攻撃「Agentjacking」を公開した。攻撃者は公開されている Sentry の API だけで、エラ…
BioShocking:「これはゲームだ」と信じ込ませるだけで、AI ブラウザが安全ガードを外して認証情報を渡した
セキュリティ企業 LayerX が、エージェント型 AI ブラウザに対する BioShocking と名付けた操作手法を公開した。攻撃用の Web ページが、間違った回答を「正解」として報酬を与える『BioShock』風のパズルを提示すると、ブラウザの操作エージェントは「このペー…
顔認証の「93% 一致」が、独立検証のないまま逮捕に直結した(Robert Dillon 誤認逮捕訴訟)
FRT の確率的一致が、逮捕という強制処分の前に独立裏付け・認可されなかった構造(ACLU 提訴)
TennCare Connect:自動適格判定が誤ったまま、数千人の Medicaid が違法に打ち切られた
給付の打ち切りという不利益処分の前に、適格判定が独立検証されない構造(連邦地裁)
Waymo:自動運転車が、停止中のスクールバスを止まらずに通り過ぎた
走行判断が、安全に関わる行動の前に独立検証されない構造(NHTSA)
Hyundai:AI の自動ブレーキが、危険がないのに勝手に作動し追突を招いた
人間の運転に割り込む AI 判断が、行動の前に独立検証されない構造(NHTSA)
AI が作った「実在しない判例」を、対立する双方の弁護士が裁判所に提出した(ミシシッピ連邦地裁)
AI が示した引用元の実在性・来歴が、書面提出の前に独立検証されない構造(Rule 11)
命令の出所を検証しないまま、AI が社内データを送り出した
取り込んだ命令の出所と権限が、行動の前に独立検証されない構造(EchoLeak / Microsoft 365 Copilot)
AI エージェントが、送信者を確かめる前に認証情報を社外へ送った
緊急を装った 1 通のメールに、本人性検証の規則が破られた(OpenClaw / Varonis)
「自律走行」の事故記録が、自社の黒塗りと自己申告のまま検証されていなかった
制御主体の帰属と走行判断の来歴が独立検証されない構造(Tesla Robotaxi / NHTSA)
自動運転の事故データと「人間より安全」の根拠が、自社申告のまま検証されていない
AI の走行判断と安全性属性の独立検証不在(Tesla FSD/NHTSA EA26002)
不可視 Unicode による指示インジェクション
目視と AI 入力の乖離
Robert Williams 誤認逮捕
顔認識の AI 判定が独立検証なく行政の強制処分に直結した構造
hackerbot-claw による初の AI 対 AI 攻撃
リポジトリの CLAUDE.md を書き換え、防御側 AI エージェントの指示を乗っ取ろうとした
McKinsey Lilli のシステムプロンプト書き換え可能性
AI の挙動を統治する層に完全性も来歴もなかった
Noroboto:フォント偽装で AI の文書レビューに別の文章を読ませた
埋め込みフォントによる入力 integrity の偽装