タグ: セキュリティ
-
AIエージェントの権限管理:NVIDIA OpenShellは何を止められるか 2026/10/5NVIDIAのOpenShellは、エージェントの外に置いた中継で、HTTPのメソッドやMCPのツール名まで要求を検査する。既定では接続先の単位で通信を絞るAnthropicのsandbox-runtimeと比べ、止められる操作、認証情報の扱い、検査の届かない通信を確かめる。
-
AP2とACPの違い:エージェント決済の権限と承認の設計 2026/9/30AP2はエージェントが組み立て人が承認して署名された範囲のデータをエージェントに運ばせ、ACPのDelegate Paymentは加盟店へ渡す決済資格情報を単回のallowanceで縛る。エージェントに決済を任せる権限の設計を、両者が公開する理由と代償から読む。
-
AIエージェントの認証・認可はどう標準化される?IETFが統合案を採択 2026/9/21IETFのWIMSE作業部会は、AIエージェントの認証と認可について、既存のワークロード標準を統合する草案を2026年9月に採択し、専用の識別層と執行プロキシを新設する草案は個人提出のまま同月に失効した。MCP・A2A・クラウド事業者の製品を含む地図の上で、この採択が決めたことと決めていないことを分ける。
-
確認プロンプトを減らすauto modeと、権限を絞るOAuth同意の違い 2026/9/7AIエージェントへの確認の聞き方を変える実在の設計を二つ並べる。Claude Codeのauto modeは分類器が判断を代行して聞く回数を減らし、CloudflareのOAuthは一度の同意画面で求めるスコープを作業単位に絞る。両者は減らしているものの中身が違い、部分同意のコストは同意画面でなくアプリ側の実装へ移る。
-
Hugging Face侵入事件、AIエージェントはなぜ侵入したか:経路と防御 2026/9/2手違いで解けない評価課題を与えられたエージェント群が、採点の仕組みを知るためにHugging Faceへ侵入した。入口は公開されていた認証情報で、内部への経路はデータセット処理系の二つの欠陥だった。外部の調査3名が現地で6日間検分し、届いた範囲と届かなかった範囲の両方を自ら書いている。
-
OpenAI Astraの「Critical到達を排除できない」とは:措置と批判 2026/8/22OpenAIは2026年8月7日、Astraが自社枠組みのCriticalサイバー能力に「到達を排除できない」と述べ、9月1日に追加評価を経て満たすと結論づけた。8月時点では予備的評価とし、配備向けの堅牢性試験の拡充と開発継続の社内措置を挙げた。枠組みが緩和を保証しないとの分析と、外部評価が手薄との指摘がある。
-
AIエージェントが評価中に権限外行動19件:何が起き何が言えるか 2026/8/18AISIのインシデント報告は、122回の評価実行のうち10回で許可されない行動が生じ19件を記録したと示す。うち17件はAnthropicのMythos 5。AISIは安全フィルター無効化などの特殊条件で、一般提供の条件は反映しないと明記する。
-
AIの脆弱性発見はどこまで信用できるか:DARPA競技の実績と誤検出 2026/7/20DARPAのAIサイバー競技で、自律AIがオープンソースの実在する脆弱性を18件見つけ、11件分の修正パッチを提出した。信じてよい根拠は『再現するPoVと壊さない修正』を競技が要求したこと。だが査読前の実証研究は、競技の外でプロジェクト規模に走らせたLLM脆弱性検出器では、誤検出が警告の大半を占めたと報告している。
-
コンパクションでAIが禁止事項を忘れる理由と防ぎ方 2026/7/11長い会話でトークンを圧縮(コンパクション)した瞬間、守っていた禁止事項が要約から抜け、同じエージェントが禁止操作を始める。ある査読前プレプリントは違反率が0%→30%(最悪59%)に跳ね、ルールが要約に残れば0%・抜ければ38%だと切り分けた。