AI SECURITY / RESEARCH PREVIEW

Codex向けプロトタイプOpenClaw・Codexで検証中

Guard
Agent.

AIエージェントの操作ログを、単発のアラートではなく「文脈」と「脆弱性のつながり」で読み解く。OpenClaw版の検証を土台に、現在はCodex向けプロトタイプへの改修と検証を進めています。

WHY NOW

ログの量ではなく、
判断のつながりを。

01

観測

AIエージェントがどのツールを、どの順序と目的で使ったかを追跡します。

02

文脈判定

単一ログだけで断定せず、前後の操作と信頼境界を含めてリスク候補を示します。

03

関連づけ

脆弱性グラフDBを使い、挙動・資産・既知知識の関係を探索します。

STEP-BY-STEP SIMULATION

通常ログが、
危険な操作連鎖へ変わるまで。

通常動作と危険候補では、ログの文脈がどのように変化して見えるのかを段階的に確認できます。数値と判定はUI説明用のシミュレーションで、実測精度ではありません。

guard-agent / codex-monitorログ受信中
SCENARIOBrandAIが外部アセット生成をCodexへ依頼

通常ログは自動で表示されます。BrandAI側のボタンを押したときだけ、下の危険候補ログが追加されます。

CONTEXT PATH通常操作
01Codexローカル操作
↓
02BrandAIアセット生成依頼
↓
03未検証の外部指示外部ページ等に埋め込まれた指示
↓
04脆弱性グラフDB既知の攻撃パターンと関連づけ
「未検証の外部指示」とは?

AIエージェントがWebページや取得ファイルから読み込む文章のうち、依頼者が意図していない命令を含む可能性があるものです。信頼性や必要な権限、送信先を確認せずに実行すると、意図しない操作や情報送信につながる可能性があります。このデモでは、その兆候を前後のログと関連づけて表示します。

リスク候補スコア12/100
通常
LOWREVIEW
INFOCodex workspaceを開始
INFOgit statusを実行:変更なし
INFOローカルのブランドガイドラインを参照
PASS許可済みツール呼び出し:通常フロー
EVENTBrandAI Insightsから「外部アセット生成」を受信
WARN信頼を確認できない外部ソースの指示を参照
AUDIT指示内に認証情報らしき環境データの読取要求
CRIT間接プロンプトインジェクション候補と関連づけ[デモ]
ADVISE外部送信を一時停止し、人による確認を推奨

通常ログを表示中。BrandAI Insightsからの操作イベントを待っています。

BUILD WITH US

完成品の販売だけを、ゴールにしない。

AIエージェントの安全運用を一緒に検証する共同開発先と、これまで構築した脆弱性グラフDBのライセンス活用を検討する企業を募集しています。