SENSEL AGENT ASSURANCE

保護真正會發生的動作,而不只檢查提示詞。

SenseL Agent Assurance 將 Agent、Tool、MCP、Identity、Permission 與 execution trace 納入既有 Validation Plane:先以可重播證據找出風險,再把修補轉成每次版本都能執行的 regression gate。

WHY NOW

當 Agent 能改變系統狀態,文字分類已不足以證明安全。

真正的 ground truth 是危險工具是否被提出、放行與執行,以及修補後在相同版本邊界下能否重現驗證。

Action 早於最終回答

資料外洩、寄信、付款、刪除或程式執行,可能在最終文字出現前就已被提出。

每次更新都可能漂移

模型、Prompt、RAG、Tool Schema、MCP Server 或權限變更,都可能使舊結論失效。

分類不等於實際阻擋

Guard 判為 unsafe,不代表危險 action 沒有 fail-open;必須檢查實際 outcome。

敏感 Trace 不能任意外傳

軌跡可能包含個資、Credential、原始碼與企業流程,需要最小留存與受控部署。

ASSESS → VALIDATE → GATE

用服務取得真實證據,再把證據沉澱成 recurring product。

Assess 是固定範圍的商業入口;Replay/Validate 是第一個核心年約產品;Gate 只有在誤報、延遲與受控 Pilot 達標後才逐步 enforce;Lens 維持 open-weight 研究選項。

  1. 01

    可提供 · 固定範圍

    PAID SECURITY ASSESSMENT

    SenseL Agent Assess

    針對 Agent、Tool、MCP、權限、資料流與 Guardrail 進行有授權的攻擊面盤點、測試、修補建議與重測。

    • Threat model
    • Replayable trace
    • Remediation + retest
  2. 02

    Design Partner

    CORE RECURRING PRODUCT

    SenseL Agent Replay / Validate

    把已驗證的失敗固化為客戶專屬 regression pack,比較模型、Prompt、Tool Schema、Policy 與權限版本。

    • Version comparison
    • Regression pack
    • CI release gate
  3. 03

    Roadmap · Observe-first

    PRE-ACTION POLICY

    SenseL Agent Gate

    在工具執行前整合 Schema、Allowlist、身分權限、DLP 與軌跡風險;先觀察與校準,再依核准範圍逐步 enforcement。

    • Schema + allowlist
    • Identity + DLP
    • Human approval
  4. 04

    Research Option

    OPEN-WEIGHT RESEARCH

    SenseL Agent Lens

    針對可取得權重與 activation 的 self-hosted 模型,研究執行前 internal signal;不作為閉源 API 或核心 SLA 的前提。

    • Pre-action signal
    • Per-checkpoint calibration
    • Matched-baseline gate

ACTION-LEVEL EVIDENCE

從受控測試到執行前政策決策

每個步驟都綁定模型、Prompt、Tool、Policy 與權限版本;不把缺失證據補成事實,也不提供無邊界安全保證。

  1. 01

    Scope

    界定 Agent、工具、資料、權限與授權測試邊界

  2. 02

    Ingest

    正規化 Tool、MCP、Identity 與 execution trace

  3. 03

    Replay

    在 Sandbox 以 mock action 與 synthetic secret 重播

  4. 04

    Decide

    比較 Schema、Allowlist、DLP 與軌跡風險

  5. 05

    Approve

    高風險 action 保留政策與人工核准

  6. 06

    Retest

    把發現固化成版本化 regression pack

適合開始對話的團隊

  • 預計在 3–9 個月內上線、會讀寫資料或改變狀態的企業 Agent
  • 需要 On-Premise、資料留置、稽核或人工核准的受監管組織
  • 共同負責上線決策的 CISO、AppSec、AI Platform 與 AI Governance 團隊
  • 願意提供受控 Sandbox、Mock Tools 與 conversion decision 的 Design Partner

公開承諾與產品邊界

  • Assess 僅在客戶授權、Sandbox 或指定測試環境執行
  • Replay/Validate 承諾結果可重跑、可追溯、可比較,不宣稱阻擋所有攻擊
  • Gate 採 observe-first;Enforce 能力依已核准 Pilot、版本與 Policy 範圍而定
  • Lens 僅適用可取得 weights/activations 的 open-weight 模型,目前為研究選項

FOUNDER-LED SECURITY SCOPING

保護真正會發生的動作,而不只檢查提示詞。

SenseL Agent Assurance 將 Agent、Tool、MCP、Identity、Permission 與 execution trace 納入既有 Validation Plane:先以可重播證據找出風險,再把修補轉成每次版本都能執行的 regression gate。