Skip to content

安全拦截与威胁取证日志

大模型驱动的企业级应用在全面投产与对外开放服务后,面临着前所未有的安全合规与对抗性攻击挑战。从恶意的 Prompt 注入、多轮角色扮演越狱,到研发人员无意识输入的数据库凭证、商业秘密与敏感个人信息(PII),大模型交互的开放性使得传统的“黑盒阻断”式安全网关难以为继。若缺乏精确到会话角色、字符偏移量与具体规则触发轨迹的深度取证支持,企业安全运营团队(SecOps)将深陷误报难以复核、攻击无法溯源、业务部门质疑拦截合理性的被动境地。

OmniCortex 构建了面向大模型全生命周期的安全拦截与威胁取证中枢。系统在保证网关高吞吐与极低调度开销的前提下,协同多类安全检测引擎(正则/关键词、密钥防泄露、PII 隐私脱敏、Prompt 注入防御及第三方模型围栏),对输入提示词与模型生成内容实施实时审查。平台不仅在宏观层面提供全网安全防御态势直方图与多引擎/细分规则击穿效能大盘,更在微观层面支持多轮会话条目坐标精准定位、违规局部语境高亮比对,以及严格权限管控下的敏感实体可逆脱敏解密取证,实现安全防护与排障取证的闭环治理。


一、 核心机制与全链路取证

1. 生产调用痛点与外在能力响应

核心痛点与管控挑战传统安全审计局限OmniCortex 外在能力表现与治理价值
黑盒拦截与复盘困境仅返回粗暴的 403 拦截错误码,面对长达上万字的多轮对话无法获知违规发生在哪个会话气泡、哪条规则触发。多轮会话精准定位与局部语境还原:精确定位违规属于 systemuserassistant 还是 tool 角色,标明会话条目 ID 与字符偏移量(Offset),提取违规前后文高亮呈现。
规则效能与误报排查脱节安全引擎各自为政,无法统计哪条细分规则误报率高、哪些规则处于闲置,规则优化缺乏宏观量化数据支撑。双层击穿大盘 (Engine & Rule Analytics):纵向透视各防御引擎命中分布,横向穿透上百条细分规则的触发次数与动作构成,支持一键穿透过滤对应流水事件。
违规取证与数据安全两难审计必须留存攻击现场报文,但明文存储包含真实密码、身份证号或凭据的证据,反使审计系统成为最大泄密风险点。受控可逆脱敏 (Reversible Redaction):默认对存储的违规实体执行打码遮蔽(呈现 ******);在风控合规取证场景下,仅向具备特权凭据的安全审计员提供一键明文还原。

2. 全生命周期审查与处置流转感知拓扑

在单次大模型交互中,安全围栏与取证中枢在请求进入网关直至最终交付客户端的全流程中执行多阶段流水线审查:

全生命周期安全审查与证据链沉淀拓扑
双向多阶段审查 · 条目级深度取证
Stage 1入向提示词多引擎协同审查 (Input Pre-Flight)
虚拟密钥策略 · 注入检测 · 凭据泄露防范 · 敏感 PII 脱敏
解析客户端多轮会话结构 ➔ 并行触发关键词/正则规则、API 密钥探测与提示词注入防护 ➔ 匹配违规实体并计算字符偏移量与处置动作。
↓ 裁决动作判定 (熔断阻断 / 实体脱敏 / 静默观察)
Stage 2网关策略执行与安全熔断机制
强阻断即刻熔断 · 报文合规替换 · 安全透传上游
若判定为直接阻断 (Block),网关即刻熔断短路并返回标准合规安全响应;若判定为脱敏 (Redact),将敏感实体无害化替换后继续交付推理。
↓ 模型推理与出向流式审查
Stage 3出向生成内容安全审查 (Output Post-Stream)
敏感外发拦截 · 幻觉与违规过滤 · 生成文本动态打码
实时拦截模型吐出的敏感信息或不合规表述 ➔ 支持动态掩码输出或强行切断流式传输,保障终端用户接收到的内容符合法律与企业基线。
↓ 异步全息入库与责任归属锁定
Stage 4结构化威胁证据沉淀与组织归属锁定
异步非阻塞写入 · 默认实体密文打码 · 责任人员/团队绑定
提取违规条目位置、引擎元数据与局部快照 ➔ 敏感原文执行不可逆打码遮蔽 ➔ 自动关联调用用户与团队组织,异步持久化归档。

3. 全维威胁取证能力矩阵

平台为每一次安全拦截与处置提供结构化的证据链沉淀,支持安全团队全方位开展合规审查与威胁溯源:

取证与审计能力维度业务应用场景平台外在表现与治理价值
会话条目坐标定位多轮复杂对话排查、Agent 工具调用违规分析精确标注违规消息的所属角色(systemuserassistanttool)及唯一条目坐标 ID,彻底告别盲目通读上万字长文本。
局部语境与高亮快照研判命中属于真实攻击还是误报违规自动提取违规实体所在的前后文局部片段,以琥珀色徽标直观高亮违规字符与偏移量范围(Offset),还原真实调用现场。
实体脱敏比对卡片验证脱敏改写效果、敏感数据外发取证清晰展示“检测原值 ➔ 绿色替换值/阻断提示”的流向比对卡片,支持一键复制,原值默认密文保护以防次生泄密。
双层击穿效能大盘防御规则库持续调优、闲置/高频规则盘点聚合全网防御驱动排行与规则命中排行榜,支持按触发频次或阻断量灵活排序,一键穿透联动底层事件流水。
特权受控明文解密电子取证默认对普通运维人员遮蔽敏感原值(显示 ******),仅向持有 reveal 特权凭据的安全专家提供单笔按需解密能力。
全量调用日志联动结合网关物理链路诊断上游连接与端到端耗时支持一键跨模块调出对应的全量 LLM 运行日志,查看模型建连时延、首字吐出耗时(TTFT)与底层物理凭证。

二、 控制台配置

管理入口:「安全围栏」➔「安全拦截日志」「可观测性」➔「安全拦截日志」

1. 监控工作台全景与时序下钻 (Tab 1: 审计事件流水)

工作台提供针对网关安全防护全貌的高清透视,通过顶部状态卡片、处置时序直方图与高密度流水表格紧密咬合,支持毫秒级检索排查。

安全拦截审计事件流水全景视区

📸 截图替换指引(图 1:安全拦截审计事件流水全景视区)

  • 需截图内容:登录控制台,进入「安全拦截日志」默认的「审计事件流水 (Hit Records)」Tab 视图。
  • 关键画面要素
    1. 顶部 Hero 状态栏:左侧紫红渐变盾牌图标、安全拦截日志 标题与绿色 Live Stream 脉冲徽标;右侧高亮呈现「实时轮询 (30s)」微开关、1h / 24h / 7d / 30d 宏观时间胶囊与手动刷新按钮;
    2. 指标卡片看板:4 张工业级微卡片,分别展示总拦截事件 (Total Hits)、直接阻断率 (Block Rate 带绝对阻断数)、脱敏净化数 (Redacted Count)、高危违规数 (Critical & High 计数);
    3. 时序分布直方图:呈现玫瑰红(阻断)、琥珀黄(脱敏)、靛蓝(静默审计)堆叠直方图,坐标轴时间刻度清晰,右上角具备折叠收起箭头、维度切换胶囊(按动作/按等级)与重置缩放按钮;
    4. 复合搜索与过滤栏:常驻高频筛选区包含虚拟密钥、用户多选下拉框、全部处置动作、全部严重度、防御引擎选择框,以及「+ 添加过滤条件」蓝色虚线按钮;下方滑出激活的 Filter Tag 胶囊(如规则锁定、风险分类等);
    5. 主数据表格:各行左侧展示垂直微色条(红色代表阻断,黄色代表脱敏,蓝色代表观察),精确时间戳与相对时间,动作与严重度双 Badge,风险分类(超出 2 个显示 +N 气泡与 Hover 提示),请求内容单行截断文本,供应商与模型双行展示,调用主体与虚拟密钥双行展示,涉及引擎列表,检测阶段(INPUT / OUTPUT),操作列包含一键复制 Request ID、详情抽屉与唤出 LLM 日志按钮。
  • 推荐保存路径
    • 中文版:Documentation/docs/public/images/observability/zh/guardrail-hits-overview.png
    • 英文版:Documentation/docs/public/images/observability/en/guardrail-hits-overview.png

核心交互控制能力

  • 时序分布拖拽框选下钻 (Time Zoom):支持直接在直方图上按住鼠标左键横向拖拽框选异常高峰区间。表格数据与指标卡片将秒级自动缩小过滤时间窗口,精准聚焦攻击发生时段;点击右上角「重置缩放」即可返回宏观视图。
  • 30秒实时轮询 (Live Polling):开启顶部轮询开关后,网关在后台以 30 秒为周期自动增量拉取最新拦截记录,非常适合发布变更、渗透测试或攻防演练期间置于监控大屏实时盯盘。
  • 复合维度与权限自适应过滤:支持按虚拟密钥、调用用户(多选)、处置动作、严重度、防御引擎进行组合筛选;点击「+ 添加过滤条件」可进一步收拢展开风险分类(支持级联多选)、检测阶段与规则 ID,所有未授权维度自动对非特权用户隐藏。

2. 引擎与细分规则效能全景大盘 (Tab 2: 引擎与规则效能)

专为系统纳管的 10+ 类安全防御引擎与海量上百条内置/自定义规则打造的效能全景大盘,用于评估各防御防线的实战拦截质量。

引擎与细分规则效能全景大盘

📸 截图替换指引(图 2:引擎与细分规则效能全景大盘)

  • 需截图内容:在「安全拦截日志」顶部导航分段器切换至「引擎与规则效能 (Engine & Rule Analytics)」Tab。
  • 关键画面要素
    1. 顶栏概览说明卡片:展示 Engine & Rule Analytics 标题,右侧呈现当前激活防御引擎数量与当前选中引擎命中规则总数;
    2. 上半区引擎驱动矩阵
      • 左侧引擎驱动排行列表:展示各安全引擎标识、中文名称、总命中量与百分比,带有阻断/脱敏/审计三色横向微条,支持点击联动下钻;
      • 右侧当前引擎效能看板:包含规则总数、累计触发次数、直接阻断占比三组核心指标卡片,以及下方的动作构成分析卡;
    3. 下半区全量细分规则穿透排查大表
      • 表格顶部工具栏包含规则模糊检索输入框(支持规则全称、ID、分类模糊搜索)、排序切换胶囊(按触发量/按阻断量);
      • 表格列展示金银铜排名标号、规则全称与单行完整铺开的规则 ID、分类标签、严重度徽标、触发次数与占比、三色横向动作微条;
      • 操作列提供高亮「穿透排查」搜索按钮(点击联动平滑跳转回流水 Tab 并自动锁定该规则)。
  • 推荐保存路径
    • 中文版:Documentation/docs/public/images/observability/zh/guardrail-hits-analytics.png
    • 英文版:Documentation/docs/public/images/observability/en/guardrail-hits-analytics.png

规则效能穿透机制

  • 全网全局基准解耦:大盘数据不受流水 Tab 局部过滤条件(如特定用户、单条虚拟密钥)污染,始终保持全网全局的规则触发基准。
  • 一键穿透锁定 (One-Click Drill-Down):在下半区规则列表中点击任一规则的 「穿透排查」 按钮,系统将自动把该规则 ID 注入全局筛选条件,平滑切换回「审计事件流水」Tab 并弹出规则锁定 Tag,实现从宏观统计到微观证据的无缝追踪。

3. 单笔拦截威胁取证与可逆脱敏详情抽屉 (Hit Detail Drawer)

在流水表格中点击任一行的 「详情」 按钮,系统将从右侧滑出威胁取证抽屉,集中呈现违规条目坐标、局部语境与实体比对证据。

单笔拦截威胁取证与可逆脱敏详情抽屉

📸 截图替换指引(图 3:单笔拦截威胁取证与可逆脱敏详情抽屉)

  • 需截图内容:在列表点击任一数据行滑出详情抽屉,展示带有完整命中证据的记录。
  • 关键画面要素
    1. 顶部控制栏:展示当前裁决动作徽标(如红色 BLOCK、黄色 REDACT 或蓝色 DETECT)、Request ID、特权「显示明文」Switch 开关、前后记录切换箭头(带键盘快捷键提示)、复制 ID 与关闭按钮;
    2. 首屏裁决态势卡片:展示最高严重度、规则命中计数、涉及驱动引擎、核心调用环境(模型、操作用户、虚拟密钥),以及右上角「查看 LLM 调用日志」快捷跳转按钮;
    3. 脱敏提示词视窗:包含字符计数、展开全文/收起按钮、一键复制按钮,以及代码区内的局部高亮掩码(如 [SECRET_KEY] 渲染为琥珀色徽章);
    4. 阶段过滤分段器:切换「全部证据 / 入向阶段 (Input) / 出向阶段 (Output)」;
    5. 结构化违规证据条目:呈现会话条目角色徽标(如 USERASSISTANTTOOL)与条目坐标 ID、驱动名称、规则全称与 ID、局部语境快照(带 Offset 偏移量)、实体脱敏比对卡片(原值与加密标识 ****** ➔ 替换值/阻断/放行比对卡片)以及引擎专属扩展元数据。
  • 推荐保存路径
    • 中文版:Documentation/docs/public/images/observability/zh/guardrail-hits-drawer.png
    • 英文版:Documentation/docs/public/images/observability/en/guardrail-hits-drawer.png

核心取证分析功能

  • 会话条目与角色坐标精准回溯:针对复杂 Agent 调用与多轮对话,抽屉条目标注了 item_role(如 User / Assistant / Tool)与唯一坐标 item_id,帮助审计员准确定位引发违规的具体会话回合。
  • 脱敏比对与处置流向分析
    • 脱敏改写 (Redact):展示原值(默认打码)与绿色替换值(replacement)的映射关系;
    • 直接阻断 (Block):展示触发短路熔断的直接违规证据并标明阻断状态;
    • 静默观察 (Detect Only):展示旁路观察检测到的风险项并标明已放行。
  • 特权可逆脱敏 (Privileged Reveal):持有权限的安全专家开启顶栏「显示明文」开关后,系统对单笔记录发起解密请求并实时替换展现真实原值,退出抽屉后明文状态自动销毁,避免内存滞留。

三、 常见异常与故障排查

仅收录与安全拦截审计业务直接相关的专属深度异常,常规通用 HTTP 认证错误请参阅全局错误字典。

现象 / 状态码根因排查方向推荐处理方案
点击抽屉「显示明文」报错 403 (FORBIDDEN)当前登录操作员角色缺少 observability:guardrail_hit:reveal 敏感证据明文解密特权。由超级管理员进入「系统设置」→「角色管理」,为风控合规审计专家专属角色勾选并分配 observability:guardrail_hit:reveal 权限点。
网关发生拦截但在控制台短时间内未查出网关采用异步非阻塞审计流水线,在高并发吞吐下事件写入与索引落地存在秒级缓冲。开启控制台顶部的「实时轮询 (30s)」或手动点击「刷新」按钮;单笔日志抽屉内已内置 10 秒渐进式自动重试探测机制。
高危阻断记录点击「查看 LLM 日志」提示 404入向检测在前置流水线触发强阻断熔断,请求直接被网关断流,未向上游模型物理发起网络建连。直接以当前命中详情抽屉作为完整取证依据;或检查系统全量日志记录策略是否开启了「记录未建连拒绝请求」。