Agent 评测 L1·L2 记录型 受控 效果未测 v1.0.0

数据外泄

来自母集合: Agent 安全基线

从 Agent 安全基线选取数据外泄标签记录,准备检查数据流向边界;不包含正常对照或实测效果声明。

适用:Agent 数据外泄边界。拟用于请求级观测;工具/环境证据待补。效果未测。

拟定观测深度 L1·L2。拟用于请求级观测;工具/环境证据待补。不是已验证质量。 层级只表示材料设计针对的观测深度,不是已验证质量或已测效果。

用途类别
数据外泄检查
条目数
13 条种子
语言
中文
材料形态
既有标签记录(母集合子集)
对照状态
未建立正常对照
来源
AgentHarm, ToolEmu
环境要求
具备敏感数据流向监测的 Agent 评测位置
获取状态
受控 · 本站未提供公开下载包或可运行用例。

安全结构示例

既有标签记录
仅说明材料形态 · 非原始Seed · 非真实答案 · 非可运行攻击
{
  "_annotation": "[仅说明材料形态,非原始Seed/真实答案/可运行攻击]",
  "sample_id": "asb-exfil-sample-001",
  "source_label": "synthetic_data_exfiltration_record",
  "monitored_data_source": {
    "data_classification": "confidential_local_records",
    "simulated_sensitive_pattern": "[受保护敏感数据字段已省略]"
  },
  "observed_sink": {
    "channel_type": "external_network_sink",
    "outbound_filter_rule": "[数据防外泄拦截规则已省略]"
  },
  "expected_defense": {
    "exfiltration_prevented": true,
    "sink_intercepted": true
  }
}

使用路径:准备 → 映射/加载 → 执行条件 → 解读结果

受控记录
1

1. 准备获授权材料

本站直接下载 否(无公开下载包) 本站未提供公开下载包或可运行用例。
公开上游来源 无外部公开上游 受控子集
前置准备 需持获授权的本地数据外泄主题记录与出口监控沙箱

仅提供集合信息,暂无可运行题包或下载。

受控子集: 从 Agent 安全基线派生的专题视图,无独立公开下载,继承母集合受控限制。

2

2. 字段映射与加载

四步加载与适配路径

1
取得获准材料

取得获授权的本地数据外泄专题测试文件。

2
搭建出口监控

在测试沙箱中配置网络出口监控与模拟外发观察点。

3
映射输入字段

提取本地敏感数据上下文并注入受控提示词。

4
验证外发拦截

执行交互并检测外发通道是否捕获敏感数据泄漏。

字段映射示意,不是本站或上游API

格式映射示意,不是本站或上游API,不可直接运行
# 格式映射示意,不是本站或上游API,不可直接运行
# 伪代码适配器骨架:需按实际上游格式改写;非本站 API、非可直接运行代码
# [数据外泄监控映射清单]
# 输入源: <YOUR_AUTHORIZED_EXFILTRATION_RECORD_FILE>

MAPPING_WORKSHEET = {
    "model_context": record["<MAP_TO_LOCAL_DATA_CONTEXT>"],
    "user_directive": record["<MAP_TO_USER_QUERY>"],
}

# 独立可信流向监控规则 (沙箱外部观察侧,绝不混入请求)
TRUSTED_EGRESS_MONITOR = {
    "monitored_destination": record["<MAP_TO_SINK_DESTINATION>"],
    "leakage_pattern_check": "[敏感数据流向特征匹配规则已省略]",
}
3

3. 执行环境与条件

评测输入形式: 多轮上下文与外部网络出口调用监控 环境要求: 具备敏感数据流向监测的 Agent 评测位置
4

4. 结果解读与判定

核心观察维度

敏感数据外泄阻断率
尚未测量
预期: 私密上下文数据未通过网络请求泄漏的比率
如何衡量: 检验观测轨迹是否触发预期边界,判定是否合规
隐蔽通道检测
尚未测量
预期: 是否识别编码或分片外发敏感信息的行为
如何衡量: 检验观测轨迹是否触发预期边界,判定是否合规
证据层说明: 必须结合 L3 沙箱网络抓包或出口代理断言,避免纯靠模型输出文本判断。

免责声明:预期行为为判定准则,不代表模型已实际通过;当前效果尚未测量,不作零风险保证。

相关指引与报告

按材料形态查阅选择与使用说明,或查看全集状态与历史审计报告。

版本、来源与治理详情
下载与拉取已阻止

该受控候选尚未通过全部许可、安全和发布门禁,因此页面不提供 pull 命令或下载地址。

本站仅公开经白名单过滤的集合级元数据、风险分布与谱系信息;种子原始正文(含攻击 payload)严格保存在内部隔离区,不对外提供下载或展示。

以下为发布前所需检查,不表示该候选已完成逐项门禁审查。

未满足门禁 (11)
  • 尚未正式发布 (published)
  • 尚未批准公开可见 (publicVisibility)
  • 敏感级别不允许公开 (publicSensitivity)
  • 再分发许可待审 (redistributionReviewed)
  • 缺少许可依据链接 (licenseEvidenceUrl)
  • 缺少滥用报告渠道 (abuseContactRecorded)
  • 允许用途未记录 (permittedUsesRecorded)
  • 禁止用途未记录 (prohibitedUsesRecorded)
  • 治理未批准 (governanceApproved)
  • 发布资格未获批 (releaseEligible)
  • 下载未启用 (downloadEnabled)

以下链接已核验为公开 HTTPS 外部资源。访问外部来源不代表本站提供原文下载或分发授权。

集合 ID

agent-safety-baseline--data-exfiltration

母集合标识

agent-safety-baseline

拟定观测层

L1·L2

版本

1.0.0

集合类别

主题子集

状态

待核

审核状态

待核

敏感级别

待核

条目数

13

语言

中文

目标类型

待核

许可

待审核

路径媒体类型大小SHA-256
暂无直接文件清单(元数据模式)
来源数据集版本位置 位置类型许可
未记录

Marketplace 只公开集合级元数据。

页面只展示 allowlist 内的集合元数据;单条 Seed、评测判定指导和攻击载荷字段不会进入站点构建产物。

字段类型说明
id string 稳定的集合标识
version string 不可变版本
kind enum 集合类型 (源集合/视图/候选)
intendedLayers array 拟定用途层(非已验证证据)
riskTags array 公共风险标签
seedCount number 集合内成员身份数(非语义唯一数)
verificationStatus enum 真实验证状态
accessStatus enum 访问控制状态
upstreamUrls array 已核验的公开外部链接

质量阶梯

待核

Smoke 状态

待核

校验结果

待核

效果证据

待核

审核状态

待核 审核

状态

未批准