每次调查 15-20 个来源
Security

数据泄露

作者:Seme 研究团队 · 更新于 2026-05-22

定义

数据泄露是受保护或保密数据被未经授权方访问、披露或窃取的事件。常见泄露类型包括黑客攻击、内部威胁、物理盗窃和意外暴露。泄露数据——通常在暗网市场、粘贴站点和 HaveIBeenPwned 等泄露通知服务上发现——可以是有价值的调查信息来源,但其使用会引发重大伦理和法律考虑。在身份调查中,泄露数据可能揭示别名、电子邮件地址、密码模式、账户关联和先前未知的在线身份。泄露数据的伦理使用需要仔细考虑隐私法、数据保护法规以及公开可用的泄露索引与原始泄露数据之间的区别。

工作原理

身份调查中的泄露数据分析遵循严格的道德准则。步骤 1 — 索引检查:查询泄露通知服务(HaveIBeenPwned、DeHashed)以识别哪些泄露包含对象的电子邮件地址。步骤 2 — 泄露评估:评估每次泄露的来源、日期和类型以评估数据可靠性和时效性。步骤 3 — 模式分析:检查电子邮件到账户的映射、用户名模式和密码特征(不访问实际密码)以识别别名使用和账户关联。步骤 4 — 交叉引用:通过实体解析将发现的账户与对象已知的数字足迹关联。步骤 5 — 法律审查:确保所有泄露数据分析符合适用的隐私法和调查法规。

示例

通过泄露数据调查一个人的数字存在揭示:他们的主要电子邮件"john@company.com"出现在 3 次泄露中(LinkedIn 2012、Adobe 2013、Dropbox 2012)。在 LinkedIn 泄露中发现的辅助电子邮件"jdoe_personal@gmail.com"出现在另外 5 次泄露中,揭示了该人公开不承认的平台上的账户。Adobe 泄露中的用户名"jdoe82"与其 GitHub 用户名匹配。这些泄露衍生的连接有助于构建更完整的数字足迹,同时通过仅使用公开可用的泄露索引来尊重道德边界。

应用场景

  • 身份调查的数字足迹扩展
  • 法律发现程序的账户发现
  • 组织暴露的安全评估
  • 通过别名和账户关联进行欺诈调查

相关术语

平台数据

15-20
来源/调查
78%
平均信任分
25+
术语定义
10-30 min
调查时间

相关资源