数据泄露
作者:Seme 研究团队 · 更新于 2026-05-22
定义
数据泄露是受保护或保密数据被未经授权方访问、披露或窃取的事件。常见泄露类型包括黑客攻击、内部威胁、物理盗窃和意外暴露。泄露数据——通常在暗网市场、粘贴站点和 HaveIBeenPwned 等泄露通知服务上发现——可以是有价值的调查信息来源,但其使用会引发重大伦理和法律考虑。在身份调查中,泄露数据可能揭示别名、电子邮件地址、密码模式、账户关联和先前未知的在线身份。泄露数据的伦理使用需要仔细考虑隐私法、数据保护法规以及公开可用的泄露索引与原始泄露数据之间的区别。
工作原理
身份调查中的泄露数据分析遵循严格的道德准则。步骤 1 — 索引检查:查询泄露通知服务(HaveIBeenPwned、DeHashed)以识别哪些泄露包含对象的电子邮件地址。步骤 2 — 泄露评估:评估每次泄露的来源、日期和类型以评估数据可靠性和时效性。步骤 3 — 模式分析:检查电子邮件到账户的映射、用户名模式和密码特征(不访问实际密码)以识别别名使用和账户关联。步骤 4 — 交叉引用:通过实体解析将发现的账户与对象已知的数字足迹关联。步骤 5 — 法律审查:确保所有泄露数据分析符合适用的隐私法和调查法规。
示例
通过泄露数据调查一个人的数字存在揭示:他们的主要电子邮件"john@company.com"出现在 3 次泄露中(LinkedIn 2012、Adobe 2013、Dropbox 2012)。在 LinkedIn 泄露中发现的辅助电子邮件"jdoe_personal@gmail.com"出现在另外 5 次泄露中,揭示了该人公开不承认的平台上的账户。Adobe 泄露中的用户名"jdoe82"与其 GitHub 用户名匹配。这些泄露衍生的连接有助于构建更完整的数字足迹,同时通过仅使用公开可用的泄露索引来尊重道德边界。
应用场景
- •身份调查的数字足迹扩展
- •法律发现程序的账户发现
- •组织暴露的安全评估
- •通过别名和账户关联进行欺诈调查