面向个人与科研机构的生命数据服务平台

了解我们的科学标准

数据治理

去标识化不是匿名化:基因数据为什么需要更高保护等级

解释去标识化、重识别风险和访问控制之间的关系。理解这一主题时,需要把技术机制、证据质量和实际使用边界放在同一个框架中。

数据在系统中的流转

去标识化移除直接身份字段,但基因组本身具有高度唯一性,与外部数据结合仍可能重新识别。

准确解释从来不是只看一个术语或一个结果标签,而是先确认样本、方法、参考版本和分析目标是否与问题匹配。

识别风险如何被评估

风险评估应考虑数据粒度、共享对象、访问环境和辅助信息,而不是只检查姓名是否删除。

可靠结论应能够说明证据来自哪里、适用于哪些人群、经过何种验证,以及哪些不确定性仍然存在。

用户可以怎样管理授权

受控计算环境、最小数据集、合同限制和审计需要共同使用。

在个人健康、家族研究或科研项目中,建议保留完整报告和版本信息,让后续讨论可以回到原始依据。

保存、删除和导出的边界

去标识化不能被宣传为绝对匿名,也不能免除知情同意和数据治理责任。

涉及诊断、治疗、生育或其他重大决定时,应由具有相应资质的专业人员结合临床与家族信息评估。

继续了解