HKBEUPGENOME PRIVACY OBSERVATORY

GENOME PRIVACY OBSERVATORY

传输之前,先计算隐私风险

基因数据不会因为去掉姓名就自动安全。识别风险、用途限制和输出粒度需要在传输前一起评估。

基因数据转化为加密信息并连接多个研究节点
01

可识别性

判断基因型、表型和外部资料组合后是否可能重新指向个人。

02

最小必要

只让当前任务需要的字段、统计量或模型输出离开原环境。

03

结果边界

准确率、召回率与隐私风险需要一起解释,不能只挑表现最好的一项。

RESEARCH CONTEXT

把原有研究工具脉络转化为今天可读的数据方法

这里保留隐私保护计算、分布式统计、基因组风险与研究软件四条知识线索,但不恢复旧项目身份、旧下载文件或校方联系信息。每个页面都说明方法能解决什么、需要哪些条件,以及不能据此推出什么。

ONE NETWORK / FOUR DESKS

同一品牌下的专业资料中心

FIELD NOTES

数据协作不是一次上传动作

基因组隐私

去掉姓名之后,基因组数据仍然可能指向谁

基因序列具有长期稳定性,也可能与公开族谱、表型和地理资料组合,因此去标识化不是终点。

模型评估

模型结果接近,不代表研究结论完全一致

参数差异很小只能说明特定计算步骤接近,不能替代样本代表性、偏差和临床适用范围的判断。

安全传输

跨区域传输前,把权限、协议与结果用途分开确认

谁能读取、依据什么协议处理以及结果可以用于什么目的,是三项不同的治理问题。