
-
生物通官微
陪你抓住生命科技
跳动的脉搏
结合多路功能数据以提升变异体分类精度
《Genome Medicine》:Combining multiplexed functional data to improve variant classification
【字体: 大 中 小 】 时间:2026年07月12日 来源:Genome Medicine 10.8
编辑推荐:
摘要背景近年来,ClinVar中报告的意义不确定的变异(VUS)数量不断增加,因此有必要大规模解决这类变异问题。多重变异效应检测(MAVEs)能够在一次实验中测定数百到数千个遗传变异的功能后果,逐渐成为可用于临床变异分类的重要证据来源。对于同一基因,越来越多的MAVEs研究结果被
近年来,ClinVar中报告的意义不确定的变异(VUS)数量不断增加,因此有必要大规模解决这类变异问题。多重变异效应检测(MAVEs)能够在一次实验中测定数百到数千个遗传变异的功能后果,逐渐成为可用于临床变异分类的重要证据来源。对于同一基因,越来越多的MAVEs研究结果被发表出来,这些研究有时会测量变异影响的不同方面。当需要考虑一个基因的多种功能作用时,结合多个MAVEs的数据可以更全面地评估遗传变异的后果,从而影响变异的分类。
我们整理了针对TP53基因的5项MAVEs研究、LDLR基因的2项MAVEs研究以及PTEN基因的2项MAVEs研究的相关数据集。通过统计方法(主成分分析)、无监督学习(k均值聚类)以及监督学习(朴素贝叶斯和随机森林分类器),我们对多个MAVEs数据集进行了整合。在假设的变异分类框架中,我们利用标准指标(灵敏度、特异性等)以及证据强度来评估MAVEs整合方法的实用性。
本文提供了整合此类多重功能数据的指导方法,涵盖从数据整理收集到模型构建与验证的逐步流程。我们还开发了一个网络小程序,用户可通过该程序测试多种整合多个检测项目得分集的方法,为所有变异计算综合功能得分,并判断数据整合是否能为判断变异的致病变性或良性提供更有力的证据。总体而言,与单独使用任何一项MAVEs数据集相比,随机森林等监督学习方法能提升变异分类的准确性。
只要遵循文中所述的步骤并采取适当的管控措施,研究人员就能充分挖掘MAVEs的价值,增强用于临床变异分类的功能性证据,还有可能为具有临床意义的基因发现新的致病变理机制。
近年来,ClinVar中报告的意义不确定的变异(VUS)数量不断增加,因此有必要大规模解决这类变异问题。多重变异效应检测(MAVEs)能够在一次实验中测定数百到数千个遗传变异的功能后果,逐渐成为可用于临床变异分类的重要证据来源。对于同一基因,越来越多的MAVEs研究结果被发表出来,这些研究有时会测量变异影响的不同方面。当需要考虑一个基因的多种功能作用时,结合多个MAVEs的数据可以更全面地评估遗传变异的后果,从而影响变异的分类。
我们整理了针对TP53基因的5项MAVEs研究、LDLR基因的2项MAVEs研究以及PTEN基因的2项MAVEs研究的相关数据集。通过统计方法(主成分分析)、无监督学习(k均值聚类)以及监督学习(朴素贝叶斯和随机森林分类器),我们对多个MAVEs数据集进行了整合。在假设的变异分类框架中,我们利用标准指标(灵敏度、特异性等)以及证据强度来评估MAVEs整合方法的实用性。
本文提供了整合此类多重功能数据的指导方法,涵盖从数据整理收集到模型构建与验证的逐步流程。我们还开发了一个网络小程序,用户可通过该程序测试多种整合多个检测项目得分集的方法,为所有变异计算综合功能得分,并判断数据整合是否能为判断变异的致病变性或良性提供更有力的证据。总体而言,与单独使用任何一项MAVEs数据集相比,随机森林等监督学习方法能提升变异分类的准确性。
只要遵循文中所述的步骤并采取适当的管控措施,研究人员就能充分挖掘MAVEs的价值,增强用于临床变异分类的功能性证据,还有可能为具有临床意义的基因发现新的致病变理机制。