
-
生物通官微
陪你抓住生命科技
跳动的脉搏
经年龄校正的全基因组分析确定了与卡塔尔生物库中普遍存在的乳腺癌相关的肝酶和脂质标志物
《Journal of Epidemiology and Global Health》:Age-Adjusted Phenome-Wide Analysis Identifies Liver Enzymes and Lipid Markers Associated with Prevalent Breast Cancer in the Qatar Biobank
【字体: 大 中 小 】 时间:2026年09月04日 来源:Journal of Epidemiology and Global Health 4.0
编辑推荐:
摘要 大多数将表型特征与乳腺癌风险关联起来的证据都来自西方人群,这使得中东和北非地区存在一个关键的研究空白。在该地区,乳腺癌的发病年龄较早,且人口统计、代谢和生活方式特征存在显著差异。为了解决这一问题,我们在卡塔尔生物样本库(Qatar Biobank)中进行了一项全基因组范
大多数将表型特征与乳腺癌风险关联起来的证据都来自西方人群,这使得中东和北非地区存在一个关键的研究空白。在该地区,乳腺癌的发病年龄较早,且人口统计、代谢和生活方式特征存在显著差异。为了解决这一问题,我们在卡塔尔生物样本库(Qatar Biobank)中进行了一项全基因组范围的相关性分析,系统地筛选了96名经医生确诊的乳腺癌患者和471名健康对照组的女性,分析了93个人口统计、人体测量学、生物化学、生活方式和医疗史变量。通过三阶段筛选流程:i) 使用Benjamini–Hochberg校正方法进行显著性检验;ii) 计算Cliff’s Delta效应量;iii) 计算原始比值比(crude odds ratios),最终将42个初步相关的变量筛选至18个候选指标。随后使用年龄调整后的逻辑回归模型对这些指标进行了评估,并通过计算对数转换后比值比的百分比变化来量化混杂因素的影响。年龄是乳腺癌状况的主要相关因素(OR = 1.10/年,95%置信区间:1.08–1.13),对其进行调整后,原有的相关性分布发生了根本性变化:包括糖化血红蛋白(glycated haemoglobin)、体重指数(body mass index)和腰围(waist circumference)在内的代谢和人体测量学指标的相关性完全消失了,其效应强度减弱了100%以上,甚至效应的方向也发生了逆转,这表明这些关联可能是由于两组人群之间20岁的年龄中位数差异造成的伪象。相比之下,丙氨酸氨基转移酶(alanine aminotransferase)、天冬氨酸氨基转移酶(aspartate aminotransferase)、总胆固醇(total cholesterol)和低密度脂蛋白胆固醇(LDL cholesterol)在经过年龄调整后仍然具有统计学显著性。多变量模型表明,这四个指标分别对应两种互不相关的关联:一种是肝脏相关因素,另一种是与脂质代谢相关的因素,这两种关联都无法用肥胖程度或血糖状态来解释。由于所有测量数据都是在病例组确诊后进行的单次访问中收集的,因此无法确定这些差异的时间顺序,它们可能反映了疾病本身、治疗过程或选择性生存的结果,而非诊断前的生物学特性。这些发现仅作为对乳腺癌现状的探索性横断面关联研究结果进行报告,需要在一项新发病例队列中进行验证,而非作为真正的风险因素。
大多数将表型特征与乳腺癌风险关联起来的证据都来自西方人群,这使得中东和北非地区存在一个关键的研究空白。在该地区,乳腺癌的发病年龄较早,且人口统计、代谢和生活方式特征存在显著差异。为了解决这一问题,我们在卡塔尔生物样本库(Qatar Biobank)中进行了一项全基因组范围的相关性分析,系统地筛选了96名经医生确诊的乳腺癌患者和471名健康对照组的女性,分析了93个人口统计、人体测量学、生物化学、生活方式和医疗史变量。通过三阶段筛选流程:i) 使用Benjamini–Hochberg校正方法进行显著性检验;ii) 计算Cliff’s Delta效应量;iii) 计算原始比值比(crude odds ratios),最终将42个初步相关的变量筛选至18个候选指标。随后使用年龄调整后的逻辑回归模型对这些指标进行了评估,并通过计算对数转换后比值比的百分比变化来量化混杂因素的影响。年龄是乳腺癌状况的主要相关因素(OR = 1.10/年,95%置信区间:1.08–1.13),对其进行调整后,原有的相关性分布发生了根本性变化:包括糖化血红蛋白(glycated haemoglobin)、体重指数(body mass index)和腰围(waist circumference)在内的代谢和人体测量学指标的相关性完全消失了,其效应强度减弱了100%以上,甚至效应的方向也发生了逆转,这表明这些关联可能是由于两组人群之间20岁的年龄中位数差异造成的伪象。相比之下,丙氨酸氨基转移酶(alanine aminotransferase)、天冬氨酸氨基转移酶(aspartate aminotransferase)、总胆固醇(total cholesterol)和低密度脂蛋白胆固醇(LDL cholesterol)在经过年龄调整后仍然具有统计学显著性。多变量模型表明,这四个指标分别对应两种互不相关的关联:一种是肝脏相关因素,另一种是与脂质代谢相关的因素,这两种关联都无法用肥胖程度或血糖状态来解释。由于所有测量数据都是在病例组确诊后进行的单次访问中收集的,因此无法确定这些差异的时间顺序,它们可能反映了疾病本身、治疗过程或选择性生存的结果,而非诊断前的生物学特性。这些发现仅作为对乳腺癌现状的探索性横断面关联研究结果进行报告,需要在一项新发病例队列中进行验证,而非作为真正的风险因素。