mBio:结肠癌中请正确认识短链脂肪酸功能
导读
结肠中的肠道菌群被认为与结肠癌的产生和发展有密切的联系,有些菌群可以改善结肠处炎症的症状,有些菌群会加重结肠部位的炎症。很多实验都证实短链脂肪酸(SCFAs)具有抗炎症的功效,它们是由结肠处的菌群通过代谢纤维素产生。我们通过16S测序以及宏基因组数据分析了来自于很多人群的肠道菌群,进而分析肠道内短链脂肪酸的含量与结肠癌的发展之间的联系。我们检测了粪便中乙酸、丙酸以及丁酸的含量,最后发现粪便中短链脂肪酸的含量与肿瘤的状态之间无显著性的联系。我们尝试使用随机森林模型对上述的相关性进行了分析,最后也发现二者之间无显著性的关联性。最后我们基于随机森林模型,利用扩增子测序以及宏基因组数据预测了对应样品中短链脂肪酸的含量。但是最后发现这些模型的准确性很低,得到的短链脂肪酸的浓度最大就是实际测量值的14%。之前有研究人员在更广泛的范围内对膳食纤维素与降低结直肠癌的风险之间的关系进行了流行病学的分析,本文结果与该结果是相似的。但是我们无法否认可能是其他的肠道代谢物是结肠癌的标记物,但是以我们目前的数据,我们只能说目前公认的短链脂肪酸是无法对结肠癌的产生与发展进行有效的预测。
论文ID
原文:Fecal Short-chain Fatty Acids Are Not Predictive of Colonic Tumor Status and Cannot Be Predicted Based on Bacterial Community Structure
译名:粪便中短链脂肪酸以及肠道菌群的结构不能够预测结肠癌的状态
期刊:mBio
IF:7.786
发表时间:2019年
通信作者:Patrick D. Schloss
通信作者单位:美国密歇根大学微生物与免疫学院
在美国,结直肠癌导致人群死亡的第三大癌症(1)。少于10%的患者是由于基因遗传导致的(2)。而大部分患者是由于环境因素、自身某些行为因素以及膳食因素导致的(3,4)。一般我们认为结直肠癌的产生始于某些基因突变的细胞的积累,这些细胞积累到一定程度开始快速的繁殖,最终导致肿瘤的产生(2)。在整个肿瘤的产生过程中,肠道微生物可以在很多的阶段发挥作用,因为很多研究表明肠道微生物可以导致引起基因突变、引发炎症以及促进肿瘤的产生(5-7)。人群中的多组学研究以及发现了很多疾病的与菌群相关联的生物标志物(8)。这些研究中均表明在某些情况下,能够产生短链脂肪酸的菌群的确实是引起炎症以及肿瘤的因素。
很多菌群的研究均采用了短链脂肪酸的浓度以及基于16S测序技术鉴定的产短链脂肪酸的菌群或者基因作为健康菌群的生物标记物(9,10)。短链脂肪酸的功效与其浓度有关,研究表明,低浓度的短链脂肪酸可以促进肿瘤的生长,高浓度的短链脂肪酸会抑制肿瘤的生长;此外短链脂肪酸还具有抗炎的作用(11)。有动物实验表明直接喂食短链脂肪酸或者纤维素可以明显的减少肿瘤的大小(12)。这些数据显示添加的纤维素可以被肠道微生物发酵产生短链脂肪酸进而发挥抑制结直肠癌的作用。但是,目前还没有数据显示在人群中增加短链脂肪酸可以有效的减少结肠癌的肿瘤大小。病理对照研究对短链脂肪酸以及结直肠癌肿瘤的状态之间的关系进行了分析,但是结果很难分析,可能与研究的人群的规模小有关。这些实验结果显示结肠癌患者粪便中乙酸含量升高,丁酸含量降低(13)。另外一项随机对照实验显示添加纤维素也未能明显的改善肿瘤的生长以及患者的恢复(14,15)。总之,这些数据显示使用短链脂肪酸作为生物标志物并不能准确的对肿瘤的发生以及针对肿瘤的防止产生积极额作用。
粪便中短链脂肪酸的含量并未随着肿瘤治疗的程度发生变化。

为了进一步的分析结直肠癌以及短链脂肪酸之间是否存在显著性的关系,我们对健康人群(n=172)、罹患结肠腺瘤(n=198)以及结肠癌(n=120)的粪便中乙酸、丙酸以及丁酸的含量进行了定量分析(16)。但是通过统计学分析我们未能找到上述组别之间的差异(p>0.15.Fig.1A)。在所有罹患结肠腺瘤或者结肠癌的患者中,有41位的结肠腺瘤患者以及26位结肠癌患者是1年治疗一次,因此相应粪便也1年收集一次(17)。在所选择的患者中未出现癌症复发的迹象,并且对应粪便中短链脂肪酸的含量并未产生很大的改变(p>0.058;Fig.1B)。此外,我们还使用了很多其他的统计学手段,也并未发现这些数据之间有显著性的差异。尽管对应的p值十分接近0.05,但是这种效果之间的差异非常的小,并且当考虑疾病级数时,这种效果无法得到统一(Fig.1)。以上的数据显示粪便中短链脂肪酸的含量与癌症的治疗效果之间没有显著性的差异。
利用随机森林模型,借助短链脂肪酸的含量以及菌群的数据无法提高对罹患结肠腺瘤以及结肠癌的诊断正确率
之前我们认为,利用随机森林的机器学习模型,结合基于OUT的数据对相应的16S测序数据进行的分析可以使得我们区分罹患结肠腺瘤以及结肠癌的患者(8,16)。本文我们将短链脂肪酸的含量也加入到该模型中一次修正上述的预测模型(补充材料Fig.S1)。当我们将短链脂肪酸加入模型预测中时,我们发现相应的ROC曲线存在中位区域,并且数值显著性的大于0.5。但是当使用ROC曲线的数值去预测是否存在结肠腺瘤或者结肠癌症状时,相应的数值分别只有0.54以及0.55,这些数据显示短链脂肪酸的含量无法准确的预测上述的疾病(Fig.2A)。并且数据还显示,是否加入短链脂肪酸的数值不影响上述模型的预测特性。以上的数据显示人群粪便中短链脂肪酸的含量无法提高诊断结肠病变的准确性。
随机森林模型无法准确的使用菌群数据预测短链脂肪酸的含量

接着我们会问,如果不考虑患者中疾病的诊断问题,肠道菌群的数据是否可以预测粪便中短链脂肪酸的含量。我们使用随机森林中的回归模型使用OUT数值以及属水平的数值去预测粪便中短链脂肪酸的含量(Fig.S2)。结果显示,在所有的预测结果中,基于属水平的数值预测丁酸的含量的预测结果与实际结果之间的相关性最大,但是R2值也只有0.14(Fig.2B)。我们还使用了少量的来自于上述人群粪便的宏基因组学数据对模型进行了修正(18)。于16S rRNA测序数据类似的时,宏基因组的数据也无法对短链脂肪酸的浓度进行准确的预测。当使用KEGG数据对丙酸浓度进行预测时的准确性最高,但是相关系数只有0.055(Fig.2B)。由于宏基因组数据量太少,我们使用16S rRNA测序数据去代替宏基因组数据,并将其导入PICRUSt中进行代谢通路的富集分析(Fig.S2)。但是此时也不能对短链脂肪酸的浓度进行准确的预测;同样,利用KEGG数据对丙酸含量的预测最为准确,但是相关系数也仅仅有0.085(Fig.2B)。以上数据表明,目前我们的手段无法通过肠道菌群的数据对短链脂肪酸的浓度进行有效的分析,这些问题也提示我们目前我们掌握的菌群的种类以及相应的基因还不足以预测粪便中短链脂肪酸的浓度。
结论
我么目前的数据无法将粪便中短链脂肪酸的含量于是否有罹患结肠腺瘤或者结肠癌的风险相关联,而且目前短链脂肪酸的含量还不能作为对结肠癌患者诊断的指标。此外,肠道菌群的种属以及基因结构还不能作为预测短链脂肪酸的含量。本文结果对其他文献的结果是个很好的补充,其他文章中谈到,摄食纤维素一次产生的短链脂肪酸无法减少罹患结肠癌的风险。有一点需要注意,本文研究涉及到的短链脂肪酸以及肠道菌群的数据均来自同一个时间点采样。此外,我们还发现对病变部位的粘膜进行有效的观察可能会提供于病变发生可能性更强的关联性。本文的结果对立志将短链脂肪酸作为肠道健康标志物尝试是一种打击。未来,最为紧迫的事情就是发展新的假设去研究肠道菌群如何与宿主互作,进而促进肿瘤的发生,这些研究有助于我们对于肿瘤的发生以及寻找相应的生物标志物进而预测病变的发生非常有利。
方法。(i)实验设计以及采样方法。整体的实验设计以及基因序列的测序方法已经在之前的文章中进行了详细的阐述(16,17)。粪便样品来源于172个健康人、198个罹患结肠腺瘤的患者以及120个罹患结肠癌的患者。在318个患者中,其中42个患有结肠腺瘤以及26个患有结肠癌的患的粪便采集于治疗后(采样间隔平均255天)。我们通过结肠镜以及对活体样本的组织病理切片的结果对肿瘤进行诊断(16)。本次样品的采集方案已经通过了密歇根州立大学伦理审查委员会的审查,并且根据赫尔辛基宣言的规定,本实验中所有志愿者都签署了告知书。
(ii)特定短链脂肪酸的测定。乙酸、丙酸、异丁酸以及丁酸的测定方法参考之前报道的高效液相色谱法(19)。但是有两处我们做了调整。首先,之前方法中将粪便样品悬浮于DNA Genotek OmniGut管中,本文直接将冷冻的粪便样品悬浮于PBS缓冲溶液中。其次,之前的方法中使用了粪便的平均质量对测得的短链脂肪酸含量进行归一化,本文直接采用了实际的粪便质量进行归一化。上述两处改变并不会影响粪便中短链脂肪酸的范围。异丁酸低于检测限,后期并没有对其进行分析。
(iii)16S rRNA基因测序数据的分析。Baxter 等人以及Sze等人的测序数据从Sequence Read Archive(研究编号位SRP062005以及SRP096978)中获取,然后使用mothurv.1.42对数据进行重新的整理(20)。测序引物依据16S rRNA的V4区进行设计,总长为250bp,测序时采用了Illumina MeSeq型号的测序仪。测序结果经过拼接形成草图,然后去除质量比较低的拼接片段。最后将相应的拼接数据按照97%的可能性归入OUT中,然后进行后续的分析。
(iv)宏基因组DNA测序分析。我们从Baxter等人发表的文章中抽取了部分的样品进行了宏基因组学的测序分析(健康人群27个样品;结肠腺瘤患者 25份;结肠癌患者26份)。Hannigan 等人完成了上述的测序工作,然后将数据导入Sequence Read Archive(编号SRP108915)。然后借助于Illumina HiSeq测序平台,利用125bp长的片段对粪便DNA进行鸟枪法测序。归档的数据首先对片段质量进行了把控,并且结合人类基因组对污染的测序数据进行了去除。我们从系统中将序列进行下载,然后利用MEGAHIT软件进行拼接,然后使用Prodigal软件对序列中的开放式阅读框进行识别(23)。利用Diamond软件对各个开放式阅读框(ORF)的丰度进行测定(24)。接着讲众多的ORF进行聚类形成OPF,此时OPF中有40%的序列时相似的。然后使用mmseq2软件将ORFs导入KEGG数据库中。
(v)随机森林模型的建立。本文我们建立了相应的区分模型,通过肠道菌群和/或短链脂肪酸含量对癌变进行预测。我们还从菌群信息入手结合回归模型对肠道内乙酸、丙酸以及丁酸的含量进行了预测。
(vi)统计学分析流程。本文采用R语言中的tidyverse包(v.1.2.1)为了对不同人群粪便中短链脂肪酸的含量进行比较,我们采用了Kruskal-Wallis 检验。
1、凡本网所有原始/编译文章及图片、图表的版权均属微生物安全与健康网所有,未经授权,禁止转载,如需转载,请联系取得授权后转载。
2、凡本网未注明"信息来源:(微生物安全与健康网)"的信息,均来源于网络,转载的目的在于传递更多的信息,仅供网友学习参考使用并不代表本网同意观点和对真实性负责,著作权及版权归原作者所有,转载无意侵犯版权,如有侵权,请速来函告知,我们将尽快处理。
3、转载请注明:文章转载自www.mbiosh.com
联系方式:020-87680942



