全国大学生数学建模竞赛题选讲 [pdf].pdfVIP

  • 9
  • 0
  • 约7.55千字
  • 约 28页
  • 2017-07-14 发布于浙江
  • 举报

全国大学生数学建模竞赛题选讲 [pdf].pdf

2000A题 DNA序列分类 全国大学生数学建模竞赛题选讲 2000A题: DNA序列分类 2000年6月, 人类基因组计划中DNA全序列草图完成, 预计2001年可以完成精确的全序列图, 此后人类将拥有一 本记录着自身生老病死及遗传进化的全部信息的“天书” 。 这本大自然写成的“天书”是由4个字符A, T, C, G按一定顺 序排成的长约30亿的序列,其中没有“断句”也没有标点符 号, 除了这4个字符表示4种碱基以外, 人们对它包含的“ 内 容”知之甚少,难以读懂。破译这部世界上最巨量信息的 “天书”是二十一世纪最重要的任务之一。在这个目标中, 研究DNA全序列具有什么结构, 由这4个字符排成的看似 随机的序列中隐藏着什么规律, 又是解读这部天书的基础, 是生物信息学(Bioinformatics)最重要的课题之一。 虽然人类对这部“天书”知之甚少, 但也发现了DNA 序列中的一些规律性和结构。例如, 在全序列中有一些是 用于编码蛋白质的序列片段, 即由这4个字符组成的64种 不同的3字符串, 其中大多数用于编码构成蛋白质的20种 氨基酸。又例如, 在不用于编码蛋白质的序列片段中, A和 T的含量特别多些, 于是以某些碱基特别丰富作为特征去 研究DNA序列的结构也取得了一些结果。此外

文档评论(0)

1亿VIP精品文档

相关文档