- 9
- 0
- 约7.55千字
- 约 28页
- 2017-07-14 发布于浙江
- 举报
2000A题 DNA序列分类
全国大学生数学建模竞赛题选讲
2000A题: DNA序列分类
2000年6月, 人类基因组计划中DNA全序列草图完成,
预计2001年可以完成精确的全序列图, 此后人类将拥有一
本记录着自身生老病死及遗传进化的全部信息的“天书” 。
这本大自然写成的“天书”是由4个字符A, T, C, G按一定顺
序排成的长约30亿的序列,其中没有“断句”也没有标点符
号, 除了这4个字符表示4种碱基以外, 人们对它包含的“ 内
容”知之甚少,难以读懂。破译这部世界上最巨量信息的
“天书”是二十一世纪最重要的任务之一。在这个目标中,
研究DNA全序列具有什么结构, 由这4个字符排成的看似
随机的序列中隐藏着什么规律, 又是解读这部天书的基础,
是生物信息学(Bioinformatics)最重要的课题之一。
虽然人类对这部“天书”知之甚少, 但也发现了DNA
序列中的一些规律性和结构。例如, 在全序列中有一些是
用于编码蛋白质的序列片段, 即由这4个字符组成的64种
不同的3字符串, 其中大多数用于编码构成蛋白质的20种
氨基酸。又例如, 在不用于编码蛋白质的序列片段中, A和
T的含量特别多些, 于是以某些碱基特别丰富作为特征去
研究DNA序列的结构也取得了一些结果。此外
原创力文档

文档评论(0)