- 1
- 0
- 约 23页
- 2017-08-21 发布于河南
- 举报
DNA序列分类
摘要 本问题是一个“有人管理分类问题”. 首先分别列举出20个学习样本序列中1字符串、2字符串、3字符串出现的频率,构成含41个变量的基本特征集,接着用主成分分析法从中提取出4个特征.然后用Fisher线性判别法进行分类,得出了所求20个人工制造序列及182个自然序列的分类结果如下:
20个人工序列:22, 23,25,27,29,34,35,36,37为A类,其余为B类.
182个自然序列:1,4,8,10,27,29,32,41,43,48,54,63,70,72,75,76,81,86,90,92,102,110,116,119,126,131,144,150,157,159,160,161,162,163,164,165,166,169,170,182为B类,其余为A类.
最后通过检验证明所用的分类数学模型效率较高.
一、问 题 重 述
人类基因组计划中DNA全序列草图是由4个字符A,T,C,G按一定顺序排成的长约30亿的字符序列,其中没有“断句”也没有标点符号.虽然人类对它知之甚少,但也发现了其中的一些规律性和结构.例如,在全序列中有一些是用于编码蛋白质的序列片段,即由这4个字符组成的64种不同的3字符串,其中大多数用于编码构成蛋白质的20种氨基酸.又例如,在不用于编码蛋白质的序列片段中,A和T的含量特别多些,于是以某些碱基特别丰富作为特征去研究
您可能关注的文档
- (备战2015中考15分钟精华题)考点30图形变换 图形镶嵌与设计.doc
- (最新)教师招聘考试教育学、心理学试题(附答案).doc
- _二氧化碳制取的研究_教学设计.pdf
- _全日制义务教育普通高级中学英语课程标准_实验稿_特点初探.pdf
- 【7年高考5年模拟】高考英语 单项填空之主谓一致试题汇编.doc
- 【备战2015】中考数学专题复习训练13 一元一次不等式(无答案).doc
- 【杭州英语】高一英语阅读理解分类训练与解析(故事类).doc
- 【强烈推荐】备战2015高考——高考历史第二阶段专题复习总攻略.doc
- 08年微观经济学竞赛题(修改好).doc
- 20 中国法语教学研究会召开翻译专题座谈会.pdf
最近下载
- 胃肠道解剖课件.pptx VIP
- 湖北省2025年普通高中学业水平合格性考试化学试卷.docx VIP
- 2025年东莞市第一中学自主招生数学复习题库附答案解析.pdf
- 重力式混凝土挡土墙施工方案.doc VIP
- 2026年东莞市第一中学数理实验班自主招生数学复习题库附答案解析.pdf
- 【国家标准】GBT 19936.1-2005 齿轮FZG试验程序 第1部分:油品的相对胶合承载能力 FZG试验方法A-8.3-1990.pdf
- DB34T 4512-2023 医院膳食服务规范.pdf VIP
- 加工车间规章管理制度.docx VIP
- 数字孪生电气火灾早期智能监测系统设计与应用.pdf VIP
- 成图大赛历届竞赛题及答案.pdf VIP
原创力文档

文档评论(0)