DNA序列研究报告数学建模问题.docVIP

  • 36
  • 0
  • 约1.79万字
  • 约 23页
  • 2018-12-08 发布于安徽
  • 举报
. PAGE -. 题目 序列 摘要 本文主要研究序列的结构问题,通过建立相应的数学模型,对序列中所隐藏的规律进行研究和分析,给出了解决问题的最优方案,并且对模型进行了评价和推广。 对于问题一,为了挖掘序列的特征将其分为类和类,以20种基本氨基酸为目标,利用软件编程得出每一行每一种氨基酸出现的概率;再运用主成分分析法进行降维,利用软件进行数据处理得到矩阵;然后再将模糊聚类问题转化为如下优化问题: 用模糊聚类分析方法来获取样本与聚类中心的加权距离最小的最佳分类,使其分类结果与问题所给的答案一致,如果如下表: 类 1 2 3 5 6 7 8 9 10 类 4 11 12 13 14 15 16 17 18 19 20 由此可见,误差较小可忽略不计,证明此种方法可行。再以此种方法将21到40行序列分为两类,其中 类,1 4 6 8 10 11 13 18 20; 类,2 3 5 7 9 12 14 15 16 17 对于问题二:在问题一的基础上,对182个氨基酸序列进行分类,采取与问题一相同的方法进行分类,分类结果见问题二的求解。 总的来说,本模型在未知数据特征的情况下很好的将数据进行分类,成功地解决了此次数学建模的序列问题,是聚类分析问题的一个有效而且具有较强实用性的方法。 关键词:主成分分析 模糊聚类分析 软

文档评论(0)

1亿VIP精品文档

相关文档