




已阅读5页,还剩14页未读, 继续免费阅读
版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
生物信息学中的不确定性和分类问题,邹 权 (博士、副教授) 厦门大学数据挖掘实验室 /zq,提纲,生物信息学和机器学习的关系 一些生物信息学中的分类问题 microRNA识别 蛋白质功能预测 基因表达数据分析 全基因组关联分析 总结,生物信息学,人类基因组计划 数据存储-数据库 数据分析-数据挖掘 Olson M V. Human genetics: Dr Watsons base pairsJ. Nature, 2008, 452(7189): 819-820. HapMap计划 /1000 Genome计划 大数据,生物信息学中的我国计算机学者,算法阶段(1990-2000) 朱大铭、姜涛、卜东波 标注阶段(2000-2008) 王晓龙、朱小燕等 系统分析阶段(2008-2013) 李衍达、张学工等 大规模数据处理阶段(2010-now) 华大基因,一些生物信息学中的分类问题,microRNA识别 蛋白质功能预测 基因表达数据分析 全基因组关联分析,microRNA识别,2006年诺贝尔奖-RNA干扰机制 CCCCUCUAUUCACAAUUGUUUGGAACUCAGUUUUGUGAUUAUUCUAUCAUUGCCAGGGAGUUUGUGUGGUUGCAUCAGGGG,microRNA分类相关论文,Chenghai Xue, Fei Li, Tao He, Guo-Ping Liu, Yanda Li, Xuegong Zhang. Classification of real and pseudo microRNA precursors using local structure-sequence features and support vector machine. BMC Bioinformatics. 2005.6:310 (google scholar引用271次,截至2014.8.2) Peng Jiang, Haonan Wu, Wenkai Wang, Wei Ma, Xiao Sun, Zuhong Lu. MiPred: classification of real and pseudo microRNA precursors using random forest prediction model with combined features. Nucleic Acids Research. 2007,35:W339-W344 (google scholar引用239次,截至2014.8.2) Leyi Wei, Minghong Liao, Yue Gao, Rongrong Ji, Zengyou He, Quan Zou. Improved and promising identification of human microRNAs by incorporating a high-quality negative Set. IEEE/ACM Transactions on Computational Biology and Bioinformatics. 2014, 11(1):192-201,microRNA与疾病的关系,图挖掘 相似度度量、不确定性 参考文献 Jiang Q, Hao Y, Wang G, et al. Prioritization of disease microRNAs through a human phenome-microRNAome networkJ. BMC Systems Biology, 2010, 4(Suppl 1): S2. Xuan P, Han K, Guo M, et al. Prediction of microRNAs associated with human diseases based on weighted k most similar neighborsJ. PloS one, 2013, 8(8): e70204.,一些生物信息学中的分类问题,microRNA识别 蛋白质功能预测 基因表达数据分析 全基因组关联分析,蛋白质功能预测,问题 输入:蛋白质序列,进行聚类、分类 特殊蛋白识别-不平衡分类 亚细胞定位-多类分类 酶和多功能酶-多类,少量多标记 功能预测-多示例、多标记 二级结构、结构域-标注、HMM 难点 特征提取 分类器,一些生物信息学中的分类问题,microRNA识别 蛋白质功能预测 基因表达数据分析 全基因组关联分析,基因表达数据分析,14/57,聚类,分类,双聚类,一些生物信息学中的分类问题,microRNA识别 蛋白质功能预测 基因表达数据分析 全基因组关联分析,全基因组关联分析(GWAS),GWAS,难点 高维小样本 SNP-SNP相互作用 结果的可解释性 前景 疾病的遗传机理 遗传育种(作物、养殖),总结,机器学习在寻找生物信息学 应用-分类、聚类、降维、不确定性 结果的
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- (2025年标准)股权投资的协议书
- (2025年标准)股权出让合同协议书
- 2025年数字化管理师初级考试趋势分析与预测题详解
- (2025年标准)购买文具捐赠协议书
- (2025年标准)购买酒坛协议书
- (2025年标准)购买班服协议书
- 隐私保护不可否认性框架-洞察及研究
- 工业自动化工程项目内外关系协调措施
- 桥梁工程质量进度保证措施
- 2026届福建省福清市化学高二上期中复习检测试题含解析
- 2024年哈尔滨租房落户协议书模板
- 专项14-因式分解-专题训练(30道)
- 异位妊娠的课件
- 食品安全体系FSSC22000-V6版标准要求及内审员培训教材
- 人教版2024年小学升学考试数学模拟测试卷(共5套)(含答案解析)
- (2024年)肺栓塞的护理课件
- (高清版)TDT 1031.6-2011 土地复垦方案编制规程 第6部分:建设项目
- 遥感数字图像处理课件
- 检验科实验室生物安全培训课件
- 《宠物解剖生理》课程标准
- 山西航空公司招聘笔试真题
评论
0/150
提交评论