EventsMOL2NET'20, Conference on Molecular, Biomed., Comput. & Network Science and Engineering, 6th ed.
Published
with-doi10.3390/mol2net-06-06950 (registering DOI)
This submission belongs to the session 07. AIMEDIC-07: Int. Congress in Med. Info., UDC, Coruña, Spain-Sandford, USA, 2019 of the event MOL2NET'20, Conference on Molecular, Biomed., Comput. & Network Science and Engineering, 6th ed.
Published date
18 Oct, 2020
Citation
Jose Liñares Blanco, Carlos Fernández Lozano, Generación de modelos predictivos de péptidos anti-angiogénicos para el proyectoCICLOGEN, in Proceedings of MOL2NET'20, Conference on Molecular, Biomed., Comput. & Network Science and Engineering, 6th ed., 30 January 2020–30 January 2021, MDPI: Basel, Switzerland, doi: 10.3390/mol2net-06-06950
Share
Email
Facebook
Twitter
LinkedIn

Generación de modelos predictivos de péptidos anti-angiogénicos para el proyecto
CICLOGEN

image
1. Department of Computer Science and Information Technologies, Faculty of Computer Science, University of A Coruña, CITIC. Campus Elviña s/n, 15071, A Coruña, Spain
Abstract

El cribado y el modelado in silico son actividades críticas para la reducción de los costes
experimentales. También aceleran notablemente la investigación y refuerzan el marco teórico,
permitiendo así a los investigadores cuantificar numéricamente la importancia de un
determinado subconjunto de información. Por ejemplo, en campos como el cáncer y otras
enfermedades de alta prevalencia, es crucial disponer de un método de predicción fiable. El
objetivo de este trabajo es clasificar las secuencias peptídicas en base a su actividad anti-
angiogénica para entender los principios subyacentes a través del aprendizaje automático. En
primer lugar, las secuencias peptídicas fueron convertidas en tres tipos de descriptores
moleculares numéricos basados en la composición de aminoácidos. Se realizaron diferentes
experimentos con los descriptores y se fusionaron para obtener resultados de línea de base para
el desempeño de los modelos, particularmente de cada subconjunto de descriptores
moleculares. Se aplicó un proceso de selección de características para reducir la dimensionalidad
del problema y eliminar las características ruidosas, que están muy presentes en los problemas
biológicos. Después de un robusto diseño experimental de aprendizaje de máquina en igualdad
de condiciones, se superó estadística y significativamente el mejor modelo antiangiogénico
previamente publicado con un modelo lineal generalizado (glmnet), alcanzando un valor medio
de AUC superior a 0,96 y con una precisión de 0,86 con 200 descriptores moleculares, mezclados
de los tres grupos. De acuerdo con nuestros hallazgos, los péptidos de actividad antiangiogénica
están fuertemente asociados con las secuencias de aminoácidos SP, LSL, PF, DIT, PC, GH, RQ,
QD, TC, SC, AS, CLD, ST, MF, GRE, IQ, CQ y HG.

Keywords
Cancer
Machine Learning
Characteristics Selection
Manuscript
Alcohol detection in “lagger” beers using NIR
Predicting Vertical Urban Growth Using Genetic Evolutionary Algorithms in Tokyo’s Minato Ward