Capítulo 2
Los enfoques multiómicos —que incluyen, entre otros, una combinación de estudios de asociación de todo el genoma, perfiles transcriptómicos, mapeo de interacciones proteómicas, secuenciación metagenómica y perfiles bioquímicos metabolómicos— proporcionan información sobre la dinámica molecular de la patogénesis de las enfermedades que no se puede obtener con ninguna tecnología ómica por sí sola. Sin embargo, armonizar estos conjuntos de datos heterogéneos en modelos biológicos exhaustivos sigue siendo un reto debido a las plataformas analíticas específicas de cada ómica, a los valores que faltan y a las diferencias en los rangos dinámicos y la dimensionalidad de los datos. En respuesta a ello, ha surgido una nueva generación de métodos computacionales que combinan el aprendizaje estadístico, la inteligencia artificial (IA), la biología de redes y la inferencia causal para integrar diversos conjuntos de datos moleculares. Estas tecnologías están transformando la multiómica, pasando de ser una herramienta de investigación descriptiva a convertirse en un motor para el descubrimiento de fármacos basado en mecanismos, el desarrollo de biomarcadores, la optimización de ensayos clínicos y la medicina de precisión.
Entre los avances más influyentes se encuentran los métodos de aprendizaje de representaciones latentes, que transforman múltiples conjuntos de datos ómicos en una representación latente compartida de baja dimensión, al tiempo que conservan las fuentes de variación biológicamente significativas. Algoritmos como el Análisis Factorial Multi-Ómico Plus (MOFA+), totalVI, el análisis de correlación canónica (CCA) y los enfoques basados en mínimos cuadrados parciales (PLS) identifican la variación biológica compartida a pesar de las diferencias sustanciales entre la secuenciación, la espectrometría de masas yel ELISA²⁻⁴. Como resultado, se modelan simultáneamente las interacciones entre genes, proteínas, metabolitos y otros datos ómicos, lo que permite caracterizar los cambios en las cascadas de señalización, los perfiles transcriptómicos y los flujos metabólicos que coordinan la patogénesis de la enfermedad.
La rápida adopción de la IA multimodal ha contribuido a acelerar la integración de las multiómicas. Las redes neuronales profundas, los transformadores multimodales y los modelos biológicos de base son capaces de aprender relaciones complejas y no lineales entre varios conjuntos de datos ómicos. Dado que estos modelos suelen entrenarse mediante aprendizaje autosupervisado, pueden descubrir patrones biológicos latentes sin necesidad de una anotación manual exhaustiva. Gracias al aprendizaje por transferencia, los modelos desarrollados para un ámbito patológico pueden adaptarse a otro, lo que reduce la cantidad de datos experimentales necesarios para nuevas aplicaciones. Al mismo tiempo, los enfoques de IA, entre los que se incluyen las explicaciones aditivas de Shapley (SHAP), los gradientes integrados, los mecanismos de atención y los algoritmos de atribución de características, ayudan a identificar qué moléculas son responsables de las predicciones de un modelo, mejorando asíla interpretación biológica5-7.
La biología de redes se ha convertido en un elemento central en muchos campos de las ciencias de la vida. Marcos como la fusión de redes de similitud (SNF), las redes neuronales de grafos, las redes bayesianas y los grafos de conocimiento biológico permiten combinar los conocimientos biológicos previos condatos experimentalesmultiómicos⁸⁻¹¹. Estos métodos basados en redes identifican módulos de enfermedad, caracterizan vías de señalización, predicen interacciones entre fármacos y dianas hasta entonces desconocidas y revelan mecanismos compensatorios que con frecuencia subyacen a la resistencia terapéutica. Dado que conservan el contexto biológico, los enfoques basados en grafos han cobrado especial relevancia para identificar nuevas dianas terapéuticas y comprender cómo las perturbaciones moleculares afectan a los sistemas biológicos.
Dado que los conjuntos de datos suelen generarse en múltiples centros clínicos, centros de secuenciación, organizaciones de investigación por contrato y consorcios internacionales, es esencial llevar a cabo una armonización adecuada de los datos para evitar que se enmascaren las señales biológicas auténticas. Algoritmos como Harmony, ComBat, «vecinos más cercanos mutuos» y los métodos de adaptación de dominio basados en el aprendizaje profundo reducen sustancialmente la variación técnica específica de cada plataforma y lote, al tiempo que conservan las señales biológicamente significativas enlos conjuntos de datos multiómicos integrados12-15. Estos métodos permiten a los investigadores combinar conjuntos de datos heredados con datos recién generados, lo que aumenta drásticamente la potencia estadística y facilita el descubrimiento y la validación de biomarcadores a gran escala.
Tradicionalmente, los datos moleculares se promedian a partir de millones de células. La multiómica espacial y de célula única mide varias capas moleculares dentro de células individuales, al tiempo que conserva su organización espacial en el interior de los tejidos. Plataformas analíticas como Seurat v5 y MultiVI integran diversas modalidades de omicas espaciales y de célula única, incluidosdatos transcriptómicos, proteómicos, metabolómicos y de imágenes espaciales¹⁶,¹⁷, mientras que marcos de análisis posteriores como CellChat y NicheNet aprovechan estos conjuntos de datos integrados para inferir la comunicación célula-célula y reconstruir los ecosistemas celulares de los tejidos con mayorresolución¹⁸,¹⁹. En conjunto, estos marcos analíticos han permitido a los investigadores reconstruir los microentornos tumorales con resolución a nivel de célula individual, identificar poblaciones celulares raras resistentes a los fármacos, cartografiar redes complejas de comunicación entre células inmunitarias y visualizar las diferencias específicas de cada paciente en la respuesta terapéutica yla progresión de la enfermedad²⁰⁻²⁴.
Los estudios de asociación tradicionales identifican características moleculares que se correlacionan con la enfermedad, pero tienen una capacidad limitada para distinguir los factores causales de las consecuencias secundarias. Los enfoques computacionales modernos —entre los que se incluyen la aleatorización mendeliana, las redes causales bayesianas, el modelado de ecuaciones estructurales, el modelado causal dinámico, la inferencia de redes basada en perturbaciones y los modelos computacionales basados en CRISPR— pueden combinarse con conjuntos de datos multiómicos armonizados para reconstruirvías biológicascausales25-29. Este cambio de la correlación a la causalidad mejora sustancialmente la confianza en que las dianas terapéuticas recién identificadas sean biológicamente significativas y tengan más probabilidades de traducirse en un beneficio clínico.
Más allá de las aplicaciones y los sectores concretos, la multiómica armonizada está redefiniendo la propia biología de las enfermedades. En lugar de clasificar las enfermedades únicamente por su histología o su cuadro clínico, los investigadores están definiendo endotipos moleculares basados en firmas integradas genómicas, transcriptómicas, proteómicas, metabolómicas e inmunitarias. Este enfoque a nivel de sistemas ya ha transformado la oncología de precisión, donde la clasificación molecular guía la selección terapéutica. Están surgiendo rápidamente estrategias similares para las enfermedades neurodegenerativas, los trastornos autoinmunes y la enfermedad inflamatoria intestinal. En última instancia, las nuevas estrategias de armonización y análisis descritas anteriormente están desplazando la investigación de las enfermedades y el desarrollo de fármacos del perfil molecular descriptivo hacia la biología predictiva y mecanicista. Estos avances prometen no solo acelerar el descubrimiento de fármacos, sino también mejorar la selección de dianas terapéuticas, reducir el abandono en los ensayos clínicos, identificar biomarcadores sólidos y ofrecer terapias verdaderamente individualizadas.
Teniendo en cuenta algunas de las técnicas multiómicas más innovadoras y punteras, analizaremos a continuación estudios clave que muestran cómo se ha utilizado la multiómica para impulsar el descubrimiento científico o proporcionar un medio para mejorar los resultados de los pacientes con cáncer (capítulo 3), enfermedades neurodegenerativas (capítulo 4) o enfermedad inflamatoria intestinal (capítulo 5). Esperamos que ver la multiómica en acción ayude a los investigadores a apreciar mejor su valor científico y su impacto.