Científicos de la Universidad de California en San Diego logran, por vez primera, mapear el patrón del iniciador genético en el 60% de los genes, un avance que promete anticipar el efecto de mutaciones asociadas a cáncer y otras patologías.
En un hito que fusiona biología molecular y computación avanzada, un equipo de investigadores del laboratorio del profesor James T. Kadonaga, adscrito al Departamento de Biología Molecular de la Universidad de California en San Diego (UCSD), ha empleado algoritmos de inteligencia artificial para desentrañar por completo la estructura del iniciador, un elemento regulador clave que determina el punto exacto donde comienza la lectura de la información genética. Este componente, presente en cerca del sesenta por ciento de los genes humanos, había permanecido como un enigma parcialmente resuelto hasta que este estudio, publicado en la revista Genes & Development, aportó una luz definitiva sobre su firma molecular.
El iniciador, conocido en la literatura científica como initiator o elemento Inr, consiste en un tramo de ADN que flanquea el sitio de inicio de la transcripción, es decir, el lugar preciso donde la maquinaria celular se posa para copiar un gen en ARN mensajero, el cual servirá de molde para fabricar proteínas, enzimas, hormonas y otras moléculas vitales. Cuando esta secuencia sufre alteraciones o mutaciones, los genes pueden perder su capacidad de activarse en el momento y tejido adecuados, desencadenando desde fallos metabólicos hasta la aparición de tumores malignos. A pesar de su importancia cardinal, la huella química que lo identifica en el genoma no había sido descifrada con nitidez hasta ahora.
El trabajo, liderado por el doctorando Torrey Rhyne-Carrigg, se basó en una estrategia ambiciosa: el equipo sintetizó y examinó cerca de medio millón de variantes distintas de la secuencia iniciadora, midiendo la eficiencia de cada una para impulsar la expresión génica mediante técnicas de secuenciación masiva de alto rendimiento. Esos datos, ingentes en número y complejidad, fueron volcados en un sistema de aprendizaje automático que, tras un entrenamiento exhaustivo, aprendió a reconocer qué combinaciones de bases nitrogenadas favorecen el arranque de la transcripción y cuáles lo entorpecen. De este modo, el modelo construyó una especie de retrato computacional del iniciador, una firma digital basada en preferencias de secuencia y en las relaciones funcionales entre sus posiciones, mucho más sofisticada que un simple motivo corto y fijo.
Al proyectar ese modelo sobre la totalidad del genoma humano, los científicos constataron que el iniciador aparece en aproximadamente seis de cada diez genes, una proporción que subraya su relevancia como mecanismo maestro de regulación. Pero el logro no se detiene en el mero censo: la inteligencia artificial reveló también patrones sutiles que distinguen a los iniciadores plenamente operativos de aquellos que muestran un rendimiento deficiente, algo que hasta ahora se resistía a los métodos experimentales convencionales. Según declaró el propio Kadonaga, estas herramientas predictivas ofrecen por primera vez estimaciones robustas sobre la presencia o ausencia del iniciador en distintos contextos genómicos, y son capaces de descifrar la lógica subyacente a su secuencia de bases.
El impacto de este descubrimiento trasciende la biología fundamental, pues los genes que dependen del iniciador incluyen muchos de expresión tisular específica y otros directamente implicados en procesos cancerosos. De ahí que el modelo diseñado por los investigadores se perfila como una valiosa hoja de ruta para evaluar el efecto de mutaciones puntuales: si una variante genética altera el iniciador de un gen vinculado al control del ciclo celular, el algoritmo podría anticipar si esa modificación compromete su activación y en qué grado, abriendo la puerta a diagnósticos más precisos y a estrategias terapéuticas personalizadas. Además, los datos generados podrían emplearse para ingeniar promotores sintéticos, es decir, secuencias artificiales capaces de encender o apagar genes a voluntad, con aplicaciones en biotecnología y medicina regenerativa.
Un dato que refuerza la solidez de los resultados es la notable conservación evolutiva de los patrones hallados: los perfiles identificados en el genoma humano resultaron prácticamente calcos de los observados en Drosophila melanogaster, la célebre mosca de la fruta que sirve como organismo modelo en genética. Esta similitud, mantenida a lo largo de millones de años de evolución, sugiere que el iniciador constituye un dispositivo ancestral y esencial en la regulación de la expresión génica en el reino animal, lo que otorga al hallazgo una relevancia aún más amplia.
Kadonaga enmarca este avance dentro de una empresa de mayor calado: la construcción de un modelo integral de inteligencia artificial que represente la totalidad del código de expresión génica humano, es decir, el conjunto completo de instrucciones contenidas en el ADN que determinan qué genes se activan, en qué células y en qué momentos. “Si lográramos ese modelo global —señaló el investigador— podríamos pronosticar la actividad de cada variante génica presente en distintos individuos”. En ese ambicioso rompecabezas, el nuevo modelo para el iniciador constituye una pieza pequeña pero decisiva.
El proyecto contó con el respaldo económico de los Institutos Nacionales de Salud (NIH) y la Fundación Nacional de Ciencias (NSF) de Estados Unidos, y para su ejecución se aprovecharon los recursos computacionales del clúster Expanse, alojado en el Centro de Supercomputación de San Diego. Junto a Rhyne-Carrigg y Kadonaga, firman el trabajo Long Vo Ngoc, Claudia Medrano y Kassidy E. Gillespie, quienes así consolidan un ejemplo paradigmático de cómo la sinergia entre experimentación húmeda y algoritmos de vanguardia puede desentrañar los mensajes crípticos que guarda nuestra herencia biológica.
