Los modelos de lenguaje ya no solo escriben texto: también empiezan a usarse para ayudar a ordenar conocimiento científico. Un estudio publicado en eLife puso a prueba una idea concreta dentro de ese movimiento: si estas herramientas pueden reconstruir redes bioquímicas, es decir, mapas de interacciones moleculares que los investigadores usan para entender cómo una célula responde a señales, activa genes o cambia su metabolismo.
La pregunta importa porque construir esos mapas suele llevar mucho tiempo. En biología y medicina, buena parte del trabajo previo a cualquier modelo computacional consiste en revisar artículos, extraer relaciones entre moléculas y convertir esa información dispersa en una red coherente. Ese proceso puede demandar meses de lectura y verificación manual. Si la IA lograra automatizar una parte sustancial de esa tarea, podría acelerar el armado de modelos para estudiar enfermedades, probar hipótesis y diseñar experimentos.
El resultado fue mixto. Al comparar lo que producían varios modelos de lenguaje de uso general con redes de señalización ya curadas por especialistas, el equipo encontró que las herramientas lograban recuperar entre 24% y 65% de las reacciones incluidas en esos mapas de referencia. En redes metabólicas de Escherichia coli, el rendimiento fue mejor: entre 64% y 91% de las reacciones del modelo central. Es decir, la IA ya puede reconstruir una porción relevante de estructuras conocidas, pero todavía deja huecos importantes.
La diferencia no es menor, porque una red incompleta puede servir como borrador inicial y aún así fallar cuando se la usa para predecir qué ocurrirá si cambia una señal o se altera una molécula. Eso también apareció en el estudio. Cuando los autores transformaron algunas de esas redes en modelos lógicos para simular perturbaciones, la precisión de las predicciones quedó bastante más baja, entre 6% y 33%. En otras palabras, una cosa es dibujar parte del mapa y otra muy distinta es que ese mapa alcance para anticipar bien el comportamiento del sistema.
El trabajo comparó tres familias de modelos y propuso una tubería de evaluación para medir cuánto recuerdan de redes ya validadas y cuánto de eso se traduce en capacidad predictiva. Más que anunciar una sustitución inminente de la curaduría humana, el estudio ofrece una línea de base: muestra con números qué tan lejos o cerca está hoy esta tecnología de convertirse en una herramienta fiable para biología computacional.
Ese punto tiene valor público aunque el tema parezca especializado. Cada vez más promesas sobre IA en ciencia hablan de acelerar descubrimientos biomédicos, encontrar fármacos o modelar células enteras. Pero para que esas promesas se vuelvan útiles, primero hay que saber si los sistemas pueden reconstruir con fidelidad el conocimiento básico sobre el que después se apoyan esas aplicaciones. Este trabajo sugiere que la respuesta, por ahora, es parcial: la IA puede ahorrar trabajo preliminar y generar borradores útiles, pero todavía no ofrece por sí sola una base suficientemente sólida para confiar en sus modelos sin revisión experta.
También deja una enseñanza metodológica. En vez de discutir la IA en términos vagos, el estudio la enfrenta a tareas medibles: cuántas reacciones correctas recupera, cuántas omite, cuántas inventa y qué tan bien predice después el modelo resultante. Esa forma de evaluación puede ser más valiosa que una demostración llamativa, porque permite distinguir entre una herramienta que impresiona y una que realmente sirve para investigación reproducible.
Como toda prueba de este tipo, el estudio tiene límites. Se centró en redes concretas ya publicadas y en modelos de lenguaje de propósito general, no en sistemas diseñados específicamente para biología. Además, una red bioquímica no es una verdad definitiva: también depende de qué literatura se elige, cómo se resume y qué simplificaciones se aceptan. Aún así, el mensaje central es claro. La IA ya empieza a ser útil para organizar conocimiento complejo, pero en este terreno todavía funciona mejor como asistente que como sustituto de quienes curan, comparan y validan la evidencia.
Benchmarking biochemical networks generated by large language models · eLife
Ciencias.uy / MiniMax image-01 · Imagen generada con MiniMax image-01 para Ciencias.uy; uso editorial no comercial; CC BY 4.0 · Fuente de imagen
Tewari, J., Dahl, B. W., Bates, B. A., Papin, J. A., & Saucerman, J. J. (2026). Benchmarking biochemical networks generated by large language models. eLife, 15, RP109709. https://doi.org/10.7554/eLife.109709.3
Relacionadas por categoría
Ver masUn método combina mapas moleculares e imágenes para leer la organización de un tejido
SpaMOAL integra imágenes histológicas, ubicación y señales moleculares para distinguir regiones de un tejido con mayor detalle.
Un método busca que la IA generativa respete límites de seguridad sin reentrenarse
HardFlow guía modelos generativos para que sus resultados cumplan restricciones estrictas, como evitar choques en una trayectoria robótica, sin tener que volver a entrenarlos.
Un sistema ayuda a anticipar cuándo puede fallar un vehículo autónomo
Un método del MIT traduce en conceptos comprensibles parte del razonamiento de un vehículo autónomo y ayuda a que humanos anticipen mejor sus errores.
Más de la misma fuente
Ver masLos cíclidos aceleran el recambio de dientes cuando pierden piezas
Un experimento con cíclidos del lago Malawi mostró que la pérdida de dientes acelera su sustitución y permitió seguir los cambios celulares que acompañan ese proceso.
La retina en desarrollo sincroniza actividad eléctrica, eliminación celular y crecimiento de vasos
Un estudio en ratones describe cómo las primeras ondas de actividad de la retina se coordinan con la eliminación de células y el avance de los vasos sanguíneos.
Un modelo identifica olores que las abejas evitan y los prueba en el campo
Un modelo examinó millones de estructuras químicas y ayudó a encontrar siete compuestos que alejaron a abejas que forrajeaban libremente en ensayos de campo.
Más del mismo autor
Ver masUn biorreactor sólido acerca mejor el metano a las bacterias
Unos andamios impresos en 3D mejoraron la conversión de metano en succinato en pruebas de laboratorio al evitar una barrera habitual de los reactores líquidos.
Así se degradan los escudos térmicos durante la reentrada
Imágenes de rayos X y análisis computacional muestran cómo cambia por dentro un material que se sacrifica para proteger naves durante la reentrada.
Un programa de reparación del intestino puede ayudar al cáncer colorrectal a diseminarse
Experimentos con organoides, ratones y datos de pacientes muestran cómo un programa normal de reparación puede facilitar la llegada de células tumorales al hígado.