Los modelos de lenguaje ya escriben, resumen y responden preguntas, pero un nuevo estudio sugiere otra capacidad llamativa: también pueden anticipar cómo saldrán muchos experimentos de ciencias sociales. Un trabajo publicado en Nature encontró que sistemas como GPT-4 lograron predecir con bastante precisión la dirección y la magnitud relativa de cientos de efectos medidos en estudios con personas reales.
El equipo reunió un archivo de 70 experimentos preregistrados y con muestras representativas de Estados Unidos. En total, el conjunto incluía 469 efectos experimentales y 119.330 participantes. Luego pidió a un modelo de lenguaje que simulara cómo responderían personas expuestas a distintos estímulos, y comparó esas respuestas simuladas entre condiciones para inferir qué efecto tendría cada intervención.
El resultado principal fue que las predicciones del modelo se parecieron mucho a los resultados observados en los estudios reales, con un nivel de acierto comparable al de grupos de pronosticadores humanos. Esa relación siguió siendo alta incluso cuando los autores analizaron trabajos que no estaban publicados ni disponibles públicamente antes de la fecha de corte del entrenamiento del modelo, una forma de reducir la posibilidad de que simplemente estuviera repitiendo información ya conocida.
Eso no significa que la inteligencia artificial “entienda” el comportamiento humano de la misma manera que lo hace un investigador social. De hecho, el estudio encontró una limitación importante: los modelos tendieron a sobreestimar el tamaño de los efectos. En otras palabras, a menudo acertaban hacia dónde iba a moverse el resultado, pero exageraban cuánto iba a cambiar.
La importancia del hallazgo está en el posible uso práctico. Si estas predicciones se confirman y mejoran, podrían servir para probar ideas de forma preliminar, comparar intervenciones antes de lanzar estudios costosos o detectar qué resultados merecen replicación adicional. En campos donde los experimentos insumen tiempo, dinero y reclutamiento de miles de personas, una herramienta así podría ayudar a ordenar prioridades, no a reemplazar la evidencia.
Los propios autores también examinaron los riesgos. Consultaron a 460 científicos sociales sobre posibles usos y problemas de esta clase de sistemas, y el trabajo discute cuestiones como sesgos, mal uso e ilusión de comprensión. Que un modelo acierte patrones estadísticos no implica que sus respuestas sean neutrales ni que pueda sustituir el diseño experimental, la teoría o la interpretación humana.
Ese punto importa especialmente porque el estudio se mueve en una frontera delicada. No muestra que un modelo pueda reemplazar participantes humanos ni que pueda resolver por sí solo preguntas complejas sobre sociedad, política o psicología. Lo que sí muestra es que estos sistemas parecen haber absorbido regularidades suficientes de grandes volúmenes de texto como para anticipar, al menos en parte, cómo responden las personas en situaciones experimentales.
Visto con cautela, el trabajo no cierra el debate sobre inteligencia artificial y ciencias sociales: lo vuelve más concreto. En vez de preguntar solo si los modelos hablan como humanos, empieza a medir si también pueden funcionar como una herramienta auxiliar para pensar experimentos. La respuesta, por ahora, es prometedora, pero todavía bastante imperfecta.
Large language models can predict the results of social science experiments · Nature
Ciencias.uy / MiniMax image-01 · Imagen generada con MiniMax image-01 para Ciencias.uy; uso editorial no comercial; CC BY 4.0 · Fuente de imagen
Ashokkumar, A., Hewitt, L., Ghezae, I., & Willer, R. (2026). Large language models can predict the results of social science experiments. Nature. https://doi.org/10.1038/s41586-026-10742-x
Relacionadas por categoría
Ver masUna ventana al interior de los chatbots ayuda a anticipar conductas problemáticas
Un estudio del MIT probó una interfaz que muestra señales internas de un chatbot antes de usarlo y encontró que puede ayudar a anticipar rasgos como complacencia excesiva, toxicidad o empatía aparente.
Un método permite auditar modelos de IA sin generar material ilegal
Investigadores de MIT desarrollaron una técnica para detectar si un modelo generativo fue adaptado para producir material ilegal, sin pedirle nunca que lo genere.
Una plataforma de IA permite seguir en tiempo real el comportamiento animal sin equipos de alto costo
Un equipo presentó una plataforma que combina etiquetado, entrenamiento y análisis en tiempo real para seguir la postura y el movimiento de animales con precisión comparable a sistemas más pesados y costosos.
Más de la misma fuente
Ver masUna terapia génica personalizada redujo convulsiones graves en dos niños
Un estudio en dos niños con una forma grave de epilepsia ligada al gen SCN2A halló menos convulsiones y mejoras del desarrollo tras una terapia diseñada a medida.
Un analizador de aliento podría ayudar a seguir la cetosis sin análisis de sangre
Un equipo validó en 12 adultos un detector portátil de acetona en el aliento que se acercó al rendimiento de una técnica de laboratorio para seguir cambios del metabolismo graso.
Un pequeño exceso de tubulina puede desordenar tejidos y debilitar células
Un estudio en Nature Communications sugiere que aumentar apenas la tubulina libre basta para volver más rígido el andamiaje interno de las células, alterar su organización y reducir su viabilidad.
Más del mismo autor
Ver masEl LHC encuentra nuevas pistas del plasma primordial en choques de oxígeno
Las cuatro grandes colaboraciones del LHC detectaron nuevas señales de plasma de quarks y gluones en colisiones de oxígeno y neón, lo que sugiere que ese estado extremo puede surgir en sistemas más pequeños.
Los castigos previos pueden dificultar aprender de las recompensas
Un estudio con 159 participantes encontró que, cuando una misma opción arrastra un historial de castigos, aprender de sus recompensas se vuelve más difícil y aumenta la exploración.
Lantana camara: una planta invasora que se propaga sin diversidad genética
Un estudio con 359 plantas de India reveló que Lantana camara, una de las especies invasoras más problemáticas del mundo, se reproduce principalmente por autofecundación y existe como líneas genéticas idénticas.