Este trabajo aceptado como póster en ICLR 2026 estudia si varios LLM pueden reconstruir la estructura de correlaciones entre rasgos psicológicos a partir de información mínima. Para 816 participantes chinos de un estudio realizado durante la pandemia, los autores proporcionaron a doce condiciones de modelo los 20 ítems del Big Five y les pidieron representar a cada persona al contestar nueve escalas adicionales. El resultado principal no es una medida de precisión individual: compara 105 correlaciones Big-Five–escala-objetivo generadas por los modelos con las correlaciones humanas. En Gemini 2.5, la regresión entre ambos vectores obtiene k = 1,42 y R² = 0,92; nuestra reproducción con los archivos publicados da k = 1,415 y R² = 0,917. Los doce modelos muestran k > 1, lo que el artículo denomina amplificación estructural. Este hallazgo agregado es sólido en los outputs liberados, pero no significa que el modelo explique más del 88 % de los rasgos de una persona. La tabla de predicción individual presenta correlaciones medias de 0,345 a 0,445. El análisis de trazas encuentra gran acuerdo entre modelos a nivel de factores (r = 0,981 frente a un baseline Bayesian Ridge), pero poco a nivel de ítems (r = 0,207), por lo que no valida el razonamiento interno. Los resúmenes narrativos mejoran modestamente el resultado al añadirse a los scores, aunque las comparaciones usan subconjuntos variables de 193 a 711 participantes y no están emparejadas limpiamente con el baseline de 816. El repositorio permite comprobar parcialmente el efecto estructural, pero carece de código, enlaces individuales entre escalas humanas, los 20 ítems Big Five usados como input, baselines ejecutables, tests, dependencias y licencia. Además, el archivo demográfico y Big Five conserva cuasi-identificadores muy específicos: 680 de 816 filas son únicas al combinar sexo, provincia, edad exacta, ocupación, educación y fecha, lo que contradice una interpretación fuerte de «totalmente anonimizado». La lectura defendible es que estos LLM reproducen y amplifican una estructura de covarianza psicológica en esta muestra y bajo estos prompts; no que realicen perfiles individuales precisos, válidos, explicables o seguros.
Pregunta de investigación
¿Pueden los LLM reconstruir, a partir de los 20 ítems del Big Five de una persona, la estructura agregada de correlaciones que conecta esos rasgos con nueve instrumentos psicológicos, y qué indican sus trazas y resúmenes sobre el mecanismo de esa simulación?