El trabajo propone sustituir la metáfora del LLM como individuo por la del LLM como superposición de perspectivas: el prompt activa conductas, valores y rasgos distintos, por lo que una puntuación aislada no debería interpretarse como atributo estable del modelo. Evalúa respuestas de opción forzada a PVQ, VSM e IPIP, una pregunta por prompt, mediante decodificación codiciosa y 50 permutaciones del orden de las opciones. En GPT-3.5-turbo-0301, cinco conversaciones simuladas, cinco formatos textuales y seis párrafos de Wikipedia sobre géneros musicales cambian significativamente muchas puntuaciones, incluso sin instrucciones explícitas sobre valores; el artículo denomina a esto cambio inesperado de perspectiva. También define controlabilidad como la diferencia entre la puntuación normalizada de los valores inducidos y la media de los no inducidos. En la comparación principal, GPT-3.5-0301 alcanza 0,681 en PVQ, Upstage LLaMA 66B Instruct 0,265 en VSM y GPT-3.5-0613 0,400 en IPIP con sus mejores prompts. El hallazgo robusto es que el formato, el contexto y la formulación alteran fuertemente las respuestas de cuestionario de estos modelos, y que ningún método de inducción domina en todos. Sin embargo, la cuantificación estadística no equivale a estudiar personas: las 50 observaciones son reordenaciones de respuesta del mismo modelo determinista, compartidas entre condiciones, no participantes ni réplicas independientes. Tratarlas como grupos independientes en ANOVA, Tukey y Welch, y equipararlas con personas para calcular Cohen d, estabilidad de rangos e ipsativa, introduce pseudorreplicación y hace que las comparaciones directas con cambios humanos no sean válidas como magnitudes equivalentes. Además, el VSM advierte explícitamente que no sirve para comparar individuos ni un único grupo, justo el uso realizado. El preprint aporta una advertencia importante contra antropomorfizar puntuaciones puntuales, pero no demuestra una ontología interna de perspectivas ni que los LLM cambien más que las personas. La reproducibilidad es parcial: existe código MIT, cuestionarios y scripts, pero el commit contemporáneo al artículo no puede arrancar sin un módulo ausente, fija rutas internas, publica dependencias contradictorias, no incluye resultados y depende de endpoints retirados. El registro de ICLR fue una submission rechazada; la referencia correcta es arXiv v3 de 2023, no proceedings 2024.
Pregunta de investigación
¿Hasta qué punto contextos aparentemente no relacionados alteran los valores y rasgos expresados por un LLM en cuestionarios psicológicos, y con qué eficacia distintas combinaciones de modelo, mensaje y persona gramatical permiten inducir deliberadamente una perspectiva objetivo?