El artículo estudia cómo cambian las respuestas de cuatro LLM a ítems de juicio de Moral Foundations Theory (MFT) cuando reciben un prompt procedimental, una identidad política explícita o una biografía estereotipada. No mide personalidad: las “personas” son descripciones redactadas que agrupan edad, género, etnia, geografía, religión, educación, situación económica y valores sociales asociados por los autores con liberalismo o conservadurismo. El objeto observado es la respuesta condicionada por prompt en cinco fundamentos, Lealtad al grupo, Equidad, Pureza, Autoridad y Cuidado/Daño, no un rasgo interno o estable del modelo.
Se prueban gpt-4o-mini, claude-3-5-haiku-20241022, deepseek-chat y Wizard-Vicuna-30B-Uncensored, con dos temperaturas para cada modelo comercial y una para Vicuna. Hay tres experimentos: respuesta “inherente” sin etiqueta ideológica, role-play explícito como liberal o conservador y role-play con 28 personas, catorce por etiqueta política. Las personas combinan entre cuatro y nueve atributos tomados de resúmenes de tipologías de Pew. Como referencia humana se reutiliza Graham, Haidt y Nosek (2009): 2.212 voluntarios estadounidenses, 1.174 liberales, 500 conservadores y 538 moderados u otros, 62 % mujeres y mediana de 32 años. La ideología humana fue una autoidentificación en un único ítem.
Agregados, los LLM sin etiqueta no reproducen ni el patrón liberal ni el conservador histórico y tienden a puntuar más alto que los humanos en los cinco fundamentos. Todas las diferencias humano-modelo de la condición base se reportan significativas, pero la dirección no forma un sesgo liberal o conservador coherente. El propio artículo plantea una explicación alternativa: aquiescencia ante escalas Likert o un artefacto del prompt, no ideología. Pedir explícitamente una perspectiva liberal acerca las respuestas a la referencia liberal, aunque siguen divergiendo en Lealtad, Autoridad y Daño. Pedir una perspectiva conservadora no reproduce a los conservadores humanos; las mayores desviaciones son Lealtad (d=0,835) y Daño (d=0,824).
Las biografías producen la divergencia más fuerte. Frente a conservadores humanos, las personas conservadoras alcanzan d=2,300 en Pureza y d=2,644 en Autoridad, los dos tamaños de efecto más extremos del estudio. Los autores interpretan este patrón como posible amplificación de estereotipos culturales: el apoyo generado supera lo observado en la referencia humana de 2009. En la comparación entre métodos, la respuesta base y el role-play conservador solo difieren significativamente en Equidad, mientras que las personas alteran ampliamente las respuestas, sobre todo en Pureza y Autoridad. Esto apoya sensibilidad al encuadre y a biografías cargadas; no demuestra una ideología conservadora intrínseca.
La construcción de personas impide atribuir causalidad a datos demográficos concretos. Los atributos están correlacionados y se presentan juntos; además, las historias incluyen activismo, religiosidad, éxito profesional, precariedad, optimismo, roles de género y lenguaje normativo. Por ejemplo, muchas personas liberales combinan juventud urbana, educación, ateísmo, trabajo tecnológico y activismo, mientras las conservadoras agrupan ruralidad, religión, trabajos manuales, dificultades económicas y familia. El estudio puede detectar una respuesta al paquete narrativo, pero no decidir si la causa es edad, etnia, religión, clase, ideología explícita, longitud del prompt o cualquier interacción. Los autores reconocen que las personas son idealizadas y proponen diseños modulares futuros.
La auditoría detecta límites de reproducibilidad que el resumen debe mantener visibles. El método describe la escala humana como 1–6, pero el prompt final exige 0–5 y no explica la recodificación. No informa la lista completa ni el número de ítems, repeticiones, seeds, fechas de API, N por condición, tratamiento de respuestas inválidas o unidad estadística. Las respuestas están anidadas por modelo, temperatura, ítem y persona, pero se agregan y comparan mediante t-tests independientes sin que pueda comprobarse independencia o N efectivo; tampoco se declara corrección por comparaciones múltiples. El artículo reconoce variación entre modelos y falta de estadística robusta a ese nivel, de modo que el agregado no permite rankings individuales.
No se localizaron código, prompts como archivos, outputs crudos ni datos de análisis en la página oficial, arXiv o búsquedas de GitHub. Por ello no pueden recalcularse la figura ni la tabla. La referencia humana es estadounidense y de 2009, anterior en dieciséis años a los modelos; además, el texto la llama tres veces más liberal que conservadora, aunque 1.174/500 equivale aproximadamente a 2,35. La conclusión fiel es acotada: bajo estos prompts y modelos de 2025, las respuestas MFT son sensibles al role-play y las biografías estereotipadas pueden amplificar Pureza y Autoridad más allá de una referencia humana histórica. No demuestra personalidad sintética, ideología interna, representación fiel de grupos, causalidad demográfica ni daño en producción.