El artículo presenta MBTI-in-Thoughts (MiT), un marco de prompts que asigna a agentes LLM uno de los 16 perfiles MBTI y estudia si esas instrucciones cambian respuestas psicométricas, relatos, estrategias en juegos y colaboración multiagente. Para validar la inducción, GPT-4o mini responde los 60 ítems de 16Personalities cinco veces por perfil, a temperatura 1; los prompts incluyen tanto una descripción del tipo como cuatro ejemplos de respuesta ya alineados con sus ejes. Los diagramas separan con claridad E/I, T/F y J/P, mientras S/N resulta más débil. Esta prueba demuestra seguimiento coherente de instrucciones en el mismo constructo que el prompt explicita, no una personalidad interna ni persistencia fuera del test. En generación narrativa se toman 100 prompts de WritingPrompts y se generan historias para los 16 tipos y dos controles, EXPERT y NONE. En el resultado mostrado, Qwen3-235B-A22B a temperatura 0 produce diferencias de tono evaluadas automáticamente: los perfiles Feeling reciben mayores puntuaciones de carga emocional, final feliz y carácter personal. Sin embargo, los controles también mejoran cohesión y redundancia respecto de historias humanas, por lo que el propio texto reconoce que el efecto específico de personalidad sobre esas propiedades de calidad es pequeño. En juegos repetidos, el trabajo define honestidad como coincidencia entre la acción anunciada, inferida por otro LLM, y la acción elegida. En la figura agregada para GPT-4, Thinking aparece con aproximadamente 90 % de defección frente a 50 % en Feeling; Thinking cambia de estrategia alrededor de 0,07 frente a 0,16 en Feeling; e Introversion alcanza una honestidad cercana a 0,54 frente a 0,33 en Extraversion. Son patrones del protocolo, cuyo prompt permite expresamente mentir, no medidas generales de honestidad, cognición o seguridad. En BIG-Bench y SOCKET, la comunicación con reflexión privada supera a la comunicación interactiva simple, pero queda aproximadamente al nivel de la votación independiente; por tanto, no se demuestra una mejora sobre el control más sencillo. La extensión a Big Five, HEXACO, Eneagrama y DISC es una formalización vectorial ilustrativa, no una evaluación experimental de esos marcos. El artículo admite que selecciona resultados “representativos” y omite datos sin “insights relevantes”. Además, el repositorio oficial no reproduce de forma ejecutable el estudio: no contiene resultados ni una instantánea de entorno, tres módulos no compilan por imports con guion, varios scripts apuntan a rutas inexistentes, el juez de los protocolos interactivos no recibe la conversación final y la configuración publicada de teoría de juegos usa temperatura 0 o GPT-4o mini, frente a GPT-4 y temperatura 1 declarados en la figura. Por estas razones, las conclusiones aplicadas a salud, negociación, seguridad o justicia son especulativas.
Pregunta de investigación
¿Puede el condicionamiento por prompt basado en perfiles MBTI producir sesgos conductuales medibles en agentes LLM y aprovecharse para generación narrativa, interacción estratégica y razonamiento multiagente; y es el mismo mecanismo formalmente adaptable a otros marcos de personalidad?