Esta revisión narrativa organiza la literatura sobre personalidad, persona y perfil en agentes conversacionales, desde ELIZA y PARRY hasta trabajos neuronales y unos pocos estudios tempranos con GPT publicados hasta 2023. Su aportación principal no es un experimento ni un nuevo modelo, sino seis tablas de orientación cruzada. La Tabla 1 reúne 15 formas de especificar personalidad en cuatro grupos: esquemas psicológicos previos, introversión/extraversión, dimensiones de Eysenck, Big Five/OCEAN, 16PF e IRI; recursos propios de chatbots, listas de rasgos, tropos de personaje, frases descriptivas y pares atributo-valor; especificaciones implícitas mediante monólogos o diálogos; y medidas relacionadas como plantillas, género textual, atributos demográficos o personas históricas. La Tabla 2 describe 21 recursos, entre ellos Persona-Chat, ConvAI2, Image-Chat, PersonalDialog, PersuasionForGood, FriendsPersona y PERSONAGE. Las Tablas 3 y 4 conectan trabajos citados con esas representaciones y con 13 familias técnicas: BERT, CNN, vectores de condición, GAN, GPT, entrenamiento conjunto, redes de memoria, prefijos, prompts, seq2seq, plantillas simbólicas, Transformers y VAE. Las Tablas 5 y 6 agrupan líneas de investigación y revisiones afines. El autor concluye que Persona-Chat e Image-Chat popularizaron las frases descriptivas transparentes, que los perfiles implícitos extraídos de historiales son más sofisticados y que seq2seq, Transformers y redes de memoria dominaban el campo. Su observación más sólida es crítica: muchos resultados seguían siendo inconclusos porque las métricas automáticas suelen reducir la evaluación a predecir la siguiente intervención y la evaluación humana es costosa y no deja claro qué aspecto de la personalidad se está midiendo. El artículo es útil como índice histórico amplio y como vocabulario de diseño, pero no cumple los requisitos de una revisión sistemática reproducible: no informa bases consultadas, búsqueda, fecha de corte, criterios de inclusión/exclusión, cribado, evaluación de calidad, protocolo ni flujo de selección. Además, declara nueve temas relacionados aunque la Tabla 6 contiene diez; equipara deliberadamente personalidad, persona y perfil pese a reconocer sus diferencias; mezcla rasgos psicológicos, biografías, estilos, edad/género, tropos, historiales y personajes históricos; incluye recursos privados junto a datasets públicos; y reproduce claims de trabajos primarios sin una escala común de evidencia. Hay defectos verificables de edición y trazabilidad: el listado de rasgos se describe como 638 elementos pero desglosa 234 positivos y 292 negativos, mientras el texto añade 292 neutrales, 818 en total; PersonalDialog figura con “8.47M million speakers”; PersuasionForGood duplica una frase y escribe “denote” por “donate”; y aparecen referencias sin resolver como “citezhang2018personalizing”, “[Zhao2017]” y “[Sukhbaatar 2015)]”. Tampoco audita licencias, privacidad, disponibilidad, sesgos, seguridad, persuasión o antropomorfización. Por ello debe citarse como mapa narrativo del campo hasta finales de 2023, no como inventario exhaustivo, metaanálisis ni estado actual de la personalidad en LLM en 2026.
Pregunta de investigación
¿Cómo se habían definido y representado personalidad, persona y perfil en agentes conversacionales; qué datasets y métodos de incorporación se habían usado; qué modelos y temas podían organizarse bajo esas categorías; y qué dificultades de evaluación seguían abiertas hasta finales de 2023?