El trabajo construye un agente virtual encarnado que utiliza GPT-4o-mini-2024-07-18 para generar diálogo y seleccionar comportamientos no verbales asociados a extraversión o introversión. El modelo recibe una definición de personalidad, el contexto de negociación o conversación para romper el hielo y una lista cerrada de acciones faciales, corporales y vocales. No genera movimiento desde cero: escoge etiquetas y descripciones que se ejecutan en Unity mediante un personaje masculino de Reallusion, expresiones SALSA, animaciones de Mixamo/Reallusion y voces de ElevenLabs. Un GPT también describe previamente los clips disponibles. Las voces Eric y Brian se asignan respectivamente a los agentes extrovertido e introvertido después de un piloto con 15 personas, de modo que voz, longitud verbal, gesto y personalidad cambian conjuntamente.
El Experimento 1 ejecuta diez conversaciones por escenario. En negociación se permiten hasta diez turnos y en ice-breaking hasta ocho. LIWC 2015 muestra 15 categorías diferentes en negociación y 11 en ice-breaking después de que los autores retengan únicamente diferencias con p<0,05 y d de Cohen>0,5. Los agentes extrovertidos generan más palabras: 90,58 frente a 56,30 en ice-breaking y 56,32 frente a 41,46 en negociación, con p<0,001. Un clasificador de personalidad basado en BERT ofrece una validación desigual: en negociación clasifica como extrovertidas el 68 % de las intervenciones de ambos agentes y la diferencia entre condiciones no es significativa (χ²=2,65; p=0,10); en ice-breaking clasifica así el 97,5 % de las intervenciones extrovertidas y el 50 % de las introvertidas (χ²=20,92; p<0,001). Las figuras no verbales siguen en general los estereotipos incorporados a la lista: más mirada, sonrisa, gesto amplio, volumen alto y velocidad rápida para extraversión; más evitación de mirada, gesto estrecho, volumen bajo y ritmo lento para introversión. No se aplican pruebas inferenciales a esas probabilidades.
El Experimento 2 presenta vídeos pregrabados a 30 participantes de Prolific, 17 mujeres y 13 hombres, asignados a negociación o ice-breaking. Cada participante compara agentes extrovertido e introvertido y responde sobre extraversión percibida y señales influyentes; su propia extraversión se estima con los dos ítems correspondientes del BFI-10. El efecto principal del tipo de agente es claro en las medias mostradas: los agentes extrovertidos reciben entre 4,8 y 6,0 puntos y los introvertidos entre 3,4 y 3,9 en una escala de siete puntos; el artículo informa F=44,57 y p<0,001. El contexto no alcanza significación (p=0,086). Los participantes atribuyen mayor influencia a lo verbal que a lo no verbal, 60 % para el agente extrovertido y 63,3 % para el introvertido, y la mayoría considera los comportamientos coherentes: 66,7–93,3 % responde «sí» para lo no verbal y 73,3 % para lo verbal; nadie responde «no».
Esta evidencia demuestra reconocibilidad de dos presentaciones deliberadamente contrastadas, no que el LLM haya descubierto o mantenido una personalidad psicológica general. Los prompts, la longitud de respuesta, la voz, las animaciones y las etiquetas de acción están diseñados para maximizar señales estereotípicas y no se aíslan mediante ablaciones. El estudio no incluye condición solo verbal, solo no verbal, sin personalidad, guion humano o agente no encarnado. Ver dos condiciones puede además revelar la hipótesis a los participantes. Las unidades del Experimento 1 son intervenciones anidadas en apenas diez diálogos por escenario, pero se analizan con t-tests sin modelar dependencia; se filtran categorías LIWC significativas sin corrección por comparaciones múltiples. En el estudio humano faltan potencia, randomización y orden, grados de libertad, tamaños de efecto y detalles de exclusión. El dato F=2,99 con p=0,622 para versión de vídeo es internamente inverosímil y no puede verificarse con los datos ausentes.
No se enlazan código, prompts, vídeos, cuestionario completo, datos, animaciones derivadas, plan analítico o registro ético, y una búsqueda dirigida no localizó un repositorio oficial. El artículo tampoco informa aprobación ética o consentimiento, pese al estudio humano, ni analiza riesgos de estereotipar introversión/extraversión o de aplicar estos agentes en terapia, mencionada solo como futuro posible. La contribución defendible es un prototipo multimodal y evidencia inicial de que observadores distinguen dos configuraciones audiovisuales muy contrastadas, especialmente en un contexto social informal. No prueba generalización a otros rasgos, agentes, modelos, voces, cuerpos, culturas, tareas o interacción en tiempo real.