Este informe breve estudia si la versión gratuita 23.3 de ChatGPT genera descripciones emocionales diferentes cuando una misma situación se atribuye a una persona con trastorno límite de la personalidad (TLP) o trastorno esquizoide de la personalidad (TEP). Los días 19 y 20 de abril de 2023, los autores presentaron una vez cada uno de los 20 escenarios de la Levels of Emotional Awareness Scale (LEAS) bajo cada etiqueta diagnóstica, siempre en una pestaña nueva. Sustituyeron el «tú» de la escala humana por «persona con TLP» o «persona con TEP» y pidieron describir qué sentirían tanto el personaje principal como otra persona del escenario. Después solicitaron al propio ChatGPT que asignara intensidad de 0 a 10 a cada emoción que acababa de producir. Las respuestas se puntuaron con el manual LEAS, de 0 a 4 por escenario y 0–80 en total, y con dos índices añadidos: número de emociones e intensidad autoasignada. El personaje con TLP obtuvo el máximo LEAS, 80, frente a 47 para el personaje con TEP; también recibió más emociones y mayor intensidad. En los escenarios TLP, el personaje principal superó al otro personaje sin diagnóstico, 80 frente a 66. En los escenarios TEP, el personaje principal no difirió del otro personaje en LEAS o intensidad, aunque sí en número de emociones. El otro personaje obtuvo además un LEAS diferente según conviviera en el escenario con la etiqueta TLP o TEP. Estos resultados muestran que el texto de una única instantánea de ChatGPT cambia fuertemente ante dos etiquetas diagnósticas y reproduce el contraste esperado por el DSM entre turbulencia emocional y desapego. No muestran mentalización de una persona real: no hay pacientes, clínicos, conducta, diálogo terapéutico ni medida independiente del estado mental. El diseño tampoco separa conocimiento clínico de estereotipo, precisamente el riesgo que el propio artículo discute. La LEAS se modifica para evaluar narración en tercera persona, no se valida para LLM, no se repiten generaciones y la intensidad la puntúa el mismo modelo que genera las emociones. Por ello, la evidencia respalda sensibilidad del output al prompt diagnóstico, no una capacidad mentalizante ni utilidad diagnóstica o terapéutica.
Pregunta de investigación
¿Puede ChatGPT generar descripciones semejantes a conciencia emocional que diferencien la experiencia atribuida a personajes con TLP y TEP, de acuerdo con el contraste clínico y teórico esperado?