Este artículo de perspectiva define «psicometría de IA» como el uso crítico de inventarios psicológicos para diagnosticar rasgos no cognitivos que los modelos expresan o imitan, y acompaña la propuesta con demostraciones en modelos abiertos de inferencia de lenguaje natural. En vez de pedir texto libre a modelos generativos, presenta cada ítem como premisa y cada opción verbal de respuesta como hipótesis; registra la probabilidad de entailment, elige la opción de máxima probabilidad y agrega los ítems según las reglas originales. Se estudian siete modelos únicos de las familias RoBERTa, DeBERTa, BERT y BART, seis en inglés y tres configuraciones en alemán. Los instrumentos cubren Big Five, tétrada oscura, valores de Schwartz, fundamentos morales y creencias sobre diversidad de género y sexo. Los perfiles Big Five ingleses resultan bastante homogéneos: alta Agreeableness y Extraversion y bajo Neuroticism, con más diferencias en Openness y Conscientiousness; las versiones alemanas divergen más. Las puntuaciones de la tétrada oscura se sitúan generalmente entre 2 y 3 sobre 5, sin perfiles extremos. En el PVQ-RR algunos modelos diferencian poco los diez valores y aparece una diferencia por pronombre especialmente visible en Achievement para DeBERTa. Frente a una referencia de estadounidenses políticamente moderados, los modelos ponderan más Authority, In-group Loyalty y Purity. En la escala GSDB todos enfatizan Uniformity y muestran poca Affirmation de identidades diversas. Estos son resultados descriptivos del método y las instantáneas elegidas, no pruebas de que los sistemas posean rasgos psicológicos ni de que las escalas sean válidas para máquinas. Los autores subrayan como agenda pendiente la fiabilidad, validez, estabilidad temporal, comparación entre idiomas, relación con conducta posterior, robustez adversarial y seguimiento de nuevas versiones. También advierten que la analogía con humanos es metafórica: los modelos son sistemas predictivos cuyos patrones lingüísticos pueden tener consecuencias reales al desplegarse, pero no comparten la vida mental, fisiología o contexto humano.
Pregunta de investigación
¿Cómo pueden reutilizarse inventarios psicométricos de rasgos no cognitivos como herramientas diagnósticas de LLM, qué revelan unas demostraciones mediante clasificación zero-shot y qué problemas conceptuales y de validez debe resolver la psicometría de IA?