El estudio separa tres explicaciones que una pregunta sí/no confunde: el veredicto lógico, la palabra elegida y la posición impresa de la respuesta. Usa 20 dilemas morales, 19 reproducidos de un trabajo anterior, y una batería de simetrización cruzada que invierte acción/complemento, dirección de escala, redacción, etiquetas y orden. Siete configuraciones frontier y dos modelos abiertos responden escalas graduadas, elección libre y formatos binarios; las API muestreadas se ejecutan a temperatura 1 con 3–8 réplicas por celda. En escalas graduadas, las configuraciones frontier muestran incoherencia entre formas de 0,12–0,21 en un eje ±1, mientras Qwen3.6-35B-A3B llega a 0,40 y Nemotron-3-Nano-30B-A3B se concentra cerca del punto medio. En el binario sí/no, el desplazamiento aparente se descompone exactamente en atracción por el último elemento y por la etiqueta. Claude Sonnet y Haiku presentan los artefactos mayores (-0,32 y -0,86, respectivamente); GPT-5.5 y Gemini se acercan a cero, y el razonamiento extendido reduce varios efectos. Al sustituir sí/no por A/B, colores, glifos o palabras de otros idiomas, el componente unido al veredicto es aproximadamente cero en todos los frontier, aunque persisten preferencias de etiqueta y orden dependientes del modelo. El resultado justifica cruzar formulaciones antes de interpretar una respuesta como valor moral. No demuestra, sin embargo, una escala moral interna en sentido psicológico: establece coherencia de salidas dentro de este instrumento, estos veinte dilemas y una sesión sin contexto. La comparación humana reutiliza dos muestras publicadas (N=285 y N=474) cuyos participantes no recorren todas las formas, y no hay datos humanos nuevos. Aunque el texto afirma que raw trials, código y una pipeline reproducen todo, el depósito conserva un marcador pendiente y el paquete arXiv omite SI, datos, código, prerregistro y scripts; por tanto, las cifras no pueden reproducirse de forma independiente desde el artefacto auditado.
Pregunta de investigación
¿Los cambios de veredicto en dilemas morales reflejan una alteración del juicio del modelo o artefactos separables de orden, etiqueta y redacción?