Lo que sigue es un apartado de Resultados completo, del primer párrafo al último, escrito como iría en un manuscrito real. Debajo está comentado frase a frase: por qué va cada cosa donde va, qué decisión hay detrás y qué pasa si la quitas.
Si lo que buscas es la guía general de notación —cursivas, decimales, cómo se escribe cada estadístico—, está en cómo reportar resultados en APA 7. Esto es lo otro: la plantilla entera y el orden.
El estudio del ejemplo
Ensayo con dos grupos: 64 estudiantes universitarios con sintomatología ansiosa asignados al azar a una intervención de regulación emocional de ocho sesiones o a lista de espera. Medida principal: ansiedad (STAI-R). Medidas en pretest, postest y seguimiento a tres meses.
El apartado, entero
Análisis preliminares
«De los 64 participantes aleatorizados, 58 completaron la evaluación postest (90.6%) y 54 la de seguimiento (84.4%). Las pérdidas no difirieron entre condiciones, χ²(1, N = 64) = 0.42, p = .517, ni en ansiedad basal, t(62) = 0.88, p = .383. Se siguió el principio de intención de tratar y los datos faltantes se manejaron con máxima verosimilitud de información completa.
La distribución del STAI-R se inspeccionó por grupo y momento. La asimetría osciló entre −0.42 y 0.61 y la curtosis entre −0.55 y 0.38, dentro del rango aceptable para el modelo lineal. La prueba de Levene no indicó heterocedasticidad en el pretest, F(1, 62) = 1.14, p = .290.
Descriptivos
La Tabla 1 recoge las medias y desviaciones típicas del STAI-R por condición y momento. En el pretest los dos grupos partían de puntuaciones equivalentes (intervención: M = 24.10, DT = 5.02; lista de espera: M = 23.40, DT = 5.31), t(62) = 0.54, p = .591, d = 0.14, IC 95% [−0.35, 0.63].
Análisis principal
Se ajustó un ANOVA mixto 2 (condición) × 3 (momento) sobre el STAI-R. La prueba de Mauchly indicó que no se cumplía la esfericidad, W = .84, χ²(2) = 9.12, p = .010, por lo que se aplicó la corrección de Greenhouse-Geisser (ε = .86).
La interacción condición × momento fue significativa, F(1.72, 89.44) = 14.27, p < .001, η²p = .22. El efecto principal de momento también lo fue, F(1.72, 89.44) = 21.03, p < .001, η²p = .29, y el de condición no, F(1, 52) = 2.91, p = .094, η²p = .05.
Las comparaciones por pares con ajuste de Bonferroni mostraron que el grupo de intervención redujo su ansiedad entre el pretest y el postest (diferencia = 6.20 puntos, IC 95% [3.90, 8.50], p < .001, d = 1.18) y mantuvo la mejora en el seguimiento frente al pretest (diferencia = 5.80, IC 95% [3.30, 8.30], p < .001, d = 1.09). El grupo de lista de espera no cambió en ningún contraste (todas las p > .38).
Análisis secundarios
El tamaño del efecto entre grupos en el postest fue d = 0.92, IC 95% [0.38, 1.45]. Un 41.4% de los participantes de la intervención (12 de 29) frente a un 6.9% de los de lista de espera (2 de 29) dejaron de superar el punto de corte clínico, χ²(1, N = 58) = 9.06, p = .003, OR = 9.53, IC 95% [1.92, 47.30].»
Comentario, frase a frase
1. El flujo de participantes va primero, y va con números
El primer párrafo dice cuánta gente entró, cuánta salió y si los que salieron se parecían a los que se quedaron. Ese contraste —pérdidas por condición y en la variable basal— no es un adorno: es la prueba de que el abandono no sesgó el resultado. Si el grupo que peor iba abandonó más, el efecto que reportas después puede ser un artefacto.
Y el manejo de los datos faltantes va aquí, con nombre propio. «Se eliminaron los casos con datos perdidos» es una decisión, y una mala, pero al menos es una decisión escrita. Lo que no vale es no decirlo.
2. Los supuestos: con números, no con adjetivos
Fíjate en que no dice «los datos eran normales». Da los rangos de asimetría y curtosis. Es la diferencia entre una afirmación comprobable y una declaración de intenciones.
Fíjate también en lo que no hay: ninguna prueba de Shapiro-Wilk. Con 29 por grupo, esa prueba no aporta —detecta desviaciones triviales o se le escapan las importantes según el n— y lo que decide es la inspección de la forma. El razonamiento largo está en la prueba de normalidad de Shapiro-Wilk, mal interpretada. Si tu revisor la pide, la reportas; pero no la conviertes en el argumento.
3. Los descriptivos van a tabla, y en el texto solo lo que se lee
La tabla lleva las seis medias; el texto solo repite las dos del pretest, porque son las que sostienen la equivalencia inicial. Repetir en el texto todo lo que ya está en la tabla es el error de redacción más común del apartado, y hace que se pierda lo importante.
El contraste del pretest lleva su tamaño del efecto con intervalo aunque no sea significativo. Un d = 0.14 con un intervalo de [−0.35, 0.63] dice «no hay diferencia y además lo hemos mirado con precisión suficiente»; una p = .591 sola no dice ni la mitad.
4. El análisis principal se anuncia antes de darlo
«Se ajustó un ANOVA mixto 2 × 3» va antes que cualquier número. El lector tiene que saber qué está mirando antes de mirarlo. Y el resultado de Mauchly va antes que la F, porque de él dependen los grados de libertad que vienen después. Todo el detalle de esa corrección está en ANOVA de medidas repetidas en APA 7.
5. La interacción primero, los efectos principales después
En un diseño con interacción significativa, el orden no es cronológico ni de la salida del programa: es de importancia. La interacción es la hipótesis del estudio —que la intervención cambie las cosas a lo largo del tiempo—, así que va primero. Los efectos principales van detrás y en dos líneas.
Y se reportan también los no significativos, con su número. Un efecto de condición con p = .094 omitido es una omisión selectiva, y en un manuscrito que va a una revista con política de datos abiertos se ve enseguida.
6. Las diferencias, en unidades de la escala y no solo en d
«Diferencia = 6.20 puntos, IC 95% [3.90, 8.50]» es información clínica: quien conoce el STAI sabe qué son seis puntos. El d = 1.18 va detrás, para comparar con otros estudios. Los dos juntos, en ese orden, es lo que hace que el resultado se pueda usar.
7. Los contrastes que no salen se agrupan
«El grupo de lista de espera no cambió en ningún contraste (todas las p > .38)». Tres líneas de no-resultados agrupadas en media. Es correcto y es legible; enumerarlas una por una habría enterrado el resultado que sí importa.
8. La significación clínica, al final
El último párrafo traduce el efecto estadístico a personas: cuántas dejaron de superar el punto de corte. Es opcional en APA pero es lo que un editor de una revista aplicada busca, y muchas veces es lo único que sobrevive al resumen que se lleva el lector.
El orden que espera APA 7
Uno: flujo de participantes y datos faltantes. Dos: comprobaciones previas y supuestos. Tres: descriptivos. Cuatro: el análisis de la hipótesis principal. Cinco: análisis secundarios o exploratorios, etiquetados como tales. Seis: cualquier análisis de sensibilidad.
Ese orden no es una manía de estilo: reproduce el orden en el que un lector escéptico necesita las cosas. Primero quiere saber si la muestra aguanta, luego si el modelo era aplicable, luego qué había, y solo entonces qué salió.
Qué NO va en Resultados
Interpretación. «Esto sugiere que la regulación emocional protege frente a la ansiedad» es Discusión. En Resultados va lo que pasó, no lo que significa.
Comparaciones con la literatura. «En línea con Smith et al. (2020)» es Discusión.
Limitaciones. Discusión.
Detalles de procedimiento. Cómo se administró la escala es Método. Si te descubres explicando en Resultados cómo hiciste algo, es que faltaba en Método.
Las hipótesis. Van en la Introducción. En Resultados se pueden citar por su número («la hipótesis 2 no se sostuvo»), pero no se enuncian de nuevo.
Comprobación rápida antes de enviarlo
Cada contraste que informas, ¿lleva su tamaño del efecto? Cada tamaño del efecto, ¿lleva su intervalo de confianza? ¿Están los gl de todos los estadísticos? ¿Coinciden los números del texto con los de las tablas, uno a uno? ¿Está dicho qué se hizo con los datos faltantes? ¿Están reportados los contrastes no significativos que preveías? ¿Hay alguna frase interpretativa que debería estar en la Discusión?
Esa última pregunta es la que más veces se responde que sí. La notación exacta de intervalos, medias y bootstrap está en cómo reportar intervalos de confianza y bootstrap en APA 7, y si lo que te falta es convertir un estadístico suelto en su frase, lo hace el formateador de resultados en APA 7.
Y si lo que buscas es la plantilla suelta de cada prueba para ir rellenando, el Kit de Resultados APA 7 reúne los diez párrafos modelo con su botón de copiar. Se abre dejando tu correo en el formulario que hay justo debajo de este artículo.
Antes de enviarlo
Resultados es el apartado donde un revisor metodológico decide si el estudio está bien hecho, y lo decide en dos lecturas. Si quieres las objeciones antes que él, sube el manuscrito al revisor de artículos: es gratis, no pide registro y te devuelve cada crítica pegada a la frase que la provoca.
Referencias
American Psychological Association. (2020). Publication manual of the American Psychological Association (7.ª ed.).
Appelbaum, M., Cooper, H., Kline, R. B., Mayo-Wilson, E., Nezu, A. M., y Rao, S. M. (2018). Journal article reporting standards for quantitative research in psychology: The APA Publications and Communications Board task force report. American Psychologist, 73(1), 3-25.