ChatGPT como revisor de tu artículo: qué hace bien y dónde te deja tirado

Empiezo por lo que me juega en contra: ChatGPT es gratis, ya lo tienes abierto y con un buen prompt saca cosas útiles sobre tu manuscrito. Cualquier comparativa que finja lo contrario te está mintiendo, y además tú lo puedes comprobar en dos minutos.

También empiezo por lo otro que me juega en contra: mi herramienta es un modelo de lenguaje igual que el suyo. No vendo magia distinta. Lo que cambia no es la tecnología, es qué se le pide, con qué criterio se le mide y qué se comprueba antes de enseñarte el resultado.

Esta página compara las dos cosas de verdad: qué obtienes pidiéndole a un modelo generalista que haga de revisor, dónde se rompe eso en psicología y ciencias de la salud, y en qué casos no compensa pagar nada porque con el chat te llega.

Lo que ChatGPT hace bien, y no es poco

Con un prompt decente, un modelo generalista te detecta cosas reales: que la introducción no deja claro el vacío que cubres, que el objetivo del estudio y la pregunta de investigación no coinciden, que la discusión repite los resultados en vez de interpretarlos, que hay una conclusión que ninguna de tus tablas sostiene. Todo eso son objeciones legítimas y te las da gratis.

Y hace algo que yo no hago: conversar. Puedes preguntarle por qué dice lo que dice, pedirle que reescriba un párrafo, que te proponga tres formas de plantear la limitación, que te traduzca la respuesta a los revisores. Esa flexibilidad no la tiene ninguna herramienta especializada, incluida la mía.

Si tu manuscrito está en fase temprana, si aún estás decidiendo qué historia cuentas, si lo que necesitas es un interlocutor y no un veredicto, el chat es la herramienta correcta y gastarte dinero en otra cosa es prematuro.

Dónde se rompe cuando el manuscrito es de psicología

El problema no es que el modelo sea malo. Es que un revisor sin campo evalúa contra el promedio de todo lo que ha leído, y el promedio de todas las disciplinas está muy por debajo de lo que exige una revista de psicología. Cuando le pides que revise, te contesta con lo que es cierto en cualquier artículo, porque es lo único que puede afirmar sin conocer tu área.

En la práctica eso significa que se le escapan justo las objeciones que hunden manuscritos en este campo. No te va a decir que reportar solo el alfa de Cronbach como prueba de fiabilidad ya no basta y que te van a pedir el omega de McDonald. Ni que comparar puntuaciones latentes entre hombres y mujeres sin haber probado la invarianza de medida invalida la comparación. Ni que una mediación estimada sobre datos transversales no puede describirse en términos de efectos causales, por muy bien escrita que esté la frase. Ni que faltan los tamaños del efecto con sus intervalos de confianza, que es lo primero que mira un revisor formado.

Hay tres problemas más, y son de forma pero pesan. El primero es la consistencia: dos ejecuciones del mismo prompt pueden darte críticas distintas, y no tienes forma de saber cuál de las dos es la buena. El segundo es la complacencia: un asistente conversacional está optimizado para resultar útil, y eso empuja a validar lo que le enseñas, sobre todo si tu pregunta suena a que esperas un sí. El tercero es que puede inventarse referencias con formato impecable, un riesgo bien documentado en los modelos generalistas, y una cita falsa en una respuesta a revisores hace un daño del que cuesta volver.

Qué cambia en el Revisor Q1, siendo la misma tecnología

Lo digo otra vez porque importa: por debajo hay un modelo de lenguaje, igual que en el chat. La diferencia está en cuatro capas que se añaden encima y que tú no tienes que construir.

La primera es el criterio. El papel, las secciones del informe, la escala de gravedad y las cosas que hay que mirar sí o sí en un manuscrito de psicología o ciencias de la salud están escritas por alguien que revisa para estas revistas. No dependen de que aciertes con el prompt.

La segunda es la estructura del proceso. En el informe Pro no hay una sola lectura: hay dos revisores independientes, un editor que arbitra entre ellos y una criba previa de rechazo de escritorio. Es una imitación deliberada del proceso real de la revista, y sirve para que una crítica no dependa de una única pasada.

La tercera es la verificación. Cada referencia del manuscrito se comprueba una a una, hasta sesenta, contra Crossref, OpenAlex, PubMed, Semantic Scholar y DOAJ, y el informe se revisa antes de entregarse para que no salga con citas inventadas. Esta capa existe precisamente porque el riesgo de alucinación es real y no se arregla pidiéndole al modelo que no alucine.

La cuarta es la forma de la salida: un informe con nota global y por secciones, cada crítica con la cita textual de tu manuscrito y su solución, un plan de reanálisis con el código escrito en el software que usaste tú —el que dice tu apartado de análisis: R, SPSS, jamovi, JASP, Mplus, Stata— y una lista de revistas Q1 y Q2 donde el trabajo encaja. Eso es un documento con el que se trabaja, no un hilo de chat que hay que releer.

Si vas a usar el chat, hazlo bien

No tengo interés en que uses mal una herramienta gratuita para que la mía parezca mejor. Si vas a pedirle a un modelo generalista que revise tu artículo, estas cuatro cosas mejoran mucho el resultado:

Cuándo compensa pagar y cuándo no

No compensa si estás en borrador temprano, si tu campo no es psicología ni ciencias de la salud, o si lo que necesitas es alguien con quien pensar en voz alta. Para eso el chat es mejor herramienta que la mía y es gratis.

Compensa cuando estás a punto de enviar y el coste de equivocarte deja de medirse en euros y pasa a medirse en meses. Una ronda de revisión perdida en una Q1 son entre tres y seis meses; un rechazo sin revisión, dos semanas más el reenvío. Frente a eso, la decisión de gastar el precio de un café en un informe completo no es una decisión económica.

Y hay un camino intermedio que es el que recomiendo: el informe de diagnóstico gratuito, sin registro y sin tarjeta. Súbelo, compáralo con lo que te dijo el chat con tu mejor prompt y quédate con el que te haya dicho algo que no sabías. Si el chat gana, has ahorrado dinero y yo tengo trabajo que hacer.

Preguntas frecuentes

¿Puede ChatGPT revisar mi artículo científico?

Puede darte una lectura crítica útil, sobre todo de estructura y argumentación, y con un buen prompt detecta problemas reales. Lo que no puede es aplicar el estándar concreto de una revista de psicología o ciencias de la salud, porque evalúa contra el promedio de todas las disciplinas. Sirve para el borrador; para el envío se queda corto en las objeciones específicas del campo.

¿El Revisor Q1 no es también IA?

Sí, y sería deshonesto decir otra cosa. Por debajo hay un modelo de lenguaje, igual que en el chat. Lo que cambia son cuatro capas construidas encima: un criterio escrito por un revisor de revistas Q1 de psicología, un proceso con dos revisores y un editor que arbitra, la verificación de cada referencia contra cinco bases de datos, y un informe estructurado en vez de una conversación.

¿Es seguro subir mi manuscrito no publicado a un chat?

Es una pregunta que deberías hacerte con cualquier herramienta, la mía incluida, y la respuesta está en las condiciones de uso y en la política de privacidad de cada una, no en lo que te diga su página de marketing. Revisa qué se hace con el texto que subes y si se usa para entrenar. Si tu manuscrito tiene datos clínicos o material sensible, esa comprobación no es opcional.

¿Por qué el chat me dice que mi artículo está bien y luego me lo rechazan?

Porque un asistente conversacional está optimizado para resultar útil y agradable, y eso empuja a validar lo que le enseñas, sobre todo si tu pregunta ya sugiere que esperas un sí. Un revisor real parte de la posición contraria: busca motivos para rechazar. Si vas a usar el chat, pídele explícitamente que no diga nada positivo y que cite tu texto en cada crítica.

¿Cuál es el mejor prompt para que ChatGPT revise mi paper?

El que le da papel, estándar y prohibición de elogio: que actúe como revisor de una revista concreta de tu área, con las instrucciones para autores y la guía de reporte pegadas en el mensaje, con el encargo explícito de encontrar motivos de rechazo y con la obligación de citar literalmente la frase de tu manuscrito en cada objeción. Si no puede citarla, se la ha inventado.

¿Cómo evito que se invente referencias?

Comprobándolas una a una en Crossref, PubMed u OpenAlex antes de meterlas en el manuscrito. No hay atajo: pedirle al modelo que no invente no garantiza nada. Esa comprobación es justo lo que automatiza el informe Pro del Revisor Q1, que verifica hasta sesenta referencias contra cinco bases de datos.

También te puede interesar