Etiqueta: test de trauma

  • Test del Ajolote y Tests de Trauma con Imágenes: Una Guía para Entenderlos (con Descargo)

    Test del Ajolote y Tests de Trauma con Imágenes: Una Guía para Entenderlos (con Descargo)

    Por Nicolás Alcayaga, Psicólogo Clínico

    Te apareció en TikTok, lo hiciste en dos minutos y el resultado te dejó pensando. Puede que hayas llegado desde el test de traumas ajolote de BetterMe, o desde uno de esos tests donde eliges una imagen y te dicen qué herida de la infancia no has cerrado. Y lo raro es que acertó. O al menos eso pareció.

    No estás inventando nada: efectivamente acertó. Lo que pasa es que habría acertado igual con cualquier otra persona que respondiera cualquier otra cosa, y esa es justamente la parte interesante. Acá abajo hay una demostración de 30 segundos que te lo va a mostrar en carne propia, con tu propia respuesta, mejor de lo que te lo puedo explicar por escrito.

    Antes de llegar ahí conviene entender dos cosas: cómo están construidos estos tests y qué tan lejos están de una evaluación del trauma de verdad. Con eso encima, el resultado de la demostración te va a hacer mucho más sentido.

    La respuesta corta

    Los tests de trauma virales con imágenes no detectan trauma. No están validados, no tienen puntajes de corte publicados ni población de referencia, y su aparente precisión se explica por el efecto Barnum: aceptamos como propia una descripción genérica cuando creemos que fue escrita para nosotros. Son entretención, y a veces un empujón para consultar. No sirven como diagnóstico.

    ¿Qué es el test del ajolote de BetterMe y por qué se volvió viral?

    El “test del ajolote” es un cuestionario online de la app de bienestar BetterMe que circuló masivamente en TikTok durante 2025 y 2026. Pide datos sobre la relación con los padres y la frecuencia de ciertas conductas, y devuelve un perfil sobre tu estado emocional y tu forma de comunicarte. El ajolote es la mascota que acompaña el recorrido, y buena parte de su viralidad viene de ahí: la gente comparte capturas de “cómo veo el ajolote” y compara resultados.

    En la misma familia están los tests de “elige una imagen”: cuatro garabatos, cuatro dibujos o cuatro figuras, y según cuál te llame la atención primero, el test te asigna un trauma (humillación, rechazo, abandono, ausencia parental). Los medios que los publican suelen agregar una línea al final aclarando que es un pasatiempo.

    Vale la pena separar dos cosas que se confunden. Un cuestionario que te hace preguntas sobre tu vida al menos recoge información tuya, aunque después la interprete sin respaldo. Un test que te pide elegir un dibujo no recoge absolutamente nada: la elección de una figura abstracta no contiene información sobre tu historia. Son dos niveles distintos de lo mismo, y ninguno es una evaluación clínica.

    [EXPERIENCIA: En consulta me ha pasado varias veces que alguien llega con la captura del resultado en el teléfono. Casi nunca vienen preguntando si el test es cierto. Vienen porque el test le puso nombre a algo que ya venían sintiendo, y eso les dio permiso para pedir hora.]

    ¿Por qué el resultado se siente tan exacto?

    Porque está diseñado para eso. El fenómeno se llama efecto Barnum (o efecto Forer) y consiste en dar por válida una descripción de personalidad genérica cuando creemos que fue elaborada especialmente para nosotros. Las frases están construidas para que le calcen a casi cualquier adulto, así que la probabilidad de fallar es mínima.

    El estudio que mejor lo ilustra no usó horóscopos, sino un instrumento psicológico serio. En una investigación con pacientes ambulatorios reales, se aplicó el test de Rorschach a doce personas y sus resultados se interpretaron con un programa computarizado del Sistema Comprehensivo. Cuatro psiquiatras puntuaron la exactitud del informe verdadero y de uno falso para cada uno de sus propios pacientes. El informe real tuvo apenas un 5% de poder discriminativo, y el 60% de sus frases se limitaba a describir características típicas de cualquier paciente ambulatorio (Prince y Guastello, 1990).

    Ojo con el dato: hablamos de un informe generado desde un test proyectivo con imágenes, interpretado por software, evaluado por psiquiatras que conocían a esos pacientes. Si ahí el margen real era de 5%, imagina cuánto queda de un test de cuatro garabatos hecho para redes sociales.

    Hay dos ingredientes más que suben la sensación de acierto sin que la validez del test cambie en nada. El primero es el halago: cuando el resultado es favorable, se percibe como más exacto y se acepta más que uno desfavorable. El segundo es el estatus de quien lo entrega. En un experimento con devoluciones en grupo, la retroalimentación que venía del líder generó más sensación de exactitud, más aceptación y mejor recuerdo que la misma retroalimentación viniendo de otro participante (Snyder y Newburg, 1981). Una app de salud con diseño cuidado ocupa exactamente ese lugar de autoridad.

    Tampoco somos todos igual de susceptibles. En un estudio con 130 participantes que respondieron cuatro medidas distintas del efecto, el pensamiento autorreferencial y la esquizotipia positiva predijeron de forma independiente cuánto acuerdo mostraba cada persona, tanto con descripciones favorables como desfavorables, y tanto con lecturas de computador como con horóscopos (Mason y Budge, 2011).

    Ahora sí. Deja de leer un segundo y haz la demostración de abajo. No hay respuestas correctas ni incorrectas, y toma menos de un minuto.

    Demostración interactiva

    Elige una imagen y mira qué dice de tu pasado

    Funciona igual que los tests virales que circulan por ahí. Tarda 30 segundos. Al final vas a entender por qué esos tests aciertan tanto.

    ¿Cuál de estos trazos te llama más la atención?

    Esto es lo que tu elección dice de ti:

    ¿Qué tan bien te describe?

    Nada que verEs exactamente yo

    Aquí está el truco

    Esa descripción no tenía nada que ver con el trazo que elegiste. Las cuatro opciones daban exactamente el mismo texto. Podrías haber elegido cualquiera y habrías leído lo mismo, palabra por palabra.

    A eso se le llama efecto Barnum: damos por buena una descripción genérica cuando creemos que fue hecha para nosotros. Está redactada con frases que le calzan a casi cualquier persona adulta, así que es casi imposible que falle.

    No es que seas ingenuo. Es que el formato está diseñado para acertar sin saber nada de ti. Cuando cuatro psiquiatras compararon informes reales con informes falsos de sus propios pacientes, el 60% de las frases del informe se limitaba a describir características típicas de cualquier paciente (Prince y Guastello, 1990).

    Ojo con lo importante: esto es una demostración de un sesgo, no una evaluación. No mide trauma ni ninguna otra cosa. Si el tema del trauma te está pesando, lo que corresponde no es un test de imágenes, sino una evaluación con un instrumento validado y con alguien que la interprete contigo.

    Conversar con un psicólogo

    Basado en el paradigma clásico del efecto Barnum (Forer). El texto que leíste está construido con afirmaciones de alta aceptación general, el mismo material con el que se hacen los tests virales de personalidad y de trauma.

    ¿Qué tan exactos son los tests de salud que circulan online?

    Podría pensarse que el problema son solo los tests de imágenes, y que los cuestionarios online serios sí funcionan. La evidencia obliga a ser más prudente que eso.

    Los verificadores de síntomas (esas herramientas donde ingresas lo que te pasa y te devuelven diagnósticos probables) fallan más de lo que aciertan. Una revisión sistemática publicada en npj Digital Medicine cribó 177 estudios, incluyó diez y evaluó su calidad con la herramienta QUADAS-2, con pacientes reales en la mitad de ellos. La exactitud del primer diagnóstico propuesto quedó entre 19% y 37,9%, y varió de una herramienta a otra aunque se les entregaran exactamente los mismos síntomas. La orientación sobre a qué nivel de atención acudir anduvo mejor, entre 48,8% y 90,1%. Los autores concluyen que apoyarse en estas herramientas puede implicar riesgos importantes para la seguridad del paciente (Wallace et al., 2022).

    Traducido: incluso una herramienta que te pregunta por tus síntomas reales acierta el diagnóstico principal en cerca de uno de cada tres casos, en el mejor escenario. Un test que solo te pide elegir un dibujo no está en esa liga, porque no está recogiendo ningún dato clínico.

    Entonces, ¿son puro daño?

    No, y acá conviene ser justo, porque el discurso de "no creas nada de internet" tampoco ayuda.

    El efecto Barnum en sí no es automáticamente perjudicial. En un estudio con 308 estudiantes chinos de secundaria, un mayor uso del MBTI se asoció a un efecto Barnum más fuerte, y este a su vez a mayor identidad del yo, que terminaba relacionándose con más bienestar subjetivo y menos ansiedad y depresión. Los autores lo leen como que estos cuestionarios pueden acompañar la construcción de identidad en la adolescencia (Hua y Zhou, 2023).

    Tampoco somos tan crédulos como sugiere el estereotipo. Cuando a 75 estudiantes y cadetes que habían respondido de verdad un inventario de personalidad se les entregó un perfil de puntuaciones generado al azar, rechazaron los puntajes que se alejaban mucho de los suyos reales (Andersen y Nordvik, 2002). Y cuando en lugar de preguntar "¿te describe?" se piden juicios más específicos, expertos y legos distinguen las frases genuinas de las frases Barnum (Schroeder y Lesyk, 1976).

    Hay algo más que rescatar. El autodiagnóstico que circula en redes cumple funciones que la consulta a veces no alcanza a cubrir. Un análisis de 150 videos y más de 1.400 comentarios en TikTok encontró que los contenidos de autodiagnóstico se centraban en combatir el estigma y en nombrar las barreras de acceso al sistema de salud, mientras que los de diagnóstico profesional priorizaban recursos. En los comentarios aparecían solidaridad y validación entre personas que se sentían solas con lo suyo (Ju et al., 2026).

    El riesgo está en el paso siguiente. Cuando el contenido lo difunde alguien sin formación clínica, los jóvenes se autodiagnostican a partir de ese material con frecuencia y a menudo de forma inexacta, con riesgo de identificación errónea y de tratamiento inadecuado (Rizwan y Weigle, 2025). Y no todo lo que circula es falsedad deliberada: buena parte son sobregeneralizaciones a partir de una experiencia personal real, que es un problema distinto y más difícil de detectar (Starvaggi et al., 2024).

    Un test viral es una puerta, no una respuesta. El problema empieza cuando se toma como respuesta.

    ¿Cómo es una evaluación del trauma de verdad?

    Acá está la diferencia concreta, y es más simple de lo que parece: un instrumento validado tiene ítems fijos, una regla de puntuación publicada, un punto de corte estudiado en una población conocida, y datos sobre cuánto se equivoca.

    La Escala de Impacto de Evento Revisada (IES-R) mide dos cosas que aparecen tras un hecho estresante: pensamientos intrusivos y evitación. La escala original nació en 1979 con 66 personas atendidas por síndromes de respuesta al estrés (Horowitz et al., 1979). Tiene una versión chilena adaptada y validada publicada en la Revista Médica de Chile, que es la referencia local (Caamaño et al., 2011). El punto de corte más usado es 33, establecido en dos muestras de veteranos donde la escala mostró consistencia interna muy alta y correlacionó 0,84 con otra medida de estrés postraumático (Creamer et al., 2003).

    Fíjate en lo que viene ahora, porque es lo que ningún test viral te va a dar: cuánto se equivoca. Con un corte de 34, en 3.313 personas que permanecieron en zona de conflicto y 854 refugiados, la escala alcanzó sensibilidad de 0,86 y 0,89 exigiendo especificidad mínima de 0,80. Los autores respaldan su uso como cribado y no como reemplazo de la entrevista diagnóstica (Morina et al., 2013).

    Esa distinción es el corazón del asunto. La revisión psicométrica clásica de la escala es explícita: sus propiedades son satisfactorias como medida de procesos intrusivos y evitativos, pero no como medida diagnóstica de estrés postraumático (Joseph, 2000). Ni siquiera un instrumento validado, con décadas de uso y validación chilena, se atribuye la capacidad de diagnosticar.

    Para el diagnóstico propiamente tal, el estándar sigue siendo una entrevista aplicada por un clínico. La revisión sistemática más reciente sobre exactitud diagnóstica cribó 21.197 publicaciones, incluyó 40 estudios y 24 instrumentos, y recomienda la entrevista CAPS-5 para evaluar estrés postraumático actual y a lo largo de la vida (Havermans et al., 2025).

    Si lo que te preocupa es un trauma complejo, el Cuestionario Internacional de Trauma (ITQ) evalúa estrés postraumático y estrés postraumático complejo según la CIE-11, y cuenta con validación en 275 adultos chilenos, donde sus dos dimensiones correlacionaron con el número de sucesos traumáticos, las experiencias adversas en la infancia, la ansiedad, la depresión y el riesgo suicida (Fresno et al., 2023).

    Ninguno de estos instrumentos se usa solo. Se aplican dentro de una evaluación donde alguien pregunta por tu historia, contrasta, y sostiene lo que aparezca.

    ¿Cuándo conviene consultar de verdad?

    Si llegaste hasta acá porque algo te viene pesando, esa señal vale más que cualquier resultado que te haya dado un test.

    Conviene pedir hora cuando los recuerdos se meten sin que los llames y cuesta pararlos, cuando estás evitando lugares, personas o conversaciones para no activar algo, cuando el sueño lleva semanas alterado, cuando la irritabilidad o el sobresalto se volvieron el estado de base, o cuando algo que pasó hace años sigue ordenando decisiones que tomas hoy.

    Un dato que ayuda a no minimizar. En 71 estudios longitudinales con 137.004 participantes tras desastres, la prevalencia media de problemas de salud mental fue de 22,1%, y la carga bajó tras un pico inicial para volver a subir alrededor de una década después (Dückers et al., 2026). Que el malestar haya bajado con el tiempo no garantiza que esté resuelto.

    Y la parte esperanzadora, que también tiene números. Las intervenciones psicológicas centradas en el trauma muestran efectos medios a grandes sobre los síntomas: 73 ensayos aleatorizados con 5.696 participantes, con una tasa media de finalización del tratamiento de 71,8% (Leithner et al., 2026). Esto se trata.

    Si aparecen ideas de hacerte daño, no esperes a ninguna evaluación. En Chile, Salud Responde atiende al 600 360 7777, las 24 horas.

    Preguntas frecuentes

    ¿El test del ajolote de BetterMe es confiable?

    No como evaluación clínica. Es un cuestionario comercial de una app de bienestar, sin validación publicada, sin puntos de corte estudiados y sin población de referencia conocida. Puede servir para ordenar ideas o para animarte a consultar, pero su resultado no equivale a un diagnóstico ni a un cribado de trauma.

    ¿Los tests de trauma de elegir una imagen tienen alguna base científica?

    Ninguna. Elegir una figura abstracta no aporta información sobre tu historia, así que el test no tiene de dónde sacar una conclusión. Lo que produce la sensación de acierto es el efecto Barnum: descripciones tan generales que le calzan a casi cualquier persona, leídas como si fueran personales.

    ¿Existe algún test de trauma gratis que sí sirva?

    Sí, existen instrumentos validados como la IES-R (con versión chilena) y el ITQ, usados como cribado, no como diagnóstico. La diferencia no está en el precio sino en tener ítems fijos, puntuación publicada y datos sobre cuánto se equivocan. Lo correcto es aplicarlos dentro de una evaluación profesional.

    ¿Puedo autodiagnosticarme un trauma por internet?

    No de forma fiable. Incluso las herramientas online que sí preguntan por síntomas reales aciertan el diagnóstico principal entre un 19% y un 37,9% de las veces (Wallace et al., 2022). El diagnóstico de estrés postraumático requiere entrevista clínica, y el estándar actual es la CAPS-5 aplicada por un profesional.

    Si el test viral me dio un resultado que me dejó mal, ¿qué hago?

    Toma en serio el malestar y no el resultado. Que un test sin validez te haya movido algo suele indicar que el tema ya estaba ahí antes del test. Eso sí merece atención profesional, y una evaluación seria puede darte una respuesta que el test nunca iba a poder darte.

    Para cerrar

    Los tests virales aciertan porque están escritos para no fallar, no porque te conozcan. Eso no los vuelve inofensivos ni inútiles: pueden ser la primera vez que alguien le pone palabras a algo que venía cargando, y esa puerta tiene valor.

    Lo que no pueden hacer es responder la pregunta que te trajo hasta acá. Para eso hacen falta instrumentos con puntuación publicada, alguien que sepa interpretarlos y una conversación donde tu historia entre completa, no en cuatro garabatos.

    Si algo de lo que leíste te resonó más de la cuenta, esa es la señal a la que vale la pena hacerle caso. Agenda una primera sesión y lo revisamos con calma, con las herramientas que sí están hechas para eso.

    Referencias

    Andersen, P., & Nordvik, H. (2002). Possible Barnum effect in the five factor model: Do respondents accept random NEO Personality Inventory-Revised scores as their actual trait profile? Psychological Reports, 90(2), 539-545. https://doi.org/10.2466/pr0.2002.90.2.539

    Caamaño, W. L., Fuentes, M. D., González, B. L., Melipillán, A. R., Sepúlveda, C. M., & Valenzuela, G. E. (2011). Adaptación y validación de la versión chilena de la Escala de Impacto de Evento-Revisada (EIE-R). Revista Médica de Chile, 139(9), 1163-1168. https://doi.org/10.4067/s0034-98872011000900008

    Creamer, M., Bell, R., & Failla, S. (2003). Psychometric properties of the Impact of Event Scale-Revised. Behaviour Research and Therapy, 41(12), 1489-1496. https://doi.org/10.1016/j.brat.2003.07.010

    Dückers, M. L. A., Stroebe, M. S., Baliatsas, C., Spreeuwenberg, P., Brüning, A., & Stroebe, K. E. (2026). The long-term mental health impact of disasters: A systematic review and multilevel meta-analysis of longitudinal epidemiological studies. Harvard Review of Psychiatry, 34(2), 59-72. https://doi.org/10.1097/hrp.0000000000000450

    Fresno, A., Ramos Alvarado, N., Núñez, D., Ulloa, J. L., Arriagada, J., Cloitre, M., & Karatzias, T. (2023). Initial validation of the International Trauma Questionnaire (ITQ) in a sample of Chilean adults. European Journal of Psychotraumatology, 14(2), 2263313. https://doi.org/10.1080/20008066.2023.2263313

    Havermans, D. C. D., Coeur, E. M. N., Jiaqing, O., Rippey, C. S., Cook, J. M., Olff, M., & Lawrence, K. A. (2025). The diagnostic accuracy of PTSD assessment instruments used in older adults: A systematic review. European Journal of Psychotraumatology, 16(1), 2498191. https://doi.org/10.1080/20008066.2025.2498191

    Horowitz, M., Wilner, N., & Alvarez, W. (1979). Impact of Event Scale: A measure of subjective stress. Psychosomatic Medicine, 41(3), 209-218. https://doi.org/10.1097/00006842-197905000-00004

    Hua, J., & Zhou, Y. X. (2023). Personality assessment usage and mental health among Chinese adolescents: A sequential mediation model of the Barnum effect and ego identity. Frontiers in Psychology, 14, 1097068. https://doi.org/10.3389/fpsyg.2023.1097068

    Joseph, S. (2000). Psychometric evaluation of Horowitz's Impact of Event Scale: A review. Journal of Traumatic Stress, 13(1), 101-113. https://doi.org/10.1023/a:1007777032063

    Ju, R., Field-Springer, K., Liu, Z., & Chandler, E. (2026). #MentalHealthDiagnosis and self-diagnosis: Harmful or helpful on TikTok. Health Communication, 1-12. https://doi.org/10.1080/10410236.2026.2652419

    Leithner, C., Schreyer, B., Däumling, S., Semmlinger, V., & Ehring, T. (2026). The role of dosage and intensity in trauma-focused treatments for posttraumatic stress disorder: A meta-analysis. Clinical Psychology Review, 125, 102720. https://doi.org/10.1016/j.cpr.2026.102720

    Mason, O. J., & Budge, K. (2011). Schizotypy, self-referential thinking and the Barnum effect. Journal of Behavior Therapy and Experimental Psychiatry, 42(2), 145-148. https://doi.org/10.1016/j.jbtep.2010.11.003

    Morina, N., Ehring, T., & Priebe, S. (2013). Diagnostic utility of the Impact of Event Scale-Revised in two samples of survivors of war. PLoS ONE, 8(12), e83916. https://doi.org/10.1371/journal.pone.0083916

    Prince, R. J., & Guastello, S. J. (1990). The Barnum effect in a computerized Rorschach interpretation system. The Journal of Psychology, 124(2), 217-222. https://doi.org/10.1080/00223980.1990.10543218

    Rizwan, B., & Weigle, P. E. (2025). Paging Dr. Influencer: Social media and psychiatric self-diagnosis. Pediatric Clinics of North America, 72(2), 267-278. https://doi.org/10.1016/j.pcl.2024.09.003

    Schroeder, H. E., & Lesyk, C. K. (1976). Judging personality assessments: Putting the Barnum report in perspective. Journal of Personality Assessment, 40(5), 470-474. https://doi.org/10.1207/s15327752jpa4005_4

    Snyder, C. R., & Newburg, C. L. (1981). The Barnum effect in a group setting. Journal of Personality Assessment, 45(6), 622-629. https://doi.org/10.1207/s15327752jpa4506_10

    Starvaggi, I., Dierckman, C., & Lorenzo-Luaces, L. (2024). Mental health misinformation on social media: Review and future directions. Current Opinion in Psychology, 56, 101738. https://doi.org/10.1016/j.copsyc.2023.101738

    Wallace, W., Chan, C., Chidambaram, S., Hanna, L., Iqbal, F. M., Acharya, A., & Darzi, A. (2022). The diagnostic and triage accuracy of digital and online symptom checker tools: A systematic review. npj Digital Medicine, 5, 118. https://doi.org/10.1038/s41746-022-00667-w

    Nicolás Alcayaga, Psicólogo Clínico

    Sobre el autor

    Nicolás Alcayaga

    Psicólogo Clínico. Especializado en Terapia Cognitivo-Conductual (TCC).

    Su experiencia clínica incluye el tratamiento de adicciones y la atención de pacientes en el sistema público y privado de salud en Chile. En este blog revisa la evidencia científica disponible sobre cada tema; cada artículo es un trabajo en curso que se actualiza a medida que surge nueva evidencia.

    Psicólogo inscrito en el Registro Nacional de Prestadores Individuales de Salud (Superintendencia de Salud)