<?xml version="1.0" encoding="UTF-8"?><?xml-model type="application/xml-dtd" href="http://jats.nlm.nih.gov/publishing/1.1d3/JATS-journalpublishing1.dtd"?>
<!DOCTYPE article PUBLIC "-//NLM//DTD JATS (Z39.96) Journal Publishing DTD v1.1d3 20150301//EN" "http://jats.nlm.nih.gov/publishing/1.1d3/JATS-journalpublishing1.dtd">
<article xmlns:ali="http://www.niso.org/schemas/ali/1.0" xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xmlns:xlink="http://www.w3.org/1999/xlink" xmlns:mml="http://www.w3.org/1998/Math/MathML" dtd-version="1.1d3" specific-use="Marcalyc 1.2" article-type="research-article" xml:lang="es">
<front>
<journal-meta>
<journal-id journal-id-type="redalyc">647</journal-id>
<journal-title-group>
<journal-title specific-use="original" xml:lang="es">Universitas Psychologica</journal-title>
<abbrev-journal-title abbrev-type="publisher" xml:lang="es">Univ. Psychol.</abbrev-journal-title>
</journal-title-group>
<issn pub-type="ppub">1657-9267</issn>
<issn pub-type="epub">2011-2777</issn>
<publisher>
<publisher-name>Pontificia Universidad Javeriana</publisher-name>
<publisher-loc>
<country>Colombia</country>
<email>revistascientificasjaveriana@gmail.com</email>
</publisher-loc>
</publisher>
</journal-meta>
<article-meta>
<article-id pub-id-type="art-access-id" specific-use="redalyc">64752604005</article-id>
<article-id pub-id-type="doi">http://dx.doi.org/10.11144/Javeriana.upsy16-3.fvcp</article-id>
<article-categories>
<subj-group subj-group-type="heading">
<subject>Sin sección</subject>
</subj-group>
</article-categories>
<title-group>
<article-title xml:lang="es">Falacias sobre el valor <italic>p</italic> compartidas por profesores y estudiantes universitarios<xref ref-type="fn" rid="fn2">*</xref>
</article-title>
<trans-title-group>
<trans-title xml:lang="en">Fallacies about <italic>p</italic>-Value
Shared by Professors and University Students</trans-title>
</trans-title-group>
</title-group>
<contrib-group>
<contrib contrib-type="author" corresp="yes">
<contrib-id contrib-id-type="ORCID">http://orcid.org/0000-0002-4706-690X</contrib-id>
<name name-style="western">
<surname>Badenes-Ribera</surname>
<given-names>Laura</given-names>
</name>
<xref ref-type="corresp" rid="corresp1"/>
<xref ref-type="aff" rid="aff1"/>
<email>Laura.badenes@uv.es</email>
</contrib>
<contrib contrib-type="author" corresp="no">
<name name-style="western">
<surname>Frias
Navarro</surname>
<given-names>Maria Dolores</given-names>
</name>
<xref ref-type="aff" rid="aff2"/>
</contrib>
</contrib-group>
<aff id="aff1">
<institution content-type="original">Universitat de València, España</institution>
<institution content-type="orgname">Universitat de València</institution>
<country country="es">España</country>
</aff>
<aff id="aff2">
<institution content-type="original">Universitat de València, España</institution>
<institution content-type="orgname">Universitat de València</institution>
<country country="es">España</country>
</aff>
<author-notes>
<corresp id="corresp1">
<email>Autor de
correspondencia: Correo electrónico: Laura.badenes@uv.es</email>
</corresp>
</author-notes>
<pub-date pub-type="epub-ppub">
<year>2017</year>
</pub-date>
<volume>16</volume>
<issue>3</issue>
<history>
<date date-type="received" publication-format="dd mes yyyy">
<day>19</day>
<month>06</month>
<year>2016</year>
</date>
<date date-type="accepted" publication-format="dd mes yyyy">
<day>08</day>
<month>02</month>
<year>2017</year>
</date>
</history>
<permissions>
<copyright-year>no</copyright-year>
<ali:free_to_read/>
<license xlink:href="https://creativecommons.org/licenses/by/4.0/">
<ali:license_ref>https://creativecommons.org/licenses/by/4.0/</ali:license_ref>
<license-p>Esta obra está bajo una Licencia Creative Commons Atribución 4.0 Internacional.</license-p>
</license>
</permissions>
<abstract xml:lang="es">
<title>Resumen</title>
<p> La “Práctica Basada en la Evidencia” requiere a los profesionales valorar de forma crítica los resultados de las investigaciones psicológicas. Sin embargo, las interpretaciones incorrectas de los valores <italic>p</italic> de probabilidad son abundantes y repetitivas. Estas interpretaciones incorrectas pueden afectar las decisiones profesionales y poner en riesgo la calidad de las intervenciones y la acumulación de un conocimiento científico válido. Por lo tanto, identificar el tipo de falacia que subyace a las decisiones estadísticas es fundamental para abordar y planificar estrategias de educación estadística dirigidas a intervenir sobre las interpretaciones incorrectas. En consecuencia, el objetivo de este estudio es analizar la interpretación del valor <italic>p</italic> en estudiantes y profesores universitarios de psicología. La muestra estuvo formada por 161 participantes (43 profesores y 118 estudiantes). La antigüedad media como profesor fue de 16.7 años (<italic>DE</italic> = 10.07). La edad media de los estudiantes fue de 21.59 (<italic>DE</italic> = 1.3). Los hallazgos sugieren que los estudiantes y profesores universitarios no conocen la interpretación correcta del valor <italic>p</italic>. La falacia de la probabilidad inversa presentó mayores problemas de comprensión. Además, se confundieron la significación estadística y la significación práctica o clínica. Estos resultados destacan la necesidad de la educación estadística y reeducación estadística.</p>
</abstract>
<trans-abstract xml:lang="en">
<title>Abstract</title>
<p> The "Evidence Based Practice" requires professionals to critically assess the results of psychological research. However, incorrect interpretations of <italic>p</italic> values of probability are abundant and repetitive. These misconceptions may affect professional decisions and compromise the quality of interventions and the accumulation of a valid scientific knowledge. Therefore, identifying the types of fallacies that underlying statistical decisions is fundamental for approaching and planning statistical education strategies designed to intervene in incorrect interpretations. Consequently, the aim of this study is to analyze the interpretation of <italic>p</italic> value among university students of psychology and academic psychologists. The sample was composed of 161 participants (43 academics and 118 students). The mean number of years as academic was 16.7 (<italic>SD</italic> = 10.07). The mean age of university students was 21.59 years (<italic>SD</italic> = 1.3). The findings suggest that college students and academics do not know the correct interpretation of <italic>p</italic> values. The inverse probability fallacy presented major problems of comprehension. In addition, the participants confused statistical significance and practical significance or clinical or the findings. There is a need for statistical education and statistical re-education.</p>
</trans-abstract>
<kwd-group xml:lang="es">
<title>Palabras clave</title>
<kwd>practica basada en la evidencia</kwd>
<kwd> interpretación errónea</kwd>
<kwd> valores p</kwd>
<kwd> tamaño del efecto</kwd>
<kwd> educación estadística</kwd>
</kwd-group>
<kwd-group xml:lang="en">
<title>Keywords</title>
<kwd>evidence-based practice</kwd>
<kwd>
misconception</kwd>
<kwd> p value</kwd>
<kwd> statistical education</kwd>
</kwd-group>
<funding-group>
<award-group award-type="contract">
<funding-source>Conselleria d'Educació, Cultura i Esport,
Generalitat Valenciana (España)</funding-source>
<award-id>ACIF/2013/167</award-id>
</award-group>
<award-group award-type="grant">
<funding-source>Ministerio
de Economía y Competitividad (I + D + i) (España)</funding-source>
<award-id>EDU2011-22862</award-id>
</award-group>
</funding-group>
<counts>
<fig-count count="0"/>
<table-count count="1"/>
<equation-count count="0"/>
<ref-count count="57"/>
</counts>
<custom-meta-group>
<custom-meta>
<meta-name>Para citar este artículo</meta-name>
<meta-value>Bardenes-Ribera, L., &amp; Frías Navarro, M. D. (2017). Falacias sobre el valor p
compartidas por profesores y estudiantes universitarios. <italic>Universitas Psychologica</italic>, <italic>16</italic>(3), xx-xx.  <ext-link ext-link-type="uri" xlink:href="https://doi.org/10.11144/Javeriana.upsy16-3.fvcp">https://doi.org/10.11144/Javeriana.upsy16-3.fvcp</ext-link> </meta-value>
</custom-meta>
</custom-meta-group>
</article-meta>
</front>
<body>
		
		<sec>
            <title>Introducción</title>
			
		<p> La Práctica Basada en la Evidencia (PBE) se define como “la integración de la mejor evidencia disponible con la experiencia clínica en el contexto de las características, cultura y preferencias del paciente” (<xref ref-type="bibr" rid="redalyc_64752604005_ref2">American Psychological Association [APA], 2006, p. 273</xref>). Por definición, la PBE se basa en la utilización de la investigación científica en la toma de decisiones en un esfuerzo por producir los mejores servicios posibles en la práctica clínica (<xref ref-type="bibr" rid="redalyc_64752604005_ref1">APA, 2005</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref4">Babione, 2010</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref15">Daset &amp; Cracco, 2013</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref18">Frias-Navarro &amp; Pascual-Llobell, 2003</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref47">Sánchez-Meca, Boruch, Petrosino, &amp; Rosa-Alcázar, 2002</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref54">Vázquez &amp; Nieto, 2003</xref>). Por tanto, el enfoque de la PBE requiere de los profesionales nuevas habilidades como la capacidad para evaluar y jerarquizar la calidad de las investigaciones psicológicas (<xref ref-type="bibr" rid="redalyc_64752604005_ref10">Beyth-Maron, Fidler, &amp; Cumming, 2008</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref43">Pascual-Llobell, Frias-Navarro, &amp; Monterde-i-Bort, 2004</xref>).  </p>
<p> Dentro de ese proceso de valoración crítica de la evidencia científica es crucial conocer y comprender el proceso de contraste de hipótesis estadísticas mediante la ejecución de la prueba de significación de la hipótesis nula (Null Hypothesis Significance Testing [NHST]), sobre todo teniendo en cuenta que en el ámbito de la psicología el procedimiento de la NHST es la técnica por excelencia en el análisis de datos (<xref ref-type="bibr" rid="redalyc_64752604005_ref14">Cumming et al., 2007</xref>). Por tanto, saber interpretar los valores <italic>p</italic> de probabilidad es una competencia básica del profesional de la psicología y de todas aquellas disciplinas donde se aplica la inferencia estadística.  </p>
<p> Sin embargo, el procedimiento de la NHST ha sido criticado desde el principio de su aplicación en psicología y otras ciencias (<xref ref-type="bibr" rid="redalyc_64752604005_ref9">Berkson, 1938</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref12">Cohen, 1994</xref>). Una de las cuestiones que más controversia ha provocado es la interpretación correcta del valor <italic>p</italic> asociado al resultado de la prueba estadística (<xref ref-type="bibr" rid="redalyc_64752604005_ref19">Frias-Navarro, Pascual-Soler, Badenes-Ribera, &amp; Monterde-i-Bort, 2014</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref56">Wasserstein &amp; Lazar, 2016</xref>). </p>
<p> El valor <italic>p</italic> es la probabilidad del resultado observado o un valor más extremo si la hipótesis nula es cierta (<xref ref-type="bibr" rid="redalyc_64752604005_ref26">Hubbard &amp; Lindsay, 2008</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref28">Johnson, 1999</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref32">Kline, 2013</xref>). La definición es clara y precisa, sin embargo, las interpretaciones incorrectas siguen siendo abundantes y repetitivas (<xref ref-type="bibr" rid="redalyc_64752604005_ref6">Badenes-Ribera, Frias-Navarro, Monterde-i-Bort, &amp; Pascual-Soler, 2015</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref44">Perezgonzalez, 2015a</xref>, <xref ref-type="bibr" rid="redalyc_64752604005_ref45">2015b</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref55">Verdam, Oort, &amp; Sprangers, 2014</xref>).  </p>
<p> Las cuatro interpretaciones erróneas del valor <italic>p</italic> más comunes son: (1) Falacia de la probabilidad inversa; (2) Falacia de la probabilidad contra el azar; (3) Falacia del tamaño del efecto y (4) Falacia de la significación clínica o práctica (<xref ref-type="bibr" rid="redalyc_64752604005_ref6">Badenes-Ribera et al., 2015</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref7">Balluerka, Gómez, &amp; Hidalgo, 2005</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref12">Cohen, 1994</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref13">Cumming, 2012</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref16">Falk &amp; Greenbaum, 1995</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref32">Kline, 2013</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref40">Nickerson, 2000</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref50">Téllez, García, &amp; Corral-Verdugo, 2015</xref>). </p>
<p> La falacia de la “probabilidad inversa” es la falsa creencia de que el valor p hace referencia a la probabilidad de que la hipótesis nula (H<sub>0</sub>) sea verdadera dados ciertos datos [Pr(H<sub>0</sub>|Datos)]. Por su parte, la “falacia de las probabilidades contra el azar” señala que el valor <italic>p</italic> es la probabilidad de obtener el resultado por azar o la probabilidad de que el resultado ocurra como consecuencia del proceso de la selección de la muestra. Ambas están relacionadas con el mismo problema: confundir la probabilidad del resultado, asumiendo que la hipótesis nula es cierta [Pr(Datos|H<sub>0</sub>)], con la probabilidad de la hipótesis nula, dados ciertos datos [Pr(H<sub>0</sub>|Datos)]. Las pruebas de significación estadística no ofrecen información de la probabilidad condicional de la hipótesis nula dados los datos obtenidos en la investigación (<xref ref-type="bibr" rid="redalyc_64752604005_ref30">Kirk, 1996</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref49">Shaver, 1993</xref>). </p>
<p> La “falacia del tamaño del efecto” vincula la significación estadística con la magnitud del efecto (<xref ref-type="bibr" rid="redalyc_64752604005_ref22">Gliner, Vaske, &amp; Morgan, 2001</xref>). De este modo, los valores pequeños de <italic>p</italic> son interpretados como efectos grandes (<xref ref-type="bibr" rid="redalyc_64752604005_ref32">Kline, 2013</xref>). Sin embargo, el valor <italic>p</italic> no informa de la magnitud de un efecto (<xref ref-type="bibr" rid="redalyc_64752604005_ref13">Cumming, 2012</xref>). El tamaño del efecto solo puede ser conocido estimando directamente su valor con el estadístico adecuado y su intervalo de confianza (<xref ref-type="bibr" rid="redalyc_64752604005_ref22">Gliner et al., 2001</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref56">Wasserstein &amp; Lazar, 2016</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref57">Wilkinson, 1999</xref>).  </p>
<p> La “falacia de la significación clínica o práctica” asocia el valor <italic>p</italic> con la importancia práctica o clínica de un hallazgo. Sin embargo, un resultado estadísticamente significativo no indica que sea un resultado importante desde el punto de vista clínico, práctico o sustantivo y viceversa (<xref ref-type="bibr" rid="redalyc_64752604005_ref21">Gliner, Leech, &amp; Morgan, 2002</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref30">Kirk, 1996</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref42">Palmer &amp; Sesé, 2013</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref56">Wasserstein &amp; Lazar, 2016</xref>). Bajo esta falsa creencia es posible que efectos sin significación estadística pero con significación clínica o importancia práctica sean rechazados. Y, al contrario, efectos con significación estadística y poca significación clínica o importancia práctica se tomen como significativos o importantes (<xref ref-type="bibr" rid="redalyc_64752604005_ref17">Frias-Navarro, 2011</xref>). </p>
<p> Detrás de estas interpretaciones erróneas hay unas creencias y atribuciones sobre el significado de los resultados. Por ello, es necesario comprender el razonamiento estadístico o la forma de razonar con ideas estadísticas y dar sentido a la información estadística que realizan las personas (<xref ref-type="bibr" rid="redalyc_64752604005_ref20">Garfield, 2002</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref35">Leek, 2014</xref>). </p>
<p> Estudios previos han detectado la presencia de este tipo de falacias sobre el valor <italic>p</italic> de probabilidad en muestras de profesores y estudiantes universitarios de distintas disciplinas (p. ej., <xref ref-type="bibr" rid="redalyc_64752604005_ref11">Castro-Sotos, Vanhoof, Van den Noortgate, &amp; Onghena, 2009</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref16">Falk &amp; Greenbaum, 1995</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref19">Frias-Navarro et al., 2014</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref24">Haller &amp; Kraus, 2002</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref38">Monterde-i-Bort, Frias-Navarro, &amp; Pascual-Llobel 2010</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref41">Oakes, 1986</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref52">Vallecillos, 2002</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref53">Vallecillos &amp; Batanero, 1997</xref>). Por ejemplo, en el ámbito de la psicología, <xref ref-type="bibr" rid="redalyc_64752604005_ref41">Oakes (1986)</xref> encontró que el 97 % de los profesores universitarios interpretaron de forma incorrecta el significado del valor <italic>p</italic>. <xref ref-type="bibr" rid="redalyc_64752604005_ref24">Haller y Kraus (2002)</xref> replicaron el estudio de <xref ref-type="bibr" rid="redalyc_64752604005_ref41">Oakes (1986)</xref> en una muestra de profesores y estudiantes universitarios. Sus resultados revelaron que el 80 % de profesores de Metodología, el 89.7 % de profesores que no enseñaban metodología y el 100 % de los estudiantes cometieron algún tipo de error de interpretación del valor <italic>p</italic>. Finalmente, en los recientes estudios de <xref ref-type="bibr" rid="redalyc_64752604005_ref6">Badenes-Ribera et al. (2015)</xref> y <xref ref-type="bibr" rid="redalyc_64752604005_ref5">Badenes-Ribera, Frias-Navarro, Iotti, Bonilla-Campos y Longobardi (2016)</xref>, en sendas muestras de profesores universitarios, se observó que muchos de ellos, incluidos los profesores del área de Metodología, no sabían interpretar correctamente los valores de <italic>p</italic> asociados a los resultados de las pruebas de inferencia estadística. En ambos estudios, la “falacia de la probabilidad inversa” presentó los mayores problemas de comprensión. Además, el 35.2 % de los profesores cometieron la “falacia de la significación clínica o práctica” de los resultados, es decir, confundieron la significación estadística de los resultados con la significación clínica o práctica de los mismos (<xref ref-type="bibr" rid="redalyc_64752604005_ref6">Badenes-Ribera et al., 2015</xref>). </p>
<p> El objetivo de la presente investigación es detectar los errores de razonamiento estadístico que estudiantes y profesores universitarios realizan ante los resultados que aporta una prueba de inferencia estadística, pues su visión e interpretación de los hallazgos son un filtro de calidad en su vida profesional que no puede estar sometido a falsas creencias del procedimiento estadístico que representa la herramienta fundamental para obtener conocimiento científico. La competencia de la ‘lectura crítica’ dentro del modelo de la PBE requiere conocer e interpretar adecuadamente la calidad metodológica de las pruebas o evidencias aportadas por la literatura. Del mismo modo, los investigadores deben producir evidencia o pruebas empíricas correctamente interpretadas no confundiendo el alcance de sus resultados. En consecuencia, identificar el tipo de falacia que subyace a las decisiones estadísticas es fundamental para abordar y planificar estrategias de educación estadística dirigidas a intervenir sobre las interpretaciones incorrectas.</p>
</sec>
	<sec>
<title>Método</title>
<sec>
<title>Muestra</title>
<p>Se
utilizó una muestra no probabilística (conveniencia). La muestra estuvo formada
por 161 participantes de la Universidad de Valencia. De ellos, el 26.7 % (<italic>n</italic> = 43) fueron profesores (<italic>n</italic> = 43) y el 73.3 %, estudiantes de
cuarto curso del grado de psicología que ya habían cursado las asignaturas de Estadística
y Psicometría (<italic>n</italic> = 118). El 39.5 %
de los profesores fueron hombres (<italic>n</italic> =
17) y el 60.5 % mujeres (<italic>n</italic> = 26). La
antigüedad media como profesor fue de 16.7 años (<italic>DE</italic> = 10.07). Respecto de la muestra de estudiantes, el 19.5 % fueron
hombres (<italic>n</italic> = 23), el 78.8 % fueron
mujeres (<italic>n</italic> = 93) y el 1.7 % no
indicó su sexo (<italic>n</italic> = 2) con una edad
media de 21.59 (<italic>DE</italic> = 1.3).</p>
</sec>
</sec>
<sec>
<title>Instrumento</title>
<p> En la primera sección de la encuesta se recogió información sobre variables sociodemográficas: sexo, edad (estudiantes universitarios), antigüedad como profesor en la universidad.  </p>
<p> La segunda sección incluyó la encuesta sobre interpretaciones del valor <italic>p</italic> de <xref ref-type="bibr" rid="redalyc_64752604005_ref6">Badenes-Ribera et al. (2015)</xref>. Este instrumento está compuesto por 10 ítems con una escala de respuesta dicotómica (verdadero o falso) pensados para detectar interpretaciones erróneas sobre el valor <italic>p</italic> de probabilidad asociadas a las pruebas de inferencia estadística y su interpretación correcta. En el presente estudio, se utilizaron los ítems referentes a falacia de la probabilidad inversa (5 ítems), falacia del tamaño del efecto (1 ítem), falacia de la significación clínica o práctica (1 ítem) y, finalmente, interpretaciones correctas del valor <italic>p</italic> del procedimiento de contraste de hipótesis (2 ítems). Las cuestiones se plantearon con el siguiente argumento:  </p>
<p> “Supongamos que un artículo de investigación señala un valor de <italic>p</italic> = 0.001 en el apartado de resultados (alfa = 0.05). Señale si las siguientes afirmaciones son verdaderas o falsas”. </p>
<p>
<bold> A.-Falacia de la Probabilidad inversa</bold>: </p>
<p> 1. Se ha probado que la hipótesis nula es verdadera. </p>
<p> 2. Se ha probado que la hipótesis nula es falsa. </p>
<p> 3. Se ha determinado la probabilidad de la hipótesis nula (<italic>p</italic> = 0.001). </p>
<p> 4. Se ha deducido la probabilidad de la hipótesis experimental (<italic>p</italic> = 0.001). </p>
<p> 5. La probabilidad de que la hipótesis nula sea verdadera, dados los datos obtenidos, es de 0.001. </p>
<p>
<bold> B.-Falacia del tamaño del efecto</bold>: </p>
<p> 6. El valor <italic>p</italic> = 0.001 confirma de forma directa que el tamaño del efecto ha sido grande. </p>
<p>
<bold> C.- Falacia de la significación clínica o práctica:</bold>
</p>
<p> 7. Obtener un resultado estadísticamente significativo indica que el efecto detectado es importante. </p>
<p>
<bold> D.- Interpretación correcta y decisión adoptada</bold>: </p>
<p> 8. Se conoce la probabilidad del resultado de la prueba estadística, asumiendo que la hipótesis nula es cierta. </p>
<p> 9. Dado que <italic>p</italic> = 0.001 entonces el resultado obtenido permite concluir que las diferencias no se deben al azar.</p>
<sec>
<title>Procedimiento</title>
<p> La participación en el estudio fue voluntaria y completamente anónima. Los estudiantes respondieron a la encuesta en horas de clase y no recibieron ninguna compensación por ello. Por su parte, los profesores cumplimentaron las preguntas a través de internet, mediante encuesta online. Para ello, se registraron las direcciones de correo electrónico de los profesores y se les envió un mensaje invitándolos a participar en el estudio sobre cognición y práctica estadística.</p>
<p> En la realización del presente estudio, se siguieron los valores éticos requeridos en la investigación con seres humanos, respetando los principios fundamentales incluidos en la Declaración de Helsinki, en sus actualizaciones y normativas vigentes (consentimiento informado y derecho a la información, protección de datos personales y garantías de confidencialidad, no discriminación y posibilidad de abandonar el estudio en cualquiera de sus fases).</p>
</sec>
<sec>
<title>Análisis de datos</title>
<p>Se utilizó el programa
estadístico IBM SPSS v. 20 para Windows. Se analizaron las frecuencias y porcentajes
de respuestas a los ítems. Además, los análisis
incluyeron la estimación del intervalo de confianza para los porcentajes. Para el cálculo de los
intervalos de confianza de los porcentajes se utilizó el método score de Wilson
(<xref ref-type="bibr" rid="redalyc_64752604005_ref39">Newcombe, 2012</xref>).</p>
</sec>
</sec>
<sec>
<title>Resultados</title>
<p>La
<xref ref-type="table" rid="gt1">Tabla 1</xref> muestra el porcentaje de participantes que estuvieron de acuerdo con las
afirmaciones sobre el valor <italic>p</italic> de
probabilidad.</p>
<p>
<table-wrap id="gt1">
<label>TABLA 1</label>
<caption>
<title>Porcentaje de participantes que
están de acuerdo con las afirmaciones (intervalo de confianza 95 %)</title>
</caption>
<alt-text>TABLA 1 Porcentaje de participantes que
están de acuerdo con las afirmaciones (intervalo de confianza 95 %)</alt-text>
<graphic xlink:href="64752604005_gt1.jpg" position="anchor" orientation="portrait"/>
<attrib>Fuente: elaboración propia.</attrib>
</table-wrap>
</p>
<p> Respecto de la falacia de la probabilidad inversa, se observa que gran parte de los participantes percibieron como verdadera alguna de las cinco interpretaciones erróneas del valor <italic>p</italic>. Las interpretaciones que mayor respaldo recibieron tanto por parte de los estudiantes como de los profesores fueron “se ha probado que la hipótesis nula es falsa” y “se ha determinado la probabilidad de la hipótesis nula (<italic>p</italic> = 0.001)”. Además, ninguno de los profesores valoró correctamente las cinco afirmaciones sobre las interpretaciones del valor <italic>p</italic>, frente al 3.39 % (IC 95% [1.33, 8.39]) de los estudiantes que sí que lo hicieron. </p>
<p> Respecto de las interpretaciones erróneas del valor <italic>p</italic> relacionadas con la falacia del tamaño del efecto y la falacia de la significación clínica o práctica de los hallazgos, se observa que la mayoría de los participantes, tanto en los estudiantes como en los profesores, valoraron correctamente estas afirmaciones, es decir, no cometieron este tipo de interpretaciones erróneas. Además, en ambas muestras, la afirmación falsa (o interpretación errónea) que mayor respaldo recibió fue “obtener un resultado estadísticamente significativo indica que el efecto detectado es importante”. En consecuencia, los participantes presentaron mayores problemas en discernir entre la significación estadística de los resultados obtenidos y la significación práctica o clínica de los mismos. </p>
<p> Finalmente, respecto de las interpretaciones correctas del valor <italic>p</italic> de probabilidad, se observa un patrón distinto entre los profesores y los estudiantes en la comprensión del valor <italic>p</italic> de probabilidad. Mientras que los profesores presentaron mayores problemas con la interpretación probabilística del valor <italic>p</italic> mejorando notablemente su interpretación cuando se hace en términos de decisión estadística. Los estudiantes presentaron mayores problemas de comprensión con la interpretación estadística del valor <italic>p</italic>, mejorando su interpretación cuando la misma se hace en términos de probabilidad. Si bien en el caso de los estudiantes, la diferencia entre ambas interpretaciones no es estadísticamente significativa puesto que existe un solapamiento entre los intervalos de confianza de los porcentajes. Finalmente, solo un pequeño porcentaje de participantes en ambas muestras valoraron correctamente las dos afirmaciones como verdaderas, sobre todo en el caso de los profesores universitarios.</p>
</sec>
<sec>
<title>Discusión</title>
<p> Los resultados del estudio indican que la comprensión e interpretación de los valores <italic>p</italic> de las pruebas de inferencia estadística sigue siendo problemática entre los estudiantes universitarios y los profesores universitarios. Confundir el nivel de significación de alfa con la probabilidad de que la hipótesis nula sea cierta, interpretar un resultado estadísticamente significativo como un resultado importante o útil son interpretaciones erróneas o falsas creencias que continúan existiendo entre estudiantes y profesores universitarios de psicología (<xref ref-type="bibr" rid="redalyc_64752604005_ref16">Falk &amp; Greenbaum 1995</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref24">Haller &amp; Kraus, 2002</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref33">Kühberger, Fritz, Lermer, &amp; Scherndl, 2015</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref41">Oakes, 1986</xref>). </p>
<p> Estos resultados son consistentes con estudios previos en muestras de estudiantes universitarios (p. ej., <xref ref-type="bibr" rid="redalyc_64752604005_ref11">Castro-Sotos et al., 2009</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref16">Falk &amp; Greenbaum, 1995</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref24">Haller &amp; Kraus, 2002</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref33">Kühberger et al., 2015</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref52">Vallecillos, 2002</xref>, <xref ref-type="bibr" rid="redalyc_64752604005_ref53">Vallecillos &amp; Batanero, 1997</xref>) en muestras de profesores universitarios de psicología (p. ej., <xref ref-type="bibr" rid="redalyc_64752604005_ref6">Badenes-Ribera et al., 2015</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref5">Badenes-Ribera et al., 2016</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref24">Haller &amp; Kraus, 2002</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref38">Monterde-i-Bort et al., 2010</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref41">Oakes, 1986</xref>), en muestras de miembros de la American Educational Research Association (AERA) (p. ej., <xref ref-type="bibr" rid="redalyc_64752604005_ref37">Mittag &amp; Thompson, 2000</xref>) y en profesionales de la Estadística (<xref ref-type="bibr" rid="redalyc_64752604005_ref34">Lecoutre, Poitevineau, &amp; Lecoutre, 2003</xref>). </p>
<p> La “falacia de la probabilidad inversa” es la que se observó con mayor frecuencia. Además, un gran número de estudiantes universitarios y profesores de psicología confundieron la significación estadística de los resultados obtenidos con la significación práctica de los mismos. Sin embargo, el valor <italic>p</italic> no ofrece información de la magnitud del efecto o importancia del resultado (<xref ref-type="bibr" rid="redalyc_64752604005_ref21">Gliner et al., 2002</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref46">Rosenthal, 1993</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref49">Shaver, 1993</xref>). La significación clínica o sustantiva no se corresponde con el valor de ningún estadístico, ni del resultado de la prueba de inferencia estadística (valor <italic>p</italic>) ni de la magnitud del tamaño del efecto (<xref ref-type="bibr" rid="redalyc_64752604005_ref3">APA, 2010</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref13">Cumming, 2012</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref32">Kline, 2013</xref>). La importancia clínica se refiere a la utilidad práctica o aplicada o a la importancia del efecto de una intervención. Es decir, si produce alguna diferencia real (auténtica, palpable, práctica, notable) para los clientes o para otros con los que interactúan en la vida cotidiana (<xref ref-type="bibr" rid="redalyc_64752604005_ref29">Kazdin, 1999</xref>). Por tanto, la presentación de muchos asteriscos junto al valor <italic>p</italic> de probabilidad o valores <italic>p</italic> muy pequeños solo señalan que en ese diseño la hipótesis nula es poco plausible, pero de ahí no se puede inferir que el efecto encontrado es importante, que la relación entre las variables es fuerte o que existe una relevancia sustantiva (<xref ref-type="bibr" rid="redalyc_64752604005_ref17">Frias-Navarro, 2011</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref22">Gliner et al., 2001</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref42">Palmer &amp; Sesé, 2013</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref39">Newcombe, 2012</xref>). </p>
<p> Las falacias del tamaño del efecto y de la significación clínica o práctica de los resultados representan una de las críticas más fuertes contra las pruebas de significación estadística y, en gran medida, han provocado el movimiento de la reforma estadística (<xref ref-type="bibr" rid="redalyc_64752604005_ref13">Cumming, 2012</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref32">Kline, 2013</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref57">Wilkinson, 1999</xref>) que aboga por acompañar los valores <italic>p</italic> con información del tamaño del efecto y sus intervalos de confianza (<xref ref-type="bibr" rid="redalyc_64752604005_ref8">Balluerka, Vergara, &amp; Arnau, 2009</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref13">Cumming, 2012</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref36">Maher, Markey, &amp; Ebert-May, 2013</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref39">Newcombe, 2012</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref48">Savalei &amp; Dunn, 2015</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref50">Téllez et al., 2015</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref51">Valera-Espín, Sánchez-Meca, &amp; Marín-Martínez, 2000</xref>), tal y como señala el manual de la <xref ref-type="bibr" rid="redalyc_64752604005_ref3">APA (2010)</xref>. Sin embargo, estudios previos han mostrado que los intervalos de confianza no están exentos de errores de interpretación (e. g., <xref ref-type="bibr" rid="redalyc_64752604005_ref25">Hoekstra, Morey, Rouder, &amp; Wagenmakers, 2014</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref44">Perezgonzalez, 2015a</xref>). </p>
<p> Finalmente, los hallazgos del estudio deben interpretarse con ciertas limitaciones. El procedimiento de muestreo (muestra de conveniencia) limita la validez externa de nuestros resultados. Sin embargo, los resultados son consistentes con estudios previos tal y como ya se ha comentado. Así pues, la presencia de interpretaciones erróneas del valor <italic>p</italic> entre estudiantes y profesores universitarios indica la necesidad de mejorar la formación o educación estadística de los profesores para evitar la perpetuación de estas falacias (<xref ref-type="bibr" rid="redalyc_64752604005_ref24">Haller &amp; Kraus, 2002</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref32">Kline, 2013</xref>) y producir un conocimiento científico válido. También se necesita mejorar el contenido de los libros de estadística para garantizar una formación de calidad a los futuros profesionales de la psicología (<xref ref-type="bibr" rid="redalyc_64752604005_ref13">Cumming, 2012</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref21">Gliner et al., 2002</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref32">Kline, 2013</xref>). La enseñanza de la estadística no solo debe consistir en cálculos de enseñanza, procedimientos y fórmulas, deberían centrarse mucho más en el pensamiento y la comprensión de los métodos estadísticos (<xref ref-type="bibr" rid="redalyc_64752604005_ref24">Haller &amp; Kraus, 2002</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref45">Perezgonzalez, 2015b</xref>).  </p>
<p> Para ello, se requiere un enfoque multifacético que implique a los autores de libros de texto, profesores, autores de paquetes estadísticos de software, editores de revistas y manuales de publicación (<xref ref-type="bibr" rid="redalyc_64752604005_ref7">Balluerka et al., 2005</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref31">Kirk, 2001</xref>). Por ejemplo, como <xref ref-type="bibr" rid="redalyc_64752604005_ref21">Gliner et al. (2002)</xref> señalan, los autores de libros de texto deberían incluir una sección sobre el debate y críticas del procedimiento NHST que incluyera un apartado sobre su origen. Pues, probablemente, la mayoría de los problemas de interpretación vinculados al valor <italic>p</italic> radican en que este procedimiento es una fusión entre la prueba de significación de Fisher y la prueba de la hipótesis estadística de Neyman y Pearson (<xref ref-type="bibr" rid="redalyc_64752604005_ref23">Hager, 2013</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref27">Ivarsson, Andersen, Stenling, Johnson, &amp; Lindwall, 2015</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref45">Perezgonzalez, 2015b</xref>). Además, los libros deberían incluir una sección sobre el cálculo del tamaño del efecto y sus intervalos de confianza y, poner ejemplos sobre la importancia práctica o clínica de un hallazgo. En los dos primeros libros de la colección Reforma Estadística editados en España, se detallan todas estas cuestiones en diferentes capítulos (<xref ref-type="bibr" rid="redalyc_64752604005_ref17">Frias-Navarro, 2011</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref19">Frias-Navarro et al., 2014</xref>). </p>
<p> La PBE requiere de profesionales que valoren críticamente los hallazgos de los estudios o investigaciones psicológicas y, para ello, es necesaria una formación en conceptos estadísticos, en metodología de diseños de investigación y en resultados de pruebas de inferencia estadística (<xref ref-type="bibr" rid="redalyc_64752604005_ref5">Badenes-Ribera et al., 2016</xref>; <xref ref-type="bibr" rid="redalyc_64752604005_ref10">Beyth-Maron et al., 2008</xref>). Finalmente, la investigación futura debe ir dirigida ahora a la intervención sobre las falacias vinculadas a la interpretación del valor <italic>p</italic> de probabilidad.</p>
</sec>
</body>
<back>
<ack>
<title>Agradecimientos</title>
<p>Este
estudio fue financiado por el programa VALI+d de Formación Pre-doctoral de
Investigadores (ACIF/2013/167) de la Conselleria d'Educació, Cultura i Esport,
Generalitat Valenciana (España), y parcialmente subvencionado por el Ministerio
de Economía y Competitividad (I + D + i) (España) (EDU2011-22862).</p>
</ack>
<ref-list>
<title>Referencias</title>
<ref id="redalyc_64752604005_ref1">
<mixed-citation> American Psychological Association. (2005). <italic>Policy Statement on Evidence-Based Practice in Psychology</italic>. Washington, DC: Autor.</mixed-citation>
<element-citation publication-type="book">
<person-group person-group-type="author">
<collab>American Psychological
Association</collab>
</person-group>
<source>Policy Statement on Evidence-Based Practice in Psychology</source>
<year>2005</year>
<publisher-loc>Washington, DC</publisher-loc>
<publisher-name>American Psychological Association</publisher-name>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref2">
<mixed-citation> American Psychological Association. (2006). Evidence-based practice in psychology: APA Presidential Task Force on evidence-based practice. <italic>American Psychologist</italic>, <italic>61</italic>, 271-285. http://dx.doi.org/10.1037/0003-066X.61.4.271</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<collab>American
Psychological Association</collab>
</person-group>
<article-title>Evidence-based practice in psychology: APA
Presidential Task Force on evidence-based practice</article-title>
<source>American Psychologist</source>
<year>2006</year>
<volume>61</volume>
<fpage>271</fpage>
<lpage>285</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1037/0003-066X.61.4.271</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref3">
<mixed-citation> American Psychological Association. (2010). <italic>Publication manual of the American Psychological Association</italic> (6th. ed.). Washington, DC: Autor.</mixed-citation>
<element-citation publication-type="book">
<person-group person-group-type="author">
<collab>American Psychological
Association</collab>
</person-group>
<source>Publication manual of the American Psychological Association</source>
<year>2010</year>
<publisher-loc>Washington, DC</publisher-loc>
<publisher-name>American Psychological Association</publisher-name>
<edition>6th. ed.</edition>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref4">
<mixed-citation> Babione, J. M. (2010). Evidence-Based Practice in Psychology: An ethical framework for graduate education, clinical training, and maintaining professional competence. <italic>Ethics &amp; Behavior</italic>, <italic>20</italic>, 443-453. http://dx.doi.org/10.1080/10508422.2010.521446</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Babione</surname>
<given-names> J. M.</given-names>
</name>
</person-group>
<article-title>Evidence-Based Practice in Psychology: An ethical framework for
graduate education, clinical training, and maintaining professional competence</article-title>
<source>Ethics &amp; Behavior</source>
<year>2010</year>
<volume>20</volume>
<fpage>443</fpage>
<lpage>453</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1080/10508422.2010.521446</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref5">
<mixed-citation> Badenes-Ribera. L., Frias-Navarro, D., Iotti, B., Bonilla-Campos, A., &amp; Longobardi, C. (2016). Misconceptions of the p-value among Chilean and Italian academic psychologists. <italic>Frontiers in Psychology</italic>, <italic>7</italic>, 1247. http://dx.doi.org/10.3389/fpsyg.2016.01247</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Badenes-Ribera</surname>
<given-names>L.</given-names>
</name>
<name>
<surname>Frias-Navarro</surname>
<given-names> D</given-names>
</name>
<name>
<surname>Iotti</surname>
<given-names> B</given-names>
</name>
<name>
<surname>Bonilla-Campos</surname>
<given-names> A</given-names>
</name>
<name>
<surname>Longobardi</surname>
<given-names> C.</given-names>
</name>
</person-group>
<article-title>Misconceptions
of the p-value among Chilean and Italian academic psychologists</article-title>
<source>Frontiers in Psychology</source>
<year>2016</year>
<volume>7</volume>
<fpage>1247</fpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.3389/fpsyg.2016.01247</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref6">
<mixed-citation> Badenes-Ribera, L., Frias-Navarro, D., Monterde-i-Bort, H., &amp; Pascual-Soler, M. (2015). Interpretation of the p value. A national survey study in academic psychologists from Spain. <italic>Psicothema</italic>, <italic>27</italic>, 290-295.  http://dx.doi.org/10.7334/psicothema2014.283</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Badenes-Ribera</surname>
<given-names> L</given-names>
</name>
<name>
<surname>Frias-Navarro</surname>
<given-names> D</given-names>
</name>
<name>
<surname>Monterde-i-Bort</surname>
<given-names> H</given-names>
</name>
<name>
<surname>Pascual-Soler</surname>
<given-names> M.</given-names>
</name>
</person-group>
<article-title>Interpretation of the p value. A national survey study in academic
psychologists</article-title>
<source>Psicothema</source>
<year>2015</year>
<volume>27</volume>
<fpage>290</fpage>
<lpage>295</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.7334/psicothema2014.283</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref7">
<mixed-citation> Balluerka, N., Gómez, J., &amp; Hidalgo, D. (2005). The controversy over null hypothesis significance testing revisited. <italic>Methodology</italic>, <italic>1</italic>, 55-70.  http://dx.doi.org/10.1027/1614-1881.1.2.55</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Balluerka</surname>
<given-names> N</given-names>
</name>
<name>
<surname>Gómez</surname>
<given-names> J</given-names>
</name>
<name>
<surname>Hidalgo</surname>
<given-names> D.</given-names>
</name>
</person-group>
<article-title>The controversy
over null hypothesis significance
testing revisited</article-title>
<source>Methodology</source>
<year>2005</year>
<volume>1</volume>
<fpage>55</fpage>
<lpage>70</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1027/1614-1881.1.2.55</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref8">
<mixed-citation> Balluerka, N., Vergara, A. I., &amp; Arnau, J. (2009). Calculating the main alternatives to Null Hypothesis Significance testing in between subject experimental designs. <italic>Psicothema</italic>, <italic>21</italic>(1), 141-151.</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Balluerka</surname>
<given-names> N</given-names>
</name>
<name>
<surname>Vergara</surname>
<given-names> A. I</given-names>
</name>
<name>
<surname>Arnau</surname>
<given-names> J.</given-names>
</name>
</person-group>
<article-title>Calculating the main alternatives to Null Hypothesis
Significance testing in between subject experimental designs</article-title>
<source>Psicothema</source>
<year>2009</year>
<volume>21</volume>
<issue>1</issue>
<fpage>141</fpage>
<lpage>151</lpage>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref9">
<mixed-citation> Berkson, J. (1938). Some difficulties of interpretation encountered in the application of the chi-square test. <italic>Journal of the American Statistical Association</italic>, <italic>33</italic>, 526-536. </mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Berkson</surname>
<given-names> J.</given-names>
</name>
</person-group>
<article-title>Some difficulties of interpretation
encountered in the application of the chi-square test</article-title>
<source>Journal of the American Statistical Association</source>
<year>1938</year>
<volume>33</volume>
<fpage>526</fpage>
<lpage>536</lpage>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref10">
<mixed-citation> Beyth-Maron, R., Fidler, F., &amp; Cumming, G. (2008). Statistical cognition: Towards evidence-based practice in statistics and statistics education. <italic>Statistics Education Research Journal</italic>, <italic>7</italic>(2), 20-39.</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Beyth-Maron</surname>
<given-names> R</given-names>
</name>
<name>
<surname>Fidler</surname>
<given-names> F</given-names>
</name>
<name>
<surname>Cumming</surname>
<given-names> G.</given-names>
</name>
</person-group>
<article-title>Statistical cognition: Towards
evidence-based practice in statistics and statistics education</article-title>
<source>Statistics Education Research Journal</source>
<year>2008</year>
<volume>7</volume>
<issue>2</issue>
<fpage>20</fpage>
<lpage>39</lpage>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref11">
<mixed-citation> Castro-Sotos, A. E., Vanhoof, S., Van den Noortgate, W., &amp; Onghena, P. (2009). How confident are students in their misconceptions about hypothesis tests? <italic>Journal of Statistics Education</italic>, <italic>17</italic>(2). (Número de servicio de reproducción de documentos ERIC EJ856367). Recuperado de  <ext-link ext-link-type="uri" xlink:href="http://www.amstat.org/publications/jse/v17n2/castrosotos.html">http://www.amstat.org/publications/jse/v17n2/castrosotos.html</ext-link> </mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Castro-Sotos</surname>
<given-names> A. E</given-names>
</name>
<name>
<surname>Vanhoof</surname>
<given-names> S</given-names>
</name>
<name>
<surname>Van den Noortgate</surname>
<given-names> W</given-names>
</name>
<name>
<surname>Onghena</surname>
<given-names> P.</given-names>
</name>
</person-group>
<article-title>How confident are students
in their misconceptions about hypothesis tests?</article-title>
<source>Journal of Statistics Education</source>
<year>2009</year>
<volume>17</volume>
<issue>2</issue>
<comment>(Número de servicio de reproducción de documentos
ERIC EJ856367)</comment>
<comment> <ext-link ext-link-type="uri" xlink:href="http://www.amstat.org/publications/jse/v17n2/castrosotos.html">http://www.amstat.org/publications/jse/v17n2/castrosotos.html</ext-link> </comment>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref12">
<mixed-citation> Cohen, J. (1994). The earth is round (p &lt; .05). <italic>American Psychologist</italic>, <italic>49</italic>(12), 997-1003. http://dx.doi.org/10.1037/0003-066X.49.12.997</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Cohen</surname>
<given-names> J.</given-names>
</name>
</person-group>
<article-title>The earth is round (p &lt; .05)</article-title>
<source>American Psychologist</source>
<year>1994</year>
<volume>49</volume>
<issue>12</issue>
<fpage>997</fpage>
<lpage>1003</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1037/0003-066X.49.12.997</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref13">
<mixed-citation> Cumming, G. (2012). <italic>Understanding the new statistics: Effect sizes, confidence intervals, and meta-analysis</italic>. Nueva York: Routledge.</mixed-citation>
<element-citation publication-type="book">
<person-group person-group-type="author">
<name>
<surname>Cumming</surname>
<given-names> G.</given-names>
</name>
</person-group>
<source>Understanding the new statistics: Effect sizes, confidence intervals, and meta-analysis</source>
<year>2012</year>
<publisher-loc>Nueva York</publisher-loc>
<publisher-name>Routledge</publisher-name>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref14">
<mixed-citation> Cumming, G., Fidler, F., Leonard, M., Kalinowski, P, Christiansen, A., Kleinig, A.,…  &amp; Wilson, S. (2007). Statistical reform in psychology: Is anything changing? <italic>Psychological Science</italic>, <italic>18</italic>, 230-232. http://dx.doi.org/10.1111/j.1467-9280.2007.01881.x</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Cumming</surname>
<given-names> G</given-names>
</name>
<name>
<surname>Fidler</surname>
<given-names> F</given-names>
</name>
<name>
<surname>Leonard</surname>
<given-names> M</given-names>
</name>
<name>
<surname>Kalinowski</surname>
<given-names> P</given-names>
</name>
<name>
<surname>Kleinig</surname>
<given-names> A</given-names>
</name>
<name>
<surname>Wilson</surname>
<given-names> S.</given-names>
</name>
</person-group>
<article-title>Statistical reform
in psychology: Is anything changing?</article-title>
<source>Psychological Science</source>
<year>2007</year>
<volume>18</volume>
<fpage>230</fpage>
<lpage>232</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1111/j.1467-9280.2007.01881.x</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref15">
<mixed-citation> Daset, L. R., &amp; Cracco, C. (2013). Psicología Basada en la Evidencia: algunas cuestiones básicas y una aproximación a través de una revisión bibliográfica. <italic>Ciencias Psicológicas</italic>, <italic>7</italic>(2), 209-220. </mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Daset</surname>
<given-names> L. R</given-names>
</name>
<name>
<surname>Cracco</surname>
<given-names> C.</given-names>
</name>
</person-group>
<article-title>Psicología Basada en la Evidencia: algunas cuestiones básicas y una
aproximación a través de una revisión bibliográfica</article-title>
<source>Ciencias Psicológicas</source>
<year>2013</year>
<volume>7</volume>
<issue>2</issue>
<fpage>209</fpage>
<lpage>220</lpage>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref16">
<mixed-citation> Falk, R., &amp; Greenbaum, C. W. (1995). Significance tests Die Hard: The amazing persistence of a probabilistic misconception. <italic>Theory &amp; Psychology</italic>, <italic>5</italic>, 75-98. http://dx.doi.org/10.1177/0959354395051004</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Falk</surname>
<given-names> R</given-names>
</name>
<name>
<surname>Greenbaum</surname>
<given-names> C. W.</given-names>
</name>
</person-group>
<article-title>Significance tests Die Hard: The amazing persistence
of a probabilistic misconception</article-title>
<source>Theory &amp; Psychology</source>
<year>1995</year>
<volume>5</volume>
<fpage>75</fpage>
<lpage>98</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1177/0959354395051004</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref17">
<mixed-citation> Frias-Navarro, D. (2011). <italic>Técnica estadística y diseño de investigación</italic>. Valencia: Palmero Ediciones.</mixed-citation>
<element-citation publication-type="book">
<person-group person-group-type="author">
<name>
<surname>Frias-Navarro</surname>
<given-names> D.</given-names>
</name>
</person-group>
<source>Técnica estadística y diseño de investigación</source>
<year>2011</year>
<publisher-loc>Valencia</publisher-loc>
<publisher-name>Palmero Ediciones</publisher-name>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref18">
<mixed-citation> Frias-Navarro, D., &amp; Pascual-Llobell, J. (2003). Psicología clínica basada en pruebas: efecto del tratamiento. <italic>Papeles del Psicólogo</italic>, <italic>24</italic>(85), 11-18.</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Frias-Navarro</surname>
<given-names> D</given-names>
</name>
<name>
<surname>Pascual-Llobell</surname>
<given-names> J.</given-names>
</name>
</person-group>
<article-title>Psicología clínica basada en pruebas:
efecto del tratamiento</article-title>
<source>Papeles del Psicólogo</source>
<year>2003</year>
<volume>24</volume>
<issue>85</issue>
<fpage>11</fpage>
<lpage>18</lpage>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref19">
<mixed-citation> Frias-Navarro, D., Pascual-Soler, M., Badenes-Ribera, L., &amp; Monterde-i-Bort, H. (2014). <italic>Reforma estadística en psicología</italic>. Valencia: Palmero Ediciones.</mixed-citation>
<element-citation publication-type="book">
<person-group person-group-type="author">
<name>
<surname>Frias-Navarro</surname>
<given-names> D</given-names>
</name>
<name>
<surname>Pascual-Soler</surname>
<given-names> M</given-names>
</name>
<name>
<surname>Badenes-Ribera</surname>
<given-names> L</given-names>
</name>
<name>
<surname>Monterde-i-Bort</surname>
<given-names> H.</given-names>
</name>
</person-group>
<source>Reforma estadística en psicología</source>
<year>2014</year>
<publisher-loc>Valencia</publisher-loc>
<publisher-name>Palmero Ediciones</publisher-name>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref20">
<mixed-citation> Garfield, J. (2002). The challenge of developing statistical reasoning. <italic>Journal of Statistic Education</italic>, <italic>10</italic>. Recuperado de  <ext-link ext-link-type="uri" xlink:href="http://www.amstat.org/publications/jse/v10n3/garfield.html">http://www.amstat.org/publications/jse/v10n3/garfield.html</ext-link> </mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Garfield</surname>
<given-names> J.</given-names>
</name>
</person-group>
<article-title>The
challenge of developing statistical reasoning</article-title>
<source>Journal of Statistic Education</source>
<year>2002</year>
<volume>10</volume>
<comment>http://www.amstat.org/publications/jse/v10n3/garfield.html</comment>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref21">
<mixed-citation> Gliner, J. A., Leech, N. L., &amp; Morgan, G. A. (2002). Problems with null hypothesis significance testing (NHST): What do the textbooks say? <italic>The Journal of Experimental Education</italic>, <italic>71</italic>, 83-92. http://dx.doi.org/ 10.1080/00220970209602058</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Gliner</surname>
<given-names> J. A</given-names>
</name>
<name>
<surname>Leech</surname>
<given-names> N. L</given-names>
</name>
<name>
<surname>Morgan</surname>
<given-names> G. A.</given-names>
</name>
</person-group>
<article-title>Problems with null hypothesis significance testing
(NHST): What do the textbooks say?</article-title>
<source>The Journal of Experimental Education</source>
<year>2002</year>
<volume>71</volume>
<fpage>83</fpage>
<lpage>92</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1080/00220970209602058</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref22">
<mixed-citation> Gliner, J. A., Vaske, J. J., &amp; Morgan, G. A. (2001). Null hypothesis significance testing: Effect size matters. <italic>Human Dimensions of Wildlife</italic>, <italic>6</italic>, 291-301. http://dx.doi.org/ 10.1080/108712001753473966</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Gliner</surname>
<given-names> J. A</given-names>
</name>
<name>
<surname>Vaske</surname>
<given-names> J. J</given-names>
</name>
<name>
<surname>Morgan</surname>
<given-names> G. A.</given-names>
</name>
</person-group>
<article-title>Null hypothesis significance testing: Effect size
matters</article-title>
<source>Human Dimensions of Wildlife</source>
<year>2001</year>
<volume>6</volume>
<fpage>291</fpage>
<lpage>301</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1080/108712001753473966</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref23">
<mixed-citation> Hager, W. (2013). The statistical theories of Fisher and of Neyman and Pearson: A methodological perspective. <italic>Theory &amp; Psychology</italic>, <italic>23</italic>, 251-270. http://dx.doi.org/10.1177/0959354312465483</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Hager</surname>
<given-names> W.</given-names>
</name>
</person-group>
<article-title>The
statistical theories of Fisher and of Neyman and Pearson: A methodological
perspective</article-title>
<source>Theory &amp; Psychology</source>
<year>2013</year>
<volume>23</volume>
<fpage>251</fpage>
<lpage>270</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1177/0959354312465483</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref24">
<mixed-citation> Haller, H., &amp; Krauss, S. (2002). Misinterpretations of significance: A problem students share with their teachers?<italic> Methods of Psychological Research Online</italic> [On-line serial], 7, 120. Recuperado de  <ext-link ext-link-type="uri" xlink:href="http://www.metheval.uni-jena.de/lehre/0405-ws/evaluationuebung/haller.pdf">http://www.metheval.uni-jena.de/lehre/0405-ws/evaluationuebung/haller.pdf</ext-link> </mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Haller</surname>
<given-names> H</given-names>
</name>
<name>
<surname>Krauss</surname>
<given-names> S.</given-names>
</name>
</person-group>
<article-title>Misinterpretations of
significance: A problem students share with their teachers?</article-title>
<source>Methods of Psychological Research Online</source>
<year>2002</year>
<volume>7</volume>
<fpage>120</fpage>
<comment> <ext-link ext-link-type="uri" xlink:href="http://www.metheval.uni-jena.de/lehre/0405-ws/evaluationuebung/haller.pdf">http://www.metheval.uni-jena.de/lehre/0405-ws/evaluationuebung/haller.pdf</ext-link> </comment>
<comment>[On-line serial]</comment>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref25">
<mixed-citation> Hoekstra, R., Morey, R. D., Rouder, J. N., &amp; Wagenmakers, E. (2014). Robust misinterpretation of confidence intervals. <italic>Psychonomic Bulletin &amp; Review</italic>, <italic>21</italic>, 1157-1164. http://dx.doi.org/10.3758/s13423-013-0572-3</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Hoekstra</surname>
<given-names> R</given-names>
</name>
<name>
<surname>Morey</surname>
<given-names> R. D</given-names>
</name>
<name>
<surname>Rouder</surname>
<given-names> J. N</given-names>
</name>
<name>
<surname>Wagenmakers</surname>
<given-names> E.</given-names>
</name>
</person-group>
<article-title>Robust misinterpretation of
confidence intervals</article-title>
<source>Psychonomic Bulletin &amp; Review</source>
<year>2014</year>
<volume>21</volume>
<fpage>1157</fpage>
<lpage>1164</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.3758/s13423-013-0572-3</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref26">
<mixed-citation> Hubbard, R., &amp; Lindsay, R. M. (2008). Why p values are not a useful measure of evidence in statistical significance testing. <italic>Theory &amp; Psychology</italic>, <italic>18</italic>, 69-88. http://dx.doi.org/10.1177/0959354307086923</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Hubbard</surname>
<given-names> R</given-names>
</name>
<name>
<surname>Lindsay</surname>
<given-names> R. M.</given-names>
</name>
</person-group>
<article-title>Why p values are not a useful measure of evidence in statistical
significance testing</article-title>
<source>Theory &amp; Psychology</source>
<year>2008</year>
<volume>18</volume>
<fpage>69</fpage>
<lpage>88</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1177/0959354307086923</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref27">
<mixed-citation> Ivarsson, A., Andersen, M. B., Stenling, A., Johnson, U., &amp; Lindwall, M. (2015). Things we still haven't learned (so far). <italic>Journal of Sport &amp; Exercise Psychology</italic>, <italic>37</italic>, 449-461. http://dx.doi.org/10.1123/jsep.2015-0015</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Ivarsson</surname>
<given-names> A</given-names>
</name>
<name>
<surname>Andersen</surname>
<given-names> M. B</given-names>
</name>
<name>
<surname>Stenling</surname>
<given-names> A</given-names>
</name>
<name>
<surname>Johnson</surname>
<given-names> U</given-names>
</name>
<name>
<surname>Lindwall</surname>
<given-names> M.</given-names>
</name>
</person-group>
<article-title>Things we still haven't
learned (so far)</article-title>
<source>Journal of Sport &amp; Exercise Psychology</source>
<year>2015</year>
<volume>37</volume>
<fpage>449</fpage>
<lpage>461</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1123/jsep.2015-0015</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref28">
<mixed-citation> Johnson, D. H. (1999). The insignificance of statistical significance testing. <italic>Journal of Wildlife Management</italic>, <italic>63</italic>, 763-772.</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Johnson</surname>
<given-names> D. H.</given-names>
</name>
</person-group>
<article-title>The
insignificance of statistical significance testing</article-title>
<source>Journal of Wildlife Management</source>
<year>1999</year>
<volume>63</volume>
<fpage>763</fpage>
<lpage>772</lpage>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref29">
<mixed-citation> Kazdin, A. E. (1999). The meanings and measurement of clinical significance. <italic>Journal of Consulting and Clinical Psychology</italic>, <italic>67</italic>, 332-339. http://dx.doi.org/10.1037/0022-006X.67.3.332</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Kazdin</surname>
<given-names> A. E.</given-names>
</name>
</person-group>
<article-title>The meanings and measurement of clinical
significance</article-title>
<source>Journal of Consulting and Clinical Psychology</source>
<year>1999</year>
<volume>67</volume>
<fpage>332</fpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1037/0022-006X.67.3.332</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref30">
<mixed-citation> Kirk, R. E. (1996). Practical significance: A concept whose time has come. <italic>Educational and Psychological Measurement</italic>, <italic>56</italic>, 746-759. http://dx.doi.org/ 10.1177/0013164496056005002</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Kirk</surname>
<given-names> R. E.</given-names>
</name>
</person-group>
<article-title>Practical
significance: A concept whose time has come</article-title>
<source>Educational and Psychological Measurement</source>
<year>1996</year>
<volume>56</volume>
<fpage>746</fpage>
<lpage>759</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1177/0013164496056005002</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref31">
<mixed-citation> Kirk, R. E. (2001). Promoting good statistical practices: Some suggestions. <italic>Educational and Psychological Measurement</italic>, <italic>61</italic>, 213-218. http://dx.doi.org/ 10.1177/00131640121971185</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Kirk</surname>
<given-names> R. E.</given-names>
</name>
</person-group>
<article-title>Promoting
good statistical practices: Some suggestions</article-title>
<source>Educational and Psychological Measurement</source>
<year>2001</year>
<volume>61</volume>
<fpage>213</fpage>
<lpage>218</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1177/00131640121971185</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref32">
<mixed-citation> Kline, R. B. (2013). <italic>Beyond significance testing: Statistic reform in the behavioral sciences</italic>. Washington, DC: APA.</mixed-citation>
<element-citation publication-type="book">
<person-group person-group-type="author">
<name>
<surname>Kline</surname>
<given-names> R. B.</given-names>
</name>
</person-group>
<source>Beyond significance testing: Statistic reform in the behavioral sciences</source>
<year>2013</year>
<publisher-loc>Washington, DC</publisher-loc>
<publisher-name>APA</publisher-name>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref33">
<mixed-citation> Kühberger, A., Fritz, A., Lermer, E., &amp; Scherndl, T. (2015). The significance fallacy in inferential statistics. <italic>BMC Research Notes</italic>, <italic>17</italic>(8), 84. http://dx.doi.org/10.1186/s13104-015-1020-4</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Kühberger</surname>
<given-names> A</given-names>
</name>
<name>
<surname>Fritz</surname>
<given-names> A</given-names>
</name>
<name>
<surname>Lermer</surname>
<given-names> E</given-names>
</name>
<name>
<surname>Scherndl</surname>
<given-names> T.</given-names>
</name>
</person-group>
<article-title>The significance fallacy in inferential
statistics</article-title>
<source>BMC Research Notes</source>
<year>2015</year>
<volume>17</volume>
<issue>8</issue>
<fpage>84</fpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1186/s13104-015-1020-4</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref34">
<mixed-citation> Lecoutre, M. P., Poitevineau, J., &amp; Lecoutre, B. (2003). Even statisticians are not immune to misinterpretations of Null Hypothesis Tests. <italic>International Journal of Psychology</italic>, <italic>38</italic>, 37-45. http://dx.doi.org/10.1080/00207590244000250</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Lecoutre</surname>
<given-names> M. P</given-names>
</name>
<name>
<surname>Poitevineau</surname>
<given-names> J</given-names>
</name>
<name>
<surname>Lecoutre</surname>
<given-names> B.</given-names>
</name>
</person-group>
<article-title>Even
statisticians are not immune to misinterpretations of Null Hypothesis Tests</article-title>
<source>International Journal of Psychology</source>
<year>2003</year>
<volume>38</volume>
<fpage>37</fpage>
<lpage>45</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1080/00207590244000250</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref35">
<mixed-citation> Leek, J. (14 de febrero de 2014). On the scalability of statistical procedures: Why the p-value bashers just don’t get it [Simply Statistics Blog].  Recuperado de  <ext-link ext-link-type="uri" xlink:href="http://simplystatistics.org/2014/02/14/on-the-scalability-of-statisticalprocedures-why-the-p-value-bashers-just-dont-get-it/">http://simplystatistics.org/2014/02/14/on-the-scalability-of-statisticalprocedures-why-the-p-value-bashers-just-dont-get-it/</ext-link> </mixed-citation>
<element-citation publication-type="book">
<person-group person-group-type="author">
<name>
<surname>Leek</surname>
<given-names> J.</given-names>
</name>
</person-group>
<source>On the scalability of statistical procedures: Why the p-value bashers just don’t get it</source>
<year>2014</year>
<comment>[Simply
Statistics Blog]</comment>
<comment> <ext-link ext-link-type="uri" xlink:href="http://simplystatistics.org/2014/02/14/on-the-scalability-of-statisticalprocedures-why-the-p-value-bashers-just-dont-get-it/">http://simplystatistics.org/2014/02/14/on-the-scalability-of-statisticalprocedures-why-the-p-value-bashers-just-dont-get-it/</ext-link> </comment>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref36">
<mixed-citation> Maher, J. M., Markey, J. C., &amp; Ebert-May, D. (2013). The other half of the story: Effect size analysis in quantitative research. <italic>CBE Life Sciences Education</italic>, <italic>12</italic>, 345-351. http://dx.doi.org/10.1187/cbe.13-04-0082</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Maher</surname>
<given-names> J. M</given-names>
</name>
<name>
<surname>Markey</surname>
<given-names> J. C</given-names>
</name>
<name>
<surname>Ebert-May</surname>
<given-names> D.</given-names>
</name>
</person-group>
<article-title>The other half of the story: Effect size analysis
in quantitative research</article-title>
<source>CBE Life Sciences Education</source>
<year>2013</year>
<volume>12</volume>
<fpage>345</fpage>
<lpage>351</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1187/cbe.13-04-0082</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref37">
<mixed-citation> Mittag, K. C., &amp; Thompson, B. (2000). A national survey of AERA members’ perceptions of statistical significance test and others statistical issues. <italic>Educational Researcher</italic>, <italic>29</italic>, 14-20. http://dx.doi.org/10.3102/0013189X029004014</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Mittag</surname>
<given-names> K. C</given-names>
</name>
<name>
<surname>Thompson</surname>
<given-names> B.</given-names>
</name>
</person-group>
<article-title>A national survey of AERA members’ perceptions of statistical
significance test and others statistical issues</article-title>
<source>Educational Researcher</source>
<year>2000</year>
<volume>29</volume>
<fpage>14</fpage>
<lpage>20</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.3102/0013189X029004014</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref38">
<mixed-citation> Monterde-i-Bort, H., Frias-Navarro, D., &amp; Pascual-Llobel, J. (2010). Uses and abuses of statistical significance tests and other statistical resources: A comparative study. <italic>European Journal of Psychology of Education</italic>, <italic>25</italic>, 429-447. http://dx.doi.org/10.1007/s10212-010-0021-x</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Monterde-i-Bort</surname>
<given-names> H</given-names>
</name>
<name>
<surname>Frias-Navarro</surname>
<given-names> D</given-names>
</name>
<name>
<surname>Pascual-Llobel</surname>
<given-names> J.</given-names>
</name>
</person-group>
<article-title>Uses and abuses of statistical significance tests and
other statistical resources: A comparative study</article-title>
<source>European Journal of Psychology of Education</source>
<year>2010</year>
<volume>25</volume>
<fpage>429</fpage>
<lpage>447</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1007/s10212-010-0021-x</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref39">
<mixed-citation> Newcombe, R. G. (2012). <italic>Confidence intervals for proportions and related measures of effect size</italic>. Boca Raton, FL: CRC Press.</mixed-citation>
<element-citation publication-type="book">
<person-group person-group-type="author">
<name>
<surname>Newcombe</surname>
<given-names> R. G.</given-names>
</name>
</person-group>
<source>Confidence intervals for proportions and related measures of effect size</source>
<year>2012</year>
<publisher-loc>Boca Raton, FL</publisher-loc>
<publisher-name>CRC Press</publisher-name>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref40">
<mixed-citation> Nickerson, R. S. (2000). Null hypothesis significance testing: A review of an old and continuing controversy. <italic>Psychological Methods</italic>, <italic>5</italic>, 241-301. http://dx.doi.org/10.1037/1082-989X.S.2.241</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Nickerson</surname>
<given-names> R. S.</given-names>
</name>
</person-group>
<article-title>Null
hypothesis significance testing: A review of an old and continuing controversy</article-title>
<source>Psychological Methods</source>
<year>2000</year>
<volume>5</volume>
<fpage>241</fpage>
<lpage>301</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1037/1082-989X.S.2.241</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref41">
<mixed-citation> Oakes, M. (1986). <italic>Statistical inference: A commentary for the social and behavioral sciences</italic>. Chichester, England: Wiley.</mixed-citation>
<element-citation publication-type="book">
<person-group person-group-type="author">
<name>
<surname>Oakes</surname>
<given-names> M.</given-names>
</name>
</person-group>
<source>Statistical inference: A commentary for the social and behavioral sciences</source>
<year>1986</year>
<publisher-loc>Chichester, England</publisher-loc>
<publisher-name>Wiley</publisher-name>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref42">
<mixed-citation> Palmer, A., &amp; Sesé, A. (2013). Recommendations for the use of statistics in clinical and health psychology. <italic>Clínica y Salud</italic>, <italic>24</italic>, 47-54. http://dx.doi.org/10.5093/cl2013a6</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Palmer</surname>
<given-names> A</given-names>
</name>
<name>
<surname>Sesé</surname>
<given-names> A.</given-names>
</name>
</person-group>
<article-title>Recommendations for the use of statistics in clinical and health
psychology</article-title>
<source>Clínica y Salud</source>
<year>2013</year>
<volume>24</volume>
<fpage>47</fpage>
<lpage>54</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.5093/cl2013a6</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref43">
<mixed-citation> Pascual-Llobell, J., Frias-Navarro, D., &amp; Monterde-i-Bort, H. (2004). Tratamientos psicológicos con apoyo empírico y práctica clínica basada en la evidencia. <italic>Papeles del Psicólogo</italic>, <italic>25</italic>(87), 1-8.</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Pascual-Llobell</surname>
<given-names> J</given-names>
</name>
<name>
<surname>Frias-Navarro</surname>
<given-names> D</given-names>
</name>
<name>
<surname>Monterde-i-Bort</surname>
<given-names> H.</given-names>
</name>
</person-group>
<article-title>Tratamientos psicológicos con apoyo empírico y práctica clínica basada
en la evidencia</article-title>
<source>Papeles del Psicólogo</source>
<year>2004</year>
<volume>25</volume>
<issue>87</issue>
<fpage>1</fpage>
<lpage>8</lpage>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref44">
<mixed-citation> Perezgonzalez, J. D. (2015a).Confidence intervals and tests are two sides of the same research question. <italic>Frontiers in Psychology</italic>, <italic>6</italic>, 34. http://dx.doi.org/  10.3389/fpsyg.2015.00034</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Perezgonzalez</surname>
<given-names> J. D.</given-names>
</name>
</person-group>
<article-title>Confidence intervals
and tests are two sides of the same research question</article-title>
<source>Frontiers in Psychology</source>
<year>2015</year>
<volume>6</volume>
<fpage>34</fpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.3389/fpsyg.2015.00034</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref45">
<mixed-citation> Perezgonzalez, J. D. (2015b).Fisher, Neyman-Pearson or NHST? A tutorial for teaching data testing. <italic>Frontiers in Psychology</italic>, <italic>6</italic>, 223. http://dx.doi.org/ 10.3389/fpsyg.2015.000223</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Perezgonzalez</surname>
<given-names> J. D.</given-names>
</name>
</person-group>
<article-title>Fisher, Neyman-Pearson
or NHST? A tutorial for teaching data testing</article-title>
<source>Frontiers in Psychology</source>
<year>2015</year>
<volume>6</volume>
<fpage>223</fpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.3389/fpsyg.2015.000223</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref46">
<mixed-citation> Rosenthal, R. (1993). Cumulating evidence. En G. Keren &amp; C. Lewis (Eds.), <italic>A handbook for data analysis in the behavioral sciences: Methodological issues</italic> (pp. 519-559). Hillsdale, NJ: Erlbaum.</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Rosenthal</surname>
<given-names> R.</given-names>
</name>
</person-group>
<person-group person-group-type="editor">
<name>
<surname>Keren</surname>
<given-names>G.</given-names>
</name>
<name>
<surname>Lewis</surname>
<given-names>C.</given-names>
</name>
</person-group>
<source>A handbook for data analysis in the behavioral sciences: Methodological issues</source>
<year>1993</year>
<fpage>519</fpage>
<lpage>559</lpage>
<publisher-loc>Hillsdale, NJ</publisher-loc>
<publisher-name>Erlbaum</publisher-name>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref47">
<mixed-citation> Sánchez-Meca, J., Boruch, R. F., Petrosino, A., &amp; Rosa-Alcázar, A. I. (2002). La Colaboración Campbell y la Práctica basada en la Evidencia. <italic>Papeles del Psicólogo</italic>, <italic>83</italic>, 44-48.</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Sánchez-Meca</surname>
<given-names> J</given-names>
</name>
<name>
<surname>Boruch</surname>
<given-names> R. F</given-names>
</name>
<name>
<surname>Petrosino</surname>
<given-names> A</given-names>
</name>
<name>
<surname>Rosa-Alcázar</surname>
<given-names> A. I.</given-names>
</name>
</person-group>
<article-title>La Colaboración Campbell y la Práctica basada en la Evidencia</article-title>
<source>Papeles del Psicólogo</source>
<year>2002</year>
<volume>83</volume>
<fpage>44</fpage>
<lpage>48</lpage>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref48">
<mixed-citation> Savalei, V., &amp; Dunn, E. (2015). Is the call to abandon p-values the red herring of the replicability crisis? <italic>Frontiers in Psychology</italic>, <italic>6</italic>, 245. http://dx.doi.org/10.3389/fpsyg.2015.00245</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Savalei</surname>
<given-names> V</given-names>
</name>
<name>
<surname>Dunn</surname>
<given-names> E.</given-names>
</name>
</person-group>
<article-title>Is the call to abandon p-values the red herring of the replicability crisis?</article-title>
<source>Frontiers in Psychology</source>
<year>2015</year>
<volume>6</volume>
<fpage>245</fpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.3389/fpsyg.2015.00245</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref49">
<mixed-citation> Shaver, J. P. (1993). What statistical significance testing is, and what is not. <italic>The Journal of Experimental Education</italic>, <italic>61</italic>, 293-316.</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Shaver</surname>
<given-names> J. P.</given-names>
</name>
</person-group>
<article-title>What statistical significance testing is,
and what is not</article-title>
<source>The Journal of Experimental Education</source>
<year>1993</year>
<volume>61</volume>
<fpage>293</fpage>
<lpage>316</lpage>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref50">
<mixed-citation> Téllez, A., García, C. H., &amp; Corral-Verdugo, V. (2015). Effect size, confidence intervals and statistical power in psychological research. <italic>Psychology in Russia: State of the Art</italic>, <italic>8</italic>, 27-46. http://dx.doi.org/10.11621/pir.2015.0303</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Téllez</surname>
<given-names> A</given-names>
</name>
<name>
<surname>García</surname>
<given-names> C. H</given-names>
</name>
<name>
<surname>Corral-Verdugo</surname>
<given-names> V.</given-names>
</name>
</person-group>
<article-title>Effect size, confidence intervals and statistical power in psychological
research</article-title>
<source>Psychology in Russia: State of the Art</source>
<year>2015</year>
<volume>8</volume>
<fpage>27</fpage>
<lpage>46</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.11621/pir.2015.0303</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref51">
<mixed-citation> Valera-Espín, A., Sánchez-Meca, J., &amp; Marín-Martínez, F. (2000). Contraste de hipótesis e investigación psicológica española: análisis y propuestas. <italic>Psicothema</italic>, <italic>12</italic>(Supl. 2), 549-552. </mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Valera-Espín</surname>
<given-names> A</given-names>
</name>
<name>
<surname>Sánchez-Meca</surname>
<given-names> J</given-names>
</name>
<name>
<surname>Marín-Martínez</surname>
<given-names> F.</given-names>
</name>
</person-group>
<article-title>Contraste de hipótesis e
investigación psicológica española: análisis y propuestas</article-title>
<source>Psicothema</source>
<year>2000</year>
<volume>12</volume>
<fpage>549</fpage>
<lpage>552</lpage>
<supplement>2</supplement>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref52">
<mixed-citation> Vallecillos, A. (2002). Empirical evidence about understanding of the level of significance concept in hypotheses testing by university students. <italic>Themes in Education</italic>, <italic>3</italic>, 183-198.</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Vallecillos</surname>
<given-names> A.</given-names>
</name>
</person-group>
<article-title>Empirical evidence about understanding of the level of significance concept in
hypotheses testing by university students</article-title>
<source>Themes in Education</source>
<year>2002</year>
<volume>3</volume>
<fpage>183</fpage>
<lpage>198</lpage>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref53">
<mixed-citation> Vallecillos, A., &amp; Batanero, C. (1997). Conceptos activados en el contraste de hipótesis estadísticas y su comprensión por estudiantes universitarios. <italic>Recherches en Didactique des Mathématiques</italic>, 17, 29-48.</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Vallecillos</surname>
<given-names> A</given-names>
</name>
<name>
<surname>Batanero</surname>
<given-names> C.</given-names>
</name>
</person-group>
<article-title>Conceptos activados en el contraste de hipótesis
estadísticas y su comprensión por estudiantes universitarios</article-title>
<source>Recherches en Didactique des Mathématiques</source>
<year>1997</year>
<volume>17</volume>
<fpage>29</fpage>
<lpage>48</lpage>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref54">
<mixed-citation> Vázquez, C., &amp; Nieto, M. (2003). Psicología (clínica) basada en la evidencia (PBE): una revisión conceptual y metodológica. En J. L. Romero (Ed.), <italic>Psicópolis: Paradigmas actuales y alternativos en la psicología contemporánea</italic> (pp. 465-485). Barcelona: Paidós.</mixed-citation>
<element-citation publication-type="book">
<person-group person-group-type="author">
<name>
<surname>Vázquez</surname>
<given-names> C</given-names>
</name>
<name>
<surname>Nieto</surname>
<given-names> M.</given-names>
</name>
</person-group>
<person-group person-group-type="editor">
<name>
<surname>Romero</surname>
<given-names>J. L.</given-names>
</name>
</person-group>
<source>Psicópolis: Paradigmas actuales y alternativos en la psicología contemporánea</source>
<year>2003</year>
<fpage>465</fpage>
<lpage>485</lpage>
<publisher-loc>Barcelona</publisher-loc>
<publisher-name>Paidós</publisher-name>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref55">
<mixed-citation> Verdam, M. G. E., Oort, F. J., &amp; Sprangers, M. A. G. (2014). Significance, truth and proof of p values: Reminders about common misconceptions regarding null hypothesis significance testing. <italic>Quality of Life Research</italic>, <italic>23</italic>, 5-7. http://dx.doi.org/10.1007/s11136-013-0437-2</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Verdam</surname>
<given-names> M. G. E</given-names>
</name>
<name>
<surname>Oort</surname>
<given-names> F. J</given-names>
</name>
<name>
<surname>Sprangers</surname>
<given-names> M. A. G.</given-names>
</name>
</person-group>
<article-title>Significance, truth and proof of p values: Reminders
about common misconceptions regarding null hypothesis significance testing</article-title>
<source>Quality of Life Research</source>
<year>2014</year>
<volume>23</volume>
<fpage>5</fpage>
<lpage>7</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1007/s11136-013-0437-2</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref56">
<mixed-citation> Wasserstein, R. L., &amp; Lazar, N. A. (2016). The ASA's statement on p-values: Context, process, and purpose. <italic>The American Statistician</italic>, <italic>70</italic>, 129-133. http://dx.doi.org/10.1080/00031305.2016.1154108</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Wasserstein</surname>
<given-names> R. L</given-names>
</name>
<name>
<surname>Lazar</surname>
<given-names> N. A.</given-names>
</name>
</person-group>
<article-title>The ASA's statement on p-values: Context, process, and
purpose</article-title>
<source>The American Statistician</source>
<year>2016</year>
<volume>70</volume>
<fpage>129</fpage>
<lpage>133</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1080/00031305.2016.1154108</pub-id>
</element-citation>
</ref>
<ref id="redalyc_64752604005_ref57">
<mixed-citation> Wilkinson, L. (1999). Statistical methods in psychology journals: Guidelines and explanations. <italic>The American Psychologist</italic>, <italic>54</italic>, 594-604. http://dx.doi.org/10.1037/0003-066X.54.8.594</mixed-citation>
<element-citation publication-type="journal">
<person-group person-group-type="author">
<name>
<surname>Wilkinson</surname>
<given-names> L.</given-names>
</name>
</person-group>
<article-title>Statistical methods in psychology journals: Guidelines and explanations</article-title>
<source>The American Psychologist</source>
<year>1999</year>
<volume>54</volume>
<fpage>594</fpage>
<lpage>604</lpage>
<pub-id pub-id-type="doi">http://dx.doi.org/10.1037/0003-066X.54.8.594</pub-id>
</element-citation>
</ref>
</ref-list>
<fn-group>
<title>Notas</title>
<fn id="fn2" fn-type="other">
<label>
<sup>*</sup>
</label>
<p>Artículo
de investigación.</p>
</fn>
</fn-group>
</back>
</article>