DICCIONARIO MÉDICO
Fiabilidad
En medicina, la fiabilidad (en inglés, reliability) es la propiedad de un instrumento de medición o una prueba diagnóstica de producir resultados consistentes y estables cuando se aplica de forma repetida en las mismas condiciones. Un test es fiable cuando distintos observadores obtienen puntuaciones concordantes al evaluarlo, o cuando un mismo observador obtiene valores similares al repetirlo en momentos diferentes. El término proviene del latín medieval fidelis (digno de confianza), a través del francés fiable, que se incorporó al español en el siglo XIX. En la terminología biomédica designa un concepto preciso que no debe confundirse con la validez: una prueba puede ser muy fiable (reproducible) sin ser válida, es decir, sin medir aquello que pretende medir. Pensemos en una balanza que siempre marca dos kilos de más. Sus resultados son perfectamente consistentes entre sí, pero ninguno refleja el peso real. La validez se evalúa mediante la sensibilidad y la especificidad de la prueba, que indican su capacidad de clasificar correctamente a los sujetos enfermos y sanos. Fiabilidad y validez son propiedades complementarias, pero independientes: para que una prueba sea útil en la práctica clínica necesita ambas. Existen varios métodos para estimar la fiabilidad, y la elección depende del tipo de medición y del diseño del estudio. La fiabilidad test-retest (o estabilidad temporal) consiste en aplicar la misma prueba a los mismos sujetos en dos momentos separados y calcular la correlación entre ambos resultados. Si el fenómeno medido no ha cambiado en el intervalo, los valores deben coincidir. Cuando la variable es categórica (presencia o ausencia de un hallazgo, grado de una lesión), el indicador más utilizado es el coeficiente kappa de Cohen, que corrige la concordancia observada por el efecto del azar. Un kappa de 1 indica acuerdo perfecto; un kappa cercano a 0 significa que la concordancia no supera lo esperable por casualidad. Valores por encima de 0,80 se consideran excelentes en la mayor parte de los contextos clínicos, mientras que por debajo de 0,40 la fiabilidad se juzga insuficiente. Para variables continuas (cifras de laboratorio, puntuaciones en escalas), se emplean el coeficiente de correlación intraclase (CCI) y el método de Bland-Altman, que permite visualizar la distribución de las diferencias entre dos mediciones y detectar sesgos sistemáticos. La fiabilidad interna de un cuestionario o escala psicométrica se estima con el alfa de Cronbach, que evalúa hasta qué punto los ítems que componen el instrumento miden un mismo constructo. En la práctica clínica resulta habitual distinguir entre estas dos dimensiones. La fiabilidad interobservador mide el grado de acuerdo entre dos o más evaluadores que examinan los mismos casos de forma independiente: dos radiólogos que interpretan la misma serie de mamografías, por ejemplo. La fiabilidad intraobservador refleja la consistencia de un mismo evaluador consigo mismo cuando repite la valoración tras un intervalo de tiempo. Ambas son relevantes, pero responden a fuentes de error distintas. Depende del contexto. En el ámbito de las pruebas diagnósticas, ambos términos se usan con frecuencia como sinónimos, y la reproducibilidad se entiende como la capacidad de obtener resultados concordantes al repetir la medición. En la metodología de la investigación científica, sin embargo, la reproducibilidad adquiere un significado más amplio que se describe en la entrada fiabilidad (ciencia). Sí, y es una situación más frecuente de lo que cabría suponer. Un test que arroje siempre el mismo resultado ante el mismo paciente es fiable por definición, pero si ese resultado no refleja la realidad del fenómeno que se pretende medir, carece de validez. La condición inversa, validez sin fiabilidad, resulta prácticamente imposible: si los resultados fluctúan al azar, no pueden ser sistemáticamente correctos. Que distintos radiólogos discrepan con frecuencia al interpretar las mismas imágenes, lo cual puede obedecer a la subjetividad inherente a la lectura visual, a criterios diagnósticos mal definidos o a diferencias en la formación. Un kappa bajo no invalida la técnica de imagen en sí, pero señala que la interpretación introduce variabilidad y puede requerir protocolos de doble lectura o consenso.Qué es la fiabilidad en el contexto diagnóstico
Cómo se cuantifica
Fiabilidad interobservador e intraobservador
Preguntas frecuentes
¿Fiabilidad y reproducibilidad son lo mismo?
¿Puede una prueba ser fiable pero no válida?
¿Qué significa un kappa bajo en un informe radiológico?
Referencias
Entradas relacionadas
Infografías realizadas con https://BioRender.com
© Clínica Universidad de Navarra 2026