DICCIONARIO MÉDICO

Recompensa

En neurociencia y en psicología de la conducta, la recompensa es cualquier estímulo, objeto o suceso al que el organismo atribuye un valor positivo: lo busca, aprende a anticiparlo y tiende a repetir lo que hizo para conseguirlo. El cerebro procesa ese valor a través de un circuito en el que la dopamina ocupa un lugar central, aunque su papel, según se ha sabido en las últimas décadas, tiene menos que ver con el placer que con señalar cuándo la realidad supera o defrauda lo esperado.

Qué es la recompensa

Pertenece a la fisiología de la conducta, no a la patología. Designa aquello que tiene valor para quien lo recibe: el agua para un animal sediento, el alimento, la compañía de otros o una suma de dinero. Un estímulo se convierte en recompensa por el efecto que produce, con independencia de su naturaleza física: el organismo se acerca a él, lo prefiere frente a otras opciones y modifica su conducta para volver a obtenerlo.

La palabra procede del latín tardío recompensare, formado por el prefijo re- y compensare, «equilibrar», que a su vez une com- («con, juntos») y pensare, forma frecuentativa de pendere, «colgar, pesar». Es decir, pesar una cosa contra otra en la balanza hasta dejarlas iguales. En el castellano actual, recompensa es la acción y el efecto de recompensar, y también aquello que sirve para recompensar. La neurociencia la usa como equivalente del inglés reward.

El circuito cerebral de la recompensa

Hablar de un «sistema de recompensa» es una simplificación útil. Se trata de una red de estructuras interconectadas cuyo eje es la vía mesolímbica: neuronas dopaminérgicas cuyos cuerpos celulares están en el área tegmental ventral del mesencéfalo y que proyectan sus axones hacia el núcleo accumbens, en el estriado ventral. De ahí la señal se distribuye hacia la amígdala, el hipocampo y distintas regiones de la corteza prefrontal, dentro de los circuitos que conectan la corteza con los ganglios basales y el tálamo.

Este circuito responde a las recompensas naturales, las que durante la evolución favorecieron la supervivencia (comer, beber, relacionarse con los seres queridos), y hace que el organismo repita esas actividades. Las drogas de abuso actúan sobre él de forma directa y lo inundan de dopamina, un atajo que se salta los estímulos naturales. La idea de que el cerebro tiene regiones capaces de reforzar la conducta por sí mismas procede de los experimentos de autoestimulación eléctrica en ratas publicados en 1954, desarrollados en la entrada dedicada al área septal.

La dopamina como señal de error de predicción

Durante mucho tiempo se dio por hecho que la dopamina era, sin más, la molécula del placer. Los registros de neuronas dopaminérgicas en monos que realizó el fisiólogo Wolfram Schultz, en la Universidad de Friburgo (Suiza), cambiaron esa lectura. Esas neuronas se activaban cuando el animal recibía una recompensa por sorpresa, por ejemplo unas gotas de líquido. Cuando la recompensa estaba anunciada por una señal que el mono ya había aprendido, la descarga se desplazaba hacia la señal y la llegada del líquido, perfectamente prevista, ya no alteraba su actividad. Si lo anunciado no llegaba, su actividad caía por debajo del nivel basal justo en el momento en que debía haber llegado.

Lo que codifican, por tanto, es la diferencia entre lo recibido y lo esperado. En 1997, Schultz, Peter Dayan y P. Read Montague publicaron en la revista Science un artículo que conectaba esta respuesta con las teorías matemáticas del aprendizaje por refuerzo, las mismas que se emplean en el aprendizaje automático para entrenar sistemas que aprenden por ensayo y error. La noción de error de predicción de la recompensa es hoy una de las ideas más productivas de la neurociencia computacional. Explica algo cotidiano: lo que llega exactamente como se esperaba enseña poco.

Tipos de recompensa

Se distinguen las recompensas primarias, cuyo valor no depende del aprendizaje porque atiende a necesidades biológicas (el alimento, el agua), de las secundarias o condicionadas, que adquieren valor por su asociación con las primarias: el dinero es el ejemplo clásico, porque por sí mismo no sacia ninguna necesidad. La psicología las estudia bajo los nombres de refuerzo primario y refuerzo secundario. Otra clasificación, más cercana a la psicología de la motivación, separa las recompensas extrínsecas, que vienen de fuera (un premio, un elogio), de las intrínsecas, que residen en la propia actividad.

El momento de la entrega también cuenta, y mucho. El valor subjetivo de una recompensa disminuye a medida que se retrasa, fenómeno que en inglés se denomina delay discounting y en español descuento temporal o por demora. La caída no es lineal. Sigue una curva hiperbólica, de modo que retrasar un día algo inmediato le resta proporcionalmente mucho más valor que retrasar un día algo que ya estaba lejano. Esa forma de la curva explica las inversiones de preferencia: quien prefiere la opción mayor y tardía mientras ambas están lejos cambia de elección cuando la pequeña se vuelve inmediata. Un descuento muy pronunciado se considera una medida de impulsividad y se ha asociado en múltiples estudios con conductas adictivas.

Recompensa, refuerzo y placer

Los tres términos se solapan y a menudo se usan como sinónimos, pero no designan lo mismo. En la época de los primeros experimentos de estimulación cerebral, refuerzo equivalía a recompensa y recompensa significaba placer; buena parte de la investigación posterior ha consistido en separarlos. El refuerzo es una definición operativa, propia del condicionamiento operante: se llama así a la consecuencia que aumenta la probabilidad de que una conducta se repita, y se identifica midiendo esa conducta. La recompensa, en cambio, alude al valor que el organismo asigna al estímulo, y ese valor puede estudiarse aunque no haya una respuesta concreta que reforzar.

El placer es solo una parte del proceso. Desear algo, disfrutarlo cuando llega y aprender a qué señales va asociado son fases con bases neuroquímicas parcialmente distintas, y pueden alterarse por separado, como ocurre en la anhedonia.

Preguntas frecuentes

¿Por qué una palabra de balanzas y deudas acabó en la neurociencia?

Porque su primer sentido era compensar un daño: el diccionario académico todavía recoge «compensar el daño hecho» como primera acepción de recompensar, por delante de retribuir un servicio o premiar un mérito. Fue ese último sentido, el de premio, el que heredó la psicología experimental del siglo XX y el que hoy traduce el inglés reward en los textos de neurociencia.

¿Es la dopamina la sustancia del placer?

No, o no exactamente. Los estudios de Schultz mostraron que las neuronas dopaminérgicas informan sobre la sorpresa, sobre la distancia entre lo esperado y lo obtenido, más que sobre el disfrute en sí. La experiencia placentera depende en mayor medida de otros sistemas, entre ellos los opioides endógenos. La dopamina se relaciona más con el deseo, la motivación para buscar y el aprendizaje.

¿Qué descubrieron Olds y Milner?

Que una rata con un electrodo implantado en determinadas regiones del cerebro pulsaba una palanca una y otra vez para recibir una breve descarga, sin ninguna otra recompensa a cambio. El experimento, publicado en 1954 por James Olds y Peter Milner en la Universidad McGill, inauguró el estudio biológico de la recompensa.

¿Por qué cuesta tanto preferir una recompensa grande pero lejana?

Porque el cerebro rebaja el valor de lo que tarda en llegar, y lo rebaja de forma desproporcionada cuando la alternativa está al alcance de la mano. Es el descuento temporal. Su intensidad varía de una persona a otra y se mantiene bastante estable en cada individuo, lo que ha llevado a estudiarlo como un rasgo medible.

Referencias

  1. National Institute on Drug Abuse (NIDA). Entendiendo el uso de drogas y la adicción. DrugFacts. NIH.
  2. Schultz W, Dayan P, Montague PR. A neural substrate of prediction and reward. Science. 1997;275(5306):1593-9.
  3. Olds J, Milner P. Positive reinforcement produced by electrical stimulation of septal area and other regions of rat brain. J Comp Physiol Psychol. 1954;47(6):419-27.
  4. Changing delay discounting and impulsive choice: implications for addictions, prevention, and human health. PubMed Central.
  5. Real Academia Española. Recompensar. Diccionario de la lengua española.

Entradas relacionadas

  • Área septal. Región del prosencéfalo basal donde se describió por primera vez la autoestimulación cerebral.
  • Refuerzo. Consecuencia que aumenta la probabilidad de que una conducta se repita.
  • Refuerzo secundario. Estímulo que adquiere valor por su asociación con un refuerzo primario.
  • Anhedonia. Incapacidad para experimentar placer en actividades que antes resultaban gratificantes.
  • Adicción. Búsqueda compulsiva de una sustancia o conducta ligada a cambios en los circuitos de recompensa.
  • Impulsividad. Tendencia a actuar sin valorar las consecuencias, relacionada con el descuento de las recompensas demoradas.
  • Motivación intrínseca. Impulso a realizar una actividad por la satisfacción que produce en sí misma.

La información proporcionada en este Diccionario Médico de la Clínica Universidad de Navarra tiene como objetivo principal ofrecer un contexto y entendimiento general sobre términos médicos y no debe ser utilizada como fuente única para tomar decisiones relacionadas con la salud. Esta información es meramente informativa y no sustituye en ningún caso el consejo, diagnóstico, tratamiento o recomendaciones de profesionales de la salud. Siempre es esencial consultar a un médico o especialista para tratar cualquier condición o síntoma médico. La Clínica Universidad de Navarra no se responsabiliza por el uso inapropiado o la interpretación de la información contenida en este diccionario.
Infografías realizadas con https://BioRender.com

© Clínica Universidad de Navarra 2026