# ¿Qué es Reinforcement Learning?

La inteligencia artificial aprende a tomar las decisiones correctas mediante prueba y error y utilizando el mecanismo de recompensa.

## Definición
En este método, a la inteligencia artificial no se le dice directamente qué hacer. En cambio, se mueve por un entorno y recibe una recompensa (puntos) o una penalización por cada acción que realiza. Con el tiempo, desarrolla la estrategia que maximizará su recompensa.

## Cómo funciona
La inteligencia artificial lo intenta miles de veces en una simulación. Al mismo tiempo que aumenta el valor de los movimientos exitosos, elimina los incorrectos y encuentra la manera que da los mejores resultados.

## Dónde se usa
Se utiliza en juegos de inteligencia artificial, control de movimiento robótico y estrategias de transacciones financieras.

## Suele confundirse con
Puede confundirse con el aprendizaje supervisado; En este caso se da la respuesta correcta, en este caso solo se premia el resultado.

## Preguntas frecuentes
**¿Por qué lleva tanto tiempo?**
Porque para que el sistema encuentre la verdad, necesita hacer muchos intentos y aprender de cada intento.


## Términos relacionados
- [RLHF](/es/dictionary/rlhf/)
- [Deep Learning](/es/dictionary/deep-learning/)
- [Machine Learning](/es/dictionary/machine-learning/)

## Herramientas relacionadas
- [Prime Agent](/es/discover/prime-agent/)
- [Miles](/es/discover/miles/)
- [Microduck Rl](/es/discover/microduck-rl/)

---
Fuente: TreScout Glosario · https://trescout.com/es/dictionary/reinforcement-learning/
