← Catalogo / ARTIFICIAL INTELLIGENCE

Reinforcement Learning: An Introduction (2nd ed)

Sutton & Barto·Tecnico duro· 548 pag · fase 7PDF en discoLicencia libre
Demasiado pronto

Demasiado pronto. Te faltan 1 prerrequisito(s). Empezarlo ahora es la forma mas comun de perder tiempo: vas a leer sin entender y vas a tener que volver.

Progreso
0%
0 de 548 paginas
Estado
Sin empezar
importante
Sesiones
0
0 paginas registradas
Desbloquea
0
no es prerrequisito de nada
Por que leerlo

LA referencia de RL, sin competencia. Sutton practicamente invento el campo. Base de RLHF, que es como se alinean los LLMs que usas.

Proyecto que demuestra que lo dominas

Implementa: Q-learning tabular, DQN, y REINFORCE. Entrena un agente en Gymnasium.

Estas listo?

Demasiado pronto. Te faltan 1 prerrequisito(s). Empezarlo ahora es la forma mas comun de perder tiempo: vas a leer sin entender y vas a tener que volver.

Prerrequisitos duros