Inteligência Artificial
Reinforcement learning: como o robô de 400m reinventou a corrida
Reinforcement learning fez um robô descobrir uma corrida mais eficiente que a humana — aprendi que penalidade térmica no reward evita destruir o hardware.
Ler artigo completo