fccoelho / fccoelho/Reinforcement-Learning-course

Apresentações 2025

Open
#45 3 comments 0 reactions 0 assignees View on GitHub
Dominant language
Jupyter Notebook
Stars
45
Forks
5
PR merge metrics
No merged PRs in 30d

Description

Cada grupo deve apresentar um artigo e preparar 5 perguntas para outro grupo.
|Grupo| Data | Artigo | Grupo que fará perguntas |
-----------|---------|----------|----------------------------------------|
| 1. Bryan Monteiro, Nicholas Costa, Sofia Monteiro |7/10/25 |[Deep Q-Network](https://storage.googleapis.com/deepmind-media/dqn/DQNNaturePaper.pdf) | grupo 10 |
| 2. Jaime Willian, Luiz Eduardo, Walléria Simões|7/10/25 |[Double DQN](https://arxiv.org/pdf/1509.06461.pdf) | grupo 14 |
| 3. João Pedro Jerônimo, Thalis Ambrosim Falqueto, Alex Júnio Maia|7/10/25 |[Quantile Regression DQN](https://arxiv.org/pdf/1710.10044.pdf) | grupo 13|
| 4. Henrique Coelho Beltrão, Henrique Gabriel Gasparelo, José Thevez Gomes Guedes| 8/10/25 | [Implicit Quantile Network](https://arxiv.org/pdf/1806.06923.pdf)| grupo 12|
| 5. Santiago Ferreyra, Marcelo Baez, Leighton Estrada|8/10/25 |[Policy Gradient](https://papers.nips.cc/paper/1713-policy-gradient-methods-for-reinforcement-learning-with-function-approximation.pdf) |grupo 1 |
| 6. Lucas Westfal, Amanda Perez|8/10/25 | [Proximal Policy Optimization](https://arxiv.org/pdf/1707.06347.pdf)| grupo 7|
| 7. Juliano Genari de Araujo, Isaque Vieira Machado Pim, Eduardo Vianna|14/10/25 |[Deep Deterministic Policy Gradient](https://arxiv.org/pdf/1509.02971.pdf) |grupo 9 |
| 8. Heitor Trielli, Francisco Kuchpil |14/10/25| [Soft Actor-Critic](https://arxiv.org/pdf/1812.05905.pdf)|grupo 5 |
| 9. Vinício Vasconcelos Muniz Deusdará, Lucas Dressler Sodré, Roger Vinícius Pereira Augusto|14/10/25 |[Conservative Q-Learning](https://arxiv.org/pdf/2006.04779.pdf) |grupo 3 |
| 10. Artur Vidal Krause, Bruno Luís Zerbinatto Rosa, Gustavo Luciano dos Santos|21/10/25 | [Critic Regularized Regression](https://arxiv.org/pdf/2006.15134.pdf)| grupo 6 |
| 11. Isaías Gouvêa Gonçalves, Joyce Figueró Braga|21/10/25 |[Generative Adversarial Imitation Learning](https://arxiv.org/pdf/1606.03476.pdf) |grupo 2 |
| 12. Joel Perca, Andres De La Puente, Luis Sante|21/10/25 |[Posterior Sampling Reinforcement Learning](https://arxiv.org/abs/2305.00477) |grupo 8 |
|13. Laio Magalhães, Matheus Pinto|22/10/25 |[Intrinsic Curiosity Module](https://arxiv.org/pdf/1705.05363.pdf) |grupo 11 |
| 14. Gustavo Ramalho, Raul Lomonte|22/10/25 | [Hindsight Experience Replay](https://arxiv.org/pdf/1707.01495.pdf)|grupo 4 |

As apresentações devem ser de no máximo 20 minutos com slides.

As apresentações começarão dia 30 de setembro na ordem da tabela acima com 3 grupos por aula.

Contributor guide

No contributing guide indexed for this repository

Assessment

This issue has not been assessed yet.

Get new issues in your inbox

A short digest of beginner-friendly GitHub issues.