242: Aprendizado por reforço, com Quentin Gallouédec, PhD. (Hugging Face)

242: Aprendizado por reforço, com Quentin Gallouédec, PhD. (Hugging Face)

April 15, 2026 · 46 min

About this episode

O episódio explora o impacto do aprendizado por reforço na Hugging Face e no mercado de IA generativa.

Nesta semana, voltamos a falar sobre o histórico, os processos, e o impacto da técnica de aprendizado por reforço dentro da Hugging Face, e no mercado de IA generativa em geral. Vem ver quem participou desse papo: ⁠⁠Marcus Mendes⁠⁠ , host sob controle ⁠⁠Fabrício Carraro⁠⁠ , co-host sob controle, Program Manager da Alura, ⁠⁠autor de IA⁠⁠ e host do podcast Carreira Sem Fronteiras Quentin Gallouédec, PhD , Engenheiro de Pesquisa na Hugging Face Links: Imersão IA Sob Controle no Vale do Silício Entrevista original em inglês com Quentin Gallouédec, PhD TRL v1.0 172: Zachary Mueller, líder técnico de Accelerate no Hugging Face 236: O significado de inteligência na era dos LLMs, com Adrian Valentim 238: Por que a Hugging Face não quer ser um frontier lab, com Leandro von Werra Estudo de esconde-esconde da OpenAI Treinando Pokémon com aprendizado por reforço Quer ir com o Fabrício Carraro, o Marcus Mendes e o Paulo Silveira na “ Imersão IA Sob Controle e Alura no Vale do Silício “? Vagas limitadas, corra para reservar a sua! Inscreva-se na ⁠⁠ Newsletter IA Sob Controle⁠⁠ , e receba notícias semanais sobre Inteligência Artificial, assinada por Fabrício Carraro. ⁠⁠Preencha o formulário⁠⁠…

More episodes of IA Sob Controle - Inteligência Artificial

Explore listener stats, chart rankings, contacts and more on the IA Sob Controle - Inteligência Artificial podcast page.