Firehose

Filtered to Podcasts, tagged “RL Environments” · clear filters

All PeopleCompaniesPapersPodcastsHacker News

Browse by tag

1 MAY 2026 · Podcast · "The Cognitive Revolution" | AI Builders, Researchers, and Live Player Analysis

Kyle Corbitt, founder of OpenPipe and leader of CoreWeave's serverless training team, provides a master class on reinforcement learning (RL) and custom fine-tuning for AI models. He explains how RL differs from supervised fine-tuning (SFT) …