Podcasts

Filtered to LLM-as-Judge · clear filter

Browse by topic

Reinforcement learning 11AI agents 10recursive self-improvement 7AI safety 6Diffusion models 5formal verification 5Agentic AI 4AI ethics 3AI infrastructure 3Code generation 3Human-AI collaboration 3Mechanistic interpretability 3multi-agent systems 3Open Source AI 3Scaling laws 3Synthetic data generation 3Venture capital 3world models 3Agent architecture 2Computational complexity 2Context engineering 2Continual learning 2Continuous learning 2Data generation 2Developer experience 2Drug discovery 2Foundation models 2GPU infrastructure 2Lab automation 2LLM inference 2

Matching episodes

The RL Fine-Tuning Playbook: CoreWeave's Kyle Corbitt on GRPO, Rubrics, Environments, Reward Hacking

"The Cognitive Revolution" | AI Builders, Researchers, and Live Player Analysis · 1 MAY 2026 · 107 min

Kyle Corbitt, founder of OpenPipe and leader of CoreWeave's serverless training team, provides a master class on reinforcement learning (RL) and custom fine-tuning for AI models. He explains how RL differs from supervised fine-tuning (S…