reinforcement-learning

28 talks

Einstein Arena: Harnessing Collective Agent Intelligence for Open ScienceJames Zou, Together AI · 16:56 · Aug 2026 · 1,820 views · AI Engineer World's Fair 2026Trading Desks to Clinical Trials: Parallels in Applied Vertical AIAyush Bhardwaj, Allos AI · 20:02 · Aug 2026 · 1,314 views · AI Engineer World's Fair 2026Training Krea 2: What Matters in Generative Model TrainingSangwu Lee, Krea.ai · 21:46 · Aug 2026 · 952 views · AI Engineer World's Fair 2026From RL to IRLGaurav Mishra, Amazon AGI Lab · 17:46 · Aug 2026 · 1,686 views · AI Engineer World's Fair 2026Scaling Compute on ContextJack Morris, Engram · 19:42 · Aug 2026 · 872 views · AI Engineer World's Fair 2026Scaling up Continual LearningRonak Malde, Trajectory · 23:03 · Aug 2026 · 2,535 views · AI Engineer World's Fair 2026Taking Reinforcement Learning Cross DatacenterNan Jiang, Modal · 19:50 · Aug 2026 · 1,982 views · AI Engineer World's Fair 2026Local Models: Trust, Control, OptimizationCarter Abdallah, NVIDIA & Vincent Weisser, Prime Intellect & Lucas Atkins, Arcee AI & Chris Alexiuk, NVIDIA · 43:21 · Aug 2026 · 12K views · AI Engineer World's Fair 2026Teaching AI to Find Real VulnerabilitiesDavid Brumley, Bugcrowd · 27:17 · Aug 2026 · 2,679 views · AI Engineer World's Fair 2026Agents at Scale: Inside MiniMax's Model and the Infrastructure Behind ItDan Fu, Together AI & Olive Song, MiniMax · 20:14 · Jul 2026 · 1,356 views · AI Engineer World's Fair 2026Data and Environment Curation for Post-Training LLMsMahesh Sathiamoorthy, Bespoke Labs · 19:12 · Jul 2026 · 1,145 views · AI Engineer World's Fair 2026Ending AI SlopThais Castello Branco, Taste Labs · 16:30 · Jul 2026 · 8,101 views · AI Engineer World's Fair 2026Learning on the Job: The Future of Post-TrainingRaymond Feng, Applied Compute · 18:20 · Jul 2026 · 5,480 views · AI Engineer World's Fair 2026Reinforcement Learning without Verifiable RewardsWill Brown, Prime Intellect · 19:27 · Jul 2026 · 4,097 views · AI Engineer World's Fair 2026Scaling to Long HorizonsRoss Taylor & Chengxi Taylor, General Reasoning · 18:07 · Jul 2026 · 1,479 views · AI Engineer World's Fair 2026The Base Model Is DeadVarun Singh, Arcee AI · 17:45 · Jul 2026 · 1,177 views · AI Engineer World's Fair 2026What's Next After RLHF?Diogo Almeida, TypeSafe AI · 18:05 · Jul 2026 · 1,898 views · AI Engineer World's Fair 2026Why Off-the-Shelf AI Doesn't Understand MoneyUdi Menkes, Intuit · 19:50 · Jul 2026 · 1,022 views · AI Engineer World's Fair 2026Everything Is a RolloutAlex Shaw & Ryan Marten, Laude Institute · 21:11 · Jul 2026 · 1,524 views · AI Engineer World's Fair 2026Harness Engineering is Not Enough: Why Software Factories FailDex Horthy, HumanLayer · 19:18 · Jul 2026 · 64K views · AI Engineer World's Fair 2026Local Agentic Theory For Mobile GamesShafik Quoraishee & Joanne Song, The New York Times · 18:04 · Jul 2026 · 1,061 views · AI Engineer World's Fair 2026Special Topics in Kernels, RL, Reward Hacking in AgentsDaniel Han, Unsloth · 2:20:21 · Jul 2026 · 14K views · AI Engineer World's Fair 2026Computer-Use 2.0: Agents Just Got Multi-CursorFrancesco Bonacci, Cua · 16:41 · Jul 2026 · 4,263 views · AI Engineer World's Fair 2026Recursive Model ImprovementLee Robinson, Cursor · 20:32 · Jul 2026 · 8,187 views · AI Engineer World's Fair 2026Modern Post-Training: A Deep DiveWill Brown, Prime Intellect · 46:52 · Jul 2026 · 9,760 views · AI Engineer World's Fair 2026How We Taught Agents to Use Good RetrievalHanna Lichtenberg, Mixedbread AI · 14:28 · Jul 2026 · 1,815 views · AI Engineer World's Fair 2026Continual Learning for AI Agents: From Failures to Durable ImprovementsSoheil Feizi, RELAI · 22:35 · Jul 2026 · 3,643 views · AI Engineer World's Fair 2026Stop Making Models Bigger, Make Them BehaveKobie Crawford, Snorkel · 20:56 · Jun 2026 · 51K views · AI Engineer Europe 2026