
Beskrivelse
Vi ser på OpenAI’s kontroversielle matematiske gennembrud, Slow AI development og the Last AI build by Humans I det dybe dyk kigger vi bag facaden på AI-benchmarks som HLE, ARC-AGI og SWE-bench – for kan vi overhovedet stole på testresultaterne, eller optimerer vi mod det forkerte? Til sidst får du ugens anbefaling: Giv ikke din AI fri adgang til din PC See omnystudio.com/listener for privacy information.
Vurdér episoden
Hvad synes du om episoden?
Din vurdering hjælper andre lyttere