Waarom Tejal Patwardhan de modellen niet meer onderschat - aflevering 21
Titel en omschrijving vertaald uit het Engels met AI.
- 16 jun. 2026
- 0 reacties
Maak er iets van
Schrijf je eigen kijk op deze video of zet de discussie open op het forum. De video staat er al in.
Over deze video
De oude tests worden te makkelijk. Tejal Patwardhan leidt het frontier-evals-team van OpenAI, dat nieuwe manieren zoekt om vooruitgang te meten en te voorspellen nu modellen steeds capabeler worden. Met host Andrew Mayne bespreekt ze waarom evals belangrijk zijn voor onderzoek, hoe benchmarks kapot kunnen gaan of gemanipuleerd worden, en waarop modellen hierna beoordeeld moeten worden. Hoofdstukken 00:00:24 Opgroeien bij OpenAI 00:03:10 Waarom reasoning alles veranderde 00:06:28 Wat o1 zo verrassend maakte 00:11:20 Waarom oude benchmarks niet meer werkten 00:14:45 Wat een goede benchmark maakt 00:17:35 Waarom evals steeds moeilijker worden 00:22:09 Spraak- en beeldmodellen meten 00:24:48 Modellen testen op echte wetenschap 00:33:23 Hoe OpenAI de vooruitgang aan de frontier volgt 00:40:47 Wat AI betekent voor werk
0 reacties
Nog geen reacties. Wees de eerste!
Log in om te reageren.
Inloggen of word lid