Naar inhoud

The Next Input is in bèta. Iets kapot of een idee? Meld het op het forum · Welkom!

Waarom Tejal Patwardhan de modellen niet meer onderschat - aflevering 21 Why Tejal Patwardhan stopped underestimating the models - Episode 21

Titel en omschrijving vertaald uit het Engels met AI. Titel en omschrijving zoals de maker ze schreef.

OpenAI @openai
  • 16 jun. 2026
  • 0 reacties

Maak er iets van

Schrijf je eigen kijk op deze video of zet de discussie open op het forum. De video staat er al in.

Over deze video

De oude tests worden te makkelijk. Tejal Patwardhan leidt het frontier-evals-team van OpenAI, dat nieuwe manieren zoekt om vooruitgang te meten en te voorspellen nu modellen steeds capabeler worden. Met host Andrew Mayne bespreekt ze waarom evals belangrijk zijn voor onderzoek, hoe benchmarks kapot kunnen gaan of gemanipuleerd worden, en waarop modellen hierna beoordeeld moeten worden. Hoofdstukken 00:00:24 Opgroeien bij OpenAI 00:03:10 Waarom reasoning alles veranderde 00:06:28 Wat o1 zo verrassend maakte 00:11:20 Waarom oude benchmarks niet meer werkten 00:14:45 Wat een goede benchmark maakt 00:17:35 Waarom evals steeds moeilijker worden 00:22:09 Spraak- en beeldmodellen meten 00:24:48 Modellen testen op echte wetenschap 00:33:23 Hoe OpenAI de vooruitgang aan de frontier volgt 00:40:47 Wat AI betekent voor werk

0 reacties

Nog geen reacties. Wees de eerste!

Log in om te reageren.

Inloggen of word lid
Reactie verwijderen?

De tekst verdwijnt. In de draad blijft staan dat hier een reactie is verwijderd, zodat antwoorden erop nog te volgen zijn.