Naar inhoud

The Next Input is in bèta. Iets kapot of een idee? Meld het op het forum · Welkom!

Build Hour: reinforcement fine-tuning Build Hour: Reinforcement Fine-Tuning

Titel en omschrijving vertaald uit het Engels met AI. Titel en omschrijving zoals de maker ze schreef.

OpenAI @openai
  • 3 sep. 2025
  • 0 reacties

Maak er iets van

Schrijf je eigen kijk op deze video of zet de discussie open op het forum. De video staat er al in.

Over deze video

Met reinforcement fine-tuning (RFT) verbeter je hoe modellen redeneren door te trainen met graders in plaats van met grote gelabelde datasets. Deze Build Hour laat zien hoe je taken opzet, beoordelingsfuncties ontwerpt en efficiënte trainingsloops draait met maar een paar honderd voorbeelden. Prashant Mital en Theophile Sautory (Applied AI) behandelen: - Introductie tot RFT: optimalisatie, opties voor fine-tuning, voordelen van RFT - Taken opzetten: prompts, graders en trainings- en validatiedata - Live demo: RFT bouwen en draaien voor een classificatietaak - De RFT-workflow: van datasetselectie tot evalueren en itereren - Klant in de spotlight: Accordance gebruikt RFT-modellen voor belasting- en boekhoudworkflows (https://accordance.com/) - Live Q&A 👉 Volg mee met de coderepo: https://github.com/openai/build-hours 👉 RFT Cookbook: https://cookbook.openai.com/examples/reinforcement_fine_tuning 👉 Gids met RFT-toepassingen: https://platform.openai.com/docs/guides/rft-use-cases 👉 Meld je aan voor komende live Build Hours: https://webinar.openai.com/buildhours

0 reacties

Nog geen reacties. Wees de eerste!

Log in om te reageren.

Inloggen of word lid
Reactie verwijderen?

De tekst verdwijnt. In de draad blijft staan dat hier een reactie is verwijderd, zodat antwoorden erop nog te volgen zijn.