Build Hour: reinforcement fine-tuning
Titel en omschrijving vertaald uit het Engels met AI.
- 3 sep. 2025
- 0 reacties
Maak er iets van
Schrijf je eigen kijk op deze video of zet de discussie open op het forum. De video staat er al in.
Over deze video
Met reinforcement fine-tuning (RFT) verbeter je hoe modellen redeneren door te trainen met graders in plaats van met grote gelabelde datasets. Deze Build Hour laat zien hoe je taken opzet, beoordelingsfuncties ontwerpt en efficiënte trainingsloops draait met maar een paar honderd voorbeelden. Prashant Mital en Theophile Sautory (Applied AI) behandelen: - Introductie tot RFT: optimalisatie, opties voor fine-tuning, voordelen van RFT - Taken opzetten: prompts, graders en trainings- en validatiedata - Live demo: RFT bouwen en draaien voor een classificatietaak - De RFT-workflow: van datasetselectie tot evalueren en itereren - Klant in de spotlight: Accordance gebruikt RFT-modellen voor belasting- en boekhoudworkflows (https://accordance.com/) - Live Q&A 👉 Volg mee met de coderepo: https://github.com/openai/build-hours 👉 RFT Cookbook: https://cookbook.openai.com/examples/reinforcement_fine_tuning 👉 Gids met RFT-toepassingen: https://platform.openai.com/docs/guides/rft-use-cases 👉 Meld je aan voor komende live Build Hours: https://webinar.openai.com/buildhours
0 reacties
Nog geen reacties. Wees de eerste!
Log in om te reageren.
Inloggen of word lid