Build Hour: prompt caching
Titel en omschrijving vertaald uit het Engels met AI.
- 18 feb. 2026
- 0 reacties
Maak er iets van
Schrijf je eigen kijk op deze video of zet de discussie open op het forum. De video staat er al in.
Over deze video
Bouw sneller, goedkoper en met minder latency dankzij prompt caching. Deze Build Hour legt uit hoe prompt caching werkt en hoe je je prompts ontwerpt om zoveel mogelijk cache hits te krijgen. Leer wat er echt wordt gecachet, wanneer caching van toepassing is en hoe kleine wijzigingen in je prompts een grote impact kunnen hebben op kosten en prestaties. Erika Kettleson (Solutions Engineer) behandelt: • Wat prompt caching is en waarom het belangrijk is voor apps in de praktijk • Hoe cache hits werken (prefixes, token-drempels en continuïteit) • Best practices zoals het gebruik van de Responses API en prompt_cache_key • Hoe je de cache hit rate, latency en tokenbesparing meet • Customer Spotlight: Warp (ttps://www.warp.dev/) onder leiding van Suraj Gupta (Team Lead) legt de impact van prompt caching uit 👉 Documentatie over prompt caching: https://platform.openai.com/docs/guides/prompt-caching 👉 Prompt Caching 101 Cookbook: https://developers.openai.com/cookbook/examples/prompt_caching101 👉 Prompt Caching 201 Cookbook: https://developers.openai.com/cookbook/examples/prompt_caching_201 👉 Volg mee met de coderepo: http://github.com/openai/build-hours 👉 Meld je aan voor komende live Build Hours: https://webinar.openai.com/buildhours 00:00 Introductie 02:37 Basis, werking, API-walkthrough 12:11 Demo: batchverwerking van afbeeldingen 16:55 Demo: vertakkende chat 26:02 Demo: compaction bij langlopende taken 32:39 Overzicht van prijzen met cachekorting 36:03 Customer Spotlight: Warp 49:37 Q&A
0 reacties
Nog geen reacties. Wees de eerste!
Log in om te reageren.
Inloggen of word lid