Wat is prompt engineering? Het ontwerpen en testen van instructies zodat een AI-model betrouwbaar hetzelfde doet.
Prompt engineering is het vak van instructies zo ontwerpen, variëren en testen dat een taalmodel een taak telkens op dezelfde betrouwbare manier doet. Het gaat niet om een magische zinswending maar om werk: de taak ontleden, context en voorbeelden kiezen, randgevallen uitproberen en vastleggen wat werkt. Waar formulering ophoudt, begint de echte opbouw van een toepassing.
Het begint met de taak lezen zoals een nieuwe collega die zou lezen. Wat is de invoer en hoe varieert die? Wat is gewenste uitvoer, in welke vorm? Wat moet er gebeuren bij twijfel. Een schatting wagen of het laten? Vanuit die vragen bouw je de instructie op: rol en doel, de regels, de bronnen die mogen meewegen, en een of meer voorbeelden die laten zien wat goed is.
Daarna komt het deel dat het verschil maakt met knip-en-plakwerk: testen. Je verzamelt voorbeelden uit de praktijk, ook de lastige, en controleert of de instructie bij elk voorbeeld het juiste resultaat geeft. Faalt hij op een randgeval, dan scherp je aan. Of je concludeert dat een instructie hier niet toereikend is en de taak meer nodig heeft: opgezochte kennis, een koppeling, een controlestap. Zo verandert een gok in een bewijs.
Prompt engineering is dus geen postvak met trucjes, maar het voorportaal van het echte ontwerp. De grens is eerlijk: instructies zijn geen product. Ze zijn het lichtste eerste middel, en precies daarom proberen we altijd eerst hoe ver formulering brengt. Voordat we zwaarder gereedschap pakken dat duurder bouwt en onderhoudt.
De moeite waard is het bijna altijd, want het is de kortste route om te ontdekken wat een model voor jouw taak kan. Een middag gericht testen leert meer dan een maand discussiëren. Zeker bij taken als samenvatten, herschrijven, classificeren of een eerste concept opstellen is een gedisciplineerde instructie vaak het hele verschil tussen nutteloos en bruikbaar.
Niet genoeg is het wanneer de taak kennis vraagt die niet in de instructie past, wanneer het antwoord uit jullie eigen systemen moet komen, of wanneer een afwijking duur is. Dan volgen RAG, koppelingen met controles en evaluatie in plaats van nog meer woorden. En wie promptwerk als product verkoopt zonder test en onderhoud, levert iets af dat bij de eerstvolgende modelupdate stilletjes anders gaat lopen.
We starten elk traject met de lichtste stap: een instructie die we tegen echte voorbeelden uit jouw werk testen. Wat daar op basis van formulering al werkt, houden we licht. Wat niet bewijsbaar werkt, bouwen we verder uit met kennis, tools en controles. En we leggen bij elk onderdeel vast waarom het er staat. Zo betaal je alleen voor zwaardere techniek die ook bewezen nodig is.
Als het antwoord kennis nodig heeft die niet in een instructie past, zoals jullie eigen voorwaarden of klantdossiers; als het model iets moet dóén in een systeem in plaats van iets te schrijven; en als een afwijkend antwoord geld of vertrouwen kost. Dan is een instructie het eerste onderdeel, niet de oplossing: kennis wordt opgezocht, acties gaan via koppelingen met rechten, en controles vangen wat erdoorslipert. Formuleren is stap één, nooit de hele ladder.
Door hem te meten, niet te lezen. We verzamelen echte voorbeelden van de taak (de makkelijke en vooral de lastige) en draaien de instructie er telkens tegenaan, ook na elke wijziging. Zo zie je in cijfers of iets verbeterde, gelijk bleef of achteruitging. Zonder zo'n testset is 'het lijkt wel te werken' het enige bewijs, en dat houdt geen modelupdate of nieuwe invoersoort vol.
Nee, en het verschil bepaalt je kosten. Bij promptwerk blijft het model ongewijzigd; je stuurt alleen mee wat het per vraag te zien krijgt. Trainen (fine-tuning) verandert het model zelf met eigen voorbeelden, wat data, tijd en doorlopend onderhoud vraagt. De volgorde in de praktijk: eerst instrueren, dan kennis meeleveren, en pas bijtrainen als dat bewezen tekortschiet. Bijvoorbeeld voor een vaste stijl of een taakvorm die instructies niet vasthouden.
Meestal minder dan je verwacht, omdat we beginnen bij de kleinste bewijsbare stap: één taak, een testset van echte voorbeelden, en een rapport wat wel en niet betrouwbaar werkt. Van daaruit bepaal je wat verder uitgebouwd wordt. We offreren per project, op basis van scope en complexiteit. Er is geen prijslijst en geen pakket. Wat je wel vóóraf krijgt, is duidelijk wat er getest wordt en op welk resultaat je mag afrekenen.
EIGHTY8