Methodologie · 4 MIN

Prompt engineering versus context engineering: geen rebranding, een verschuiving van wat u optimaliseert

Prompt engineering formuleert een instructie. Context engineering ontwerpt de hele lading die het model ziet, binnen een tokenbudget.

Prompt engineering versus context engineering: geen rebranding, een verschuiving van wat u optimaliseert
LOCATIE
Wereldwijd
AUTEUR
Sayan Sinha
GEPUBLICEERD
25 jun 2026
BEELD
AI-GEGENEREERD

Vertaling automatisch gegenereerd met AI. De Duitse versie is het redactioneel gecontroleerde origineel.

Context engineering is geen rebranding van prompt engineering. Het is een verschuiving van het object dat u optimaliseert. Prompt engineering stemt een tekenreeks af: de formulering van een enkele instructie. Context engineering ontwerpt een systeem: de volledige tokenlading die het model tijdens inferentie leest, samengesteld uit de systeemprompt, opgehaalde documenten, tooldefinities, geheugen en gespreksgeschiedenis, binnen een eindig budget. De verschuiving gebeurde om een concrete reden, niet uit trend. Productiewerk ging van losse chatbeurten over naar agenten die context dynamisch over veel beurten samenstellen, en het empirisch bewijs doodde de aanname dat een groter contextvenster alles oplost.

01. Het werkelijke verschil, in telkens één zin

Prompt engineering is een instructie goed formuleren. Context engineering is beslissen wat het model eigenlijk te zien krijgt. De term werd in juni 2025 gepopulariseerd door Shopify's Tobi Lutke en versterkt door Andrej Karpathy, die hem omschreef als de kunst om het contextvenster te vullen met precies de juiste informatie voor de volgende stap. Het scherpste onderscheid komt van Philipp Schmid: context is alles wat het model ziet voordat het een antwoord genereert, en dat is een systeem, geen tekenreeks.

De twee zijn geen rivalen; prompt engineering is een deelverzameling. Wanneer u een goede systeemprompt schrijft, is dat prompt engineering. Wanneer u beslist welke drie documenten worden opgehaald, welke tools u vrijgeeft, hoeveel geschiedenis u behoudt, wat u weglaat en welk uitvoerschema u vereist, allemaal binnen een tokenbudget, is dat context engineering. Anthropics eigen richtlijn omschrijft dit als het beheren van de volledige contexttoestand over beurten heen, en de scherpste zin daarin is er een om te onthouden: context is een eindige bron met afnemend grensnut.

02. Waarom het veld verschoof, en het was geen trend

De reden waarom context engineering een benoemde discipline werd, is dat de gemakkelijke aanname onder meting instortte. De aanname was dat modellen met een lange context het venster laten volstoppen en gewoon ophouden na te denken. Chroma's context-rotstudie testte in juli 2025 18 frontier-modellen en ontdekte dat elk model degradeert naarmate de invoer groeit, vaak op een inconsistente manier: het model behandelt het tienduizendste token niet zo betrouwbaar als het honderdste. De oudere lost-in-the-middle-bevinding wees in dezelfde richting.

Twee krachten maakten de lading, niet de prompt, tot het ding dat geengineerd moet worden. Ten eerste: agenten, tool-gebruik, retrieval en geheugen betekenen dat de context over veel beurten door een systeem wordt samengesteld, niet eenmalig met de hand geschreven. Ten tweede de economie: in productie bij Manus ligt de verhouding van invoer- tot uitvoertokens rond 100 tot 1, en het hergebruik van de key-value-cache stuurt een groot kostenverschil aan. Wat in het venster terechtkomt, is dus net zozeer een kostenbeslissing als een kwaliteitsbeslissing. Meer context is niet beter; gebudgetteerde, relevante context is dat wel. Dat is de empirische ruggengraat onder onze eerdere bespreking van context engineering en waarom het telt.

03. Waaruit context engineering werkelijk bestaat

Bevrijd van het etiket is context engineering een verzameling toetsbare praktijken, geen prompt-fluisteren. De benoemde technieken keren terug bij Anthropic, LangChain en het Manus-productierapport:

  • Retrieval. Haal de paar relevante documenten op op het moment dat ze nodig zijn, in plaats van alles erin te kopieren. Dat is de discipline achter Retrieval-Augmented Generation.
  • Verdichting en samenvatting. Comprimeer oude beurten tot een lopende samenvatting, zodat het budget wordt besteed aan wat leeft, niet aan het transcript.
  • Geheugen en notities. Sla toestand op in externe notities of bestanden die de agent kan teruglezen, in plaats van hem in het venster mee te dragen.
  • Toolcuratie. Houd drie tot vijf kerntools geladen en haal de rest precies op tijd erbij. Elke geladen tool verdunt het signaal en breekt de cache.
  • Gestructureerde uitvoer. Vereis een schema, zodat het model tokens uitgeeft aan het antwoord, niet aan opmaakproza.
  • Isolatie. Verdeel werk over subagenten, zodat elk alleen de context ziet die hij nodig heeft.

LangChain omschrijft dezelfde verzameling als schrijven, selecteren, comprimeren en isoleren. Het punt is dat elk daarvan meetbaar is: u kunt een retriever, een verdichtingsdrempel of een tooluitrusting A/B-testen, en precies dat maakt dit tot engineering in plaats van formulering.

04. Is het alleen een rebranding? Het eerlijke antwoord

Deels, en dat is prima. Ja, goede ingenieurs curateerden al wat het model ziet; de waarde van de naam is dat hij de optimalisatie richt op de lading en het systeem, niet op de zin, waar betrouwbaarheid en kosten daadwerkelijk zitten. Het lopende debat is nuttiger dan de terminologiestrijd. In juni 2025 pleitte Cognition tegen multi-agentsystemen, met als argument dat het moeilijk is om context netjes tussen agenten te delen, en beval aan werk enkelvoudig te houden en volledige traces te delen. In dezelfde week beschreef Anthropic een multi-agent-onderzoekssysteem dat afhankelijk is van gedisciplineerde contextisolatie. Dezelfde discipline, tegengestelde architecturale conclusie.

Voor een team dat met LLM's bouwt, zijn de lessen eenvoudig. Budgetteer tokens zoals u rekenkracht budgetteert, want meer is niet gratis en niet altijd beter. Behandel het werk als bedrading (retrievalkwaliteit, verdichting, geheugen, toolcuratie, gestructureerde uitvoer), niet als formulering. En kies uw architectuur op basis van hoe betrouwbaar u context kunt delen, niet op basis van welke aanpak geavanceerder klinkt. De naam zal blijven muteren, sommigen noemen de volgende laag al harness engineering, maar het object is stabiel: het systeem dat beslist wat het model te zien krijgt.

← Signals

Wayne Dyer

“Als u de manier waarop u naar dingen kijkt verandert, veranderen de dingen waar u naar kijkt.”