本站提供正體中文版。切換到正體中文本站提供简体中文版。切换到简体中文This site is available in English.View in Englishこのサイトには日本語版があります。日本語で表示이 사이트는 한국어로도 제공됩니다.한국어로 보기Diese Website ist auch auf Deutsch verfügbar.Auf Deutsch ansehenEste sitio web también está disponible en español.Ver en españolQuesto sito è disponibile anche in italiano.Visualizza in italianoCe site est également disponible en français.Afficher en françaisEste site também está disponível em português.Ver em portuguêsЭтот сайт также доступен на русском языке.Смотреть на русскомयह वेबसाइट हिन्दी में भी उपलब्ध है।हिन्दी में देखेंهذا الموقع متاح أيضًا باللغة العربية.عرض بالعربيةSitus ini juga tersedia dalam bahasa Indonesia.Lihat dalam bahasa IndonesiaBu site Türkçe olarak da mevcut.Türkçe görüntüleTa strona jest dostępna także po polsku.Wyświetl po polskuTrang web này cũng có phiên bản tiếng Việt.Xem bằng tiếng Việtاین وب‌سایت به فارسی هم در دسترس است.مشاهده به فارسی

Het oordeel in uw hoofd in een document vastleggen: context engineering en de gehoorzaamheid van een model

AI2026.06

Nadat ik AI de afgelopen jaren in mijn werk heb ingevoerd, ben ik de oordelen die oorspronkelijk alleen in mijn hoofd bestonden geleidelijk gaan ontleden en externaliseren (externalize), en heb ik ze geordend tot een beheersbaar “context engineering-document” (Context Engineering Document).

Een infographic met een modelvergelijking die Claude als hoofdmodel, GPT als reserve en Gemini als afgevallen aanmerkt omdat het ooit verzonnen bronnen had opgesomd, met de aantekening dat dit een persoonlijke meting van het moment is en geen objectief eindoordeel

Ik beoordeel een model aan de hand van drie dingen

Wanneer ik momenteel beoordeel of een model geschikt is voor werk met “hoge discipline en hoge traceerbaarheid”, let ik vooral op drie dingen:

  1. of het zich aan de vastgestelde regels kan houden;
  2. of het, wanneer er onvoldoende informatie is, uit zichzelf “de gaten opvult”;
  3. of de output kan worden getraceerd en geaudit.

Een testverslag van dit moment

Hieronder mijn recente testbevindingen — laat ik vooraf zeggen dat dit puur mijn huidige, persoonlijke gebruikservaring is; de modellen worden ook voortdurend bijgewerkt, dus dit geldt niet noodzakelijk voor iedereen of voor elke versie:

  • Claude: de hoogste gehoorzaamheid aan de context; het voert doorgaans strak volgens de vastgestelde regels uit, dus ik gebruik het als hoofdmodel om de oordeelslaag te dragen.
  • GPT: de tweede. De traceerbaarheid is relatief goed beheersbaar, maar wanneer er onvoldoende informatie is, vult het de gaten af en toe op met trainingsdata, dus ik gebruik het vooral als reserve en voor specifieke taken.
  • Gemini: het heeft meer moeite met dit soort lange, hoogdisciplinaire werk; het heeft ooit in één keer een hele lading verzonnen bronnen opgesomd, en is daarom voorlopig uit deze hoofdlijn gestapt.

Wat het verschil maakt, is “gehoorzaamheid aan het reeds geëxternaliseerde oordeel”

Voor mij is de sleutel die het verschil tussen de modellen werkelijk maakt, eigenlijk niet alleen het vermogen van het model zelf, maar of het kan “gehoorzamen” aan dat professionele oordeel dat ik al heb geëxternaliseerd.

Gereedschappen zullen zich blijven bijwerken, maar eerst het oordeel in uw hoofd helder opschrijven — dat is eigenlijk even belangrijk als welk gereedschap u kiest.