Onderzoek
Uitzoeken wat er werkelijk staat
Een onderwerp uitpluizen tot de bewering en het bewijs uit elkaar te houden zijn. Elk stuk hier zegt wat er gemeten is, wat daaruit volgt, en waar het ophoudt — met de bronnen erbij, zodat je het kunt natrekken zonder mij te geloven. En met een prompt eronder, zodat je kunt zien of je eigen systeem er iets mee kan.
8 van de 8 stukken
- Veiligheid & grenzen
Promptinjectie bij AI-agents: filters falen, actiegrenzen werken
Promptinjectie bij AI-agents: waarom aanvalscijfers zo uiteenlopen, wat een grens rond risicovolle handelingen oplevert, en wat die kost.Lees het stuk → - Agents & pijplijnen
Autonomie is een ontwerpkeuze, geen modeleigenschap
Autonomie bij AI-agents: waarom hetzelfde model op vijf niveaus kan draaien, en waarom een langere tijdshorizon niet vanzelf minder toezicht betekent.Lees het stuk → - deSchouwVloot verdiepen
Metadata in een CI/CD-pijplijn: vastleggen, niet reconstrueren
Een pijplijn laat zien dát er iets gebeurde, maar zelden wát. Welke velden je op het moment zelf moet opschrijven voordat er iets te meten valt — en wie dat opschrijft.Lees het stuk → - Agents & pijplijnen
Geheugen voor agents is geen product, maar een keuze per knelpunt
Twee onafhankelijke evaluaties vergelijken vijftien geheugensystemen voor agents. Geen enkele wint overal, en een lang contextvenster blijft een geduchte basislijn.Lees het stuk → - Modellen & evaluatie
Toegang is geen controle
Je kunt een AI-capability gebruiken zonder grip op het model dat hem levert. Die afstand is geen implementatiedetail maar een architectuurvariabele.Lees het stuk → - Agents & pijplijnen
Context is een eindige hulpbron, geen emmer
Waarom een groter contextvenster een agent niet betrouwbaarder maakt, en welke vier technieken de aandacht van een model wél efficiënt besteden.Lees het stuk → - Modellen & evaluatie
Een groene testsuite bewijst niet dat de patch klopt
Bijna een derde van de patches die op SWE-bench Verified slagen, gedraagt zich anders dan de referentie. Wat dat betekent voor wie agents in een pijplijn zet.Lees het stuk → - Modellen & evaluatie
Modelkeuze is een architectuurbeslissing, geen prijsvergelijking
Tien keer prijsverschil tussen het duurste en het goedkoopste model, drie redenen waarom dat getal misleidt, en waarom je in de verkeerde eenheid rekent.Lees het stuk →
Waar dit over gaat
- Agents & pijplijnenTechnieken om autonome systemen bruikbaar te houden over lange taken, en wat dat vraagt van de machinerie eromheen.
- Modellen & evaluatieWat er uit de modellen en de benchmarks komt, en wat daarvan overeind blijft zodra je het op echt werk loslaat.
- Veiligheid & grenzenWat er gebeurt als een autonoom systeem invoer tegenkomt die het niet zelf geschreven heeft, en welke grenzen dan nog houden.
- deSchouwVloot verdiepenStukken die de pijplijn onder deze site zelf als onderwerp nemen: wat er aan deSchouwVloot beter kan, getoetst aan wat er buiten deze repo over bekend is.
Nieuwe stukken verschijnen ook in de RSS-feed.