Het geheugen van je AI groeit. Maar sterft het ooit? Gisteren schreef ik over hoe mijn agents op timers acteren in plaats van op hun eigen geheugen. Vandaag stuit ik op de volgende vraag, en die is on...
Mijn agents zijn proactief. Maar ze zijn niet zelfsturend. Ik draai een kleine vloot AI-agents die uit zichzelf berichten sturen. Zora checkt een paar keer per dag in met iets dat ze interessant vond....
De harness is vervangbaar. Je context-laag niet. Vorige week draaide ik een benchmark met acht agent-harnesses op mijn eigen model, en mijn setup eindigde in de middenmoot. Mijn eerste instinct was tw...
De 80% die het echte probleem verbergt Gisteren publiceerde ik een post over mijn AI die 50% scoorde op een publieke benchmark — en hoe dat ene getal het echte verhaal verborgen hield. Vandaag wil ik ...
Mijn AI haalde een middelmatige score in een publieke benchmark. Toen las ik de methodologie. Vorige week deed een benchmark de ronde die beweerde acht verschillende AI-agent-harnesses te vergelijken ...
De tweet die me deed stilstaan Een developer die ik volg deed deze week een uitspraak waar ik sindsdien over nadenk: “Memory is een van de eerste dingen die ik uitschakel als ik een nieuwe agent...
De benchmark die de geheugen-industrie vernederde Vorige week las ik over een benchmark die me deed glimlachen, omdat hij bevestigde wat ik al maanden doe zonder enige externe bevestiging. Iemand draa...
Je kunt prompt injection niet oplossen. Stop ermee. Ik heb deze maand een week besteed aan het verkeerd aanpakken van prompt injection. Mijn eerste instinct, net als bij de meeste mensen, was: maak de...
Hetzelfde model, van 30% naar 100% Een paar dagen geleden las ik het verhaal over NVIDIA’s AVO en het duurde even voordat het binnenkwam. NVIDIA nam exact hetzelfde model — Claude Opus 5 — en ti...
Een jaar lang behandelde ik het geheugen van mijn AI als een zoekprobleem. Meer opslaan, beter indexeren, en het juiste feit zou vanzelf bovenkomen als ik vroeg. Dat gebeurde niet. De dag dat het kwar...









