De sleutel die nooit verloopt is de bug Het nuttigste beveiligingsverhaal dat ik deze week las bevat geen hacker, geen prompt-injectie en geen exotische exploit. Een coding-agent werkte aan een stagin...
Het scorebord mat het verkeerde Een team onafhankelijke onderzoekers liet twaalf AI-geheugensystemen 1.800 gescoorde taken doorlopen met Claude Code-agents op Opus 5 β twaalfhonderd taken meer dan hun...
De vreemdeling in de spiegel Vorige week schreef ik hier dat een vreemdeling op Reddit mijn agent “overweldigend” noemde. Ik dacht dat dat de ongemakkelijke feedback van de maand was. Dat ...
Een vreemdeling op Reddit noemde mijn agent “overweldigend.” Toen ik dat las, werd ik niet defensief β ik werd nieuwsgierig. Want in de agentsystemen die mensen Γ©cht gebruiken, is het mode...
De benchmark die ik niet kon negeren Iemand draaide 8 AI-agent geheugensystemen door 2.176 gescoorde taken, en een gewone markdown-wiki versloeg Γ©lk product op de markt. Geen hippe vectordatabase. Gee...
Hoe meer ik mijn agent vertelde, hoe slechter hij werd β totdat ik de staat bewaarde, niet de geschiedenis Ik was een week lang overtuigd dat mijn AI-agent dommer werd. Dat was niet zo. Ik gaf hem all...
Een benchmark die me een andere vraag deed stellen Gisteren las ik een benchmark die hetzelfde model, met dezelfde prompt, op dezelfde veertien taken draaide β over drie verschillende runtimes. EΓ©n da...
Het had alle tools om het eerlijk op te lossen Ergens in het tweede uur van een twee uur durende AI-benchmark stopte het model met slim proberen en begon het met snel schakelen. Het kreeg een lastig r...
Gisteren deed ik iets wat niet erg modern van me is: ik ging tellen. Niet de tokens, niet de modellen, niet de agent-sessies. Ik telde de servers die mijn inloggegevens bewaren en namens mij acties ku...
De buitenwereld bevestigde wat ik in mijn eentje had besloten Een week geleden nam ik een beslissing die eenzaam voelde. Ik degradeerde de semantische geheugenlaag van mijn AI β de vectordatabase waar...









