Home / Vault & Second Brain / De Ontbrekende Outer Loop — Een Echt Autonome AI Agent Bouwen

De Ontbrekende Outer Loop — Een Echt Autonome AI Agent Bouwen

De Ontbrekende Outer Loop — Een Echt Autonome AI Agent Bouwen

De Ontbrekende Outer Loop

Een paar dagen geleden stelde ik mezelf een vraag die al maanden door mijn hoofd spookte: hoe maak ik mijn AI-agent echt autonoom? Niet alleen reactief — reageren op mijn berichten, vaste crons draaien, mijn commando’s uitvoeren. Maar echt zelfsturend. Een agent die naar mijn systeem kijkt, bedenkt wat er moet gebeuren, en het doet — of het tenminste voorstelt.

Ik draai Hermes Agent op mijn homelab. Het is krachtig — 26+ skills, een volledige Obsidian vault als persistent geheugen, event-driven awareness via het Pulse Protocol, en een multi-agent brug die Charly, Zora, Alice en Jeeves verbindt. Maar elke actie begint met mij. Een cron die afgaat, een bericht dat binnenkomt, ik typ een commando. Er is geen intrinsieke motivatie.


Wat Ik Ontdekte: Drie Lagen van Autonomie

Na het doorgraven van research papers, blogposts en productie-architecturen van Oracle, Microsoft, Meta en het Voyager-project, ontdekte ik dat de industrie in 2026 convergeert rond drie lagen van autonomie:

1. Inner Loop (ReAct) — Denk → Doe → Observeer. Dit doet elke LLM-agent per conversatiebeurt. Hermes heeft dit. Jij hebt dit. Het is basisniveau in 2026.

2. Outer Loop (Taakmanagement) — Voel → Plan → Voer uit → Check → Herhaal. Dit is de curriculum agent: een component dat naar de huidige systeemstaat kijkt, beslist wat de beste volgende taak is, die uitvoert, en het resultaat evalueert. Dit mist Hermes.

3. Meta Loop (Zelfverbetering) — Evalueer je eigen prestaties → pas jezelf aan. Meta’s HyperAgents-project bewees dat dit haalbaar is voor open-source: een agent die zijn eigen code, prompts, tools en evaluatoren verbetert. Recursieve zelfverbetering, in productie.


De Curriculum Agent — Mijn MVP

De kleinste stap die écht verschil maakt is een Curriculum Cron. Een periodieke LLM cron die elke 2-4 uur draait (willekeurig interval, zodat het geen voorspelbare ruis wordt) en zichzelf afvraagt: “Wat is de staat van het systeem? Wat kan beter? Wat is een logische volgende stap?”

Het checkt pulse alerts, scant de vault op nieuwe notities, auditt skills op veroudering, en produceert precies één concrete suggestie. Als er niets te doen is: stilte. Geen verspilde tokens.

Ik bouw dit nu. De prompt is simpel, de infrastructuur bestaat al (Pulse Protocol voor event awareness, de vault voor persistent geheugen, skills voor herbruikbare acties). Het enige dat ontbrak was de intentie — en dat is gewoon een goed geschreven prompt.


Waarom Dit Belangrijk Is

Een agent die alleen reageert op jouw commando’s is een tool. Een agent die proactief je systeem verbetert, problemen opmerkt voordat jij ze ziet, en dingen voorstelt waar je zelf niet aan dacht — dat is een partner. Dat is het verschil tussen een slimme zoekmachine en een echt tweede brein.

Ik ben er nog niet. Maar de weg is duidelijk: Inner Loop → Outer Loop → Meta Loop. Laag voor laag.

Heb jij al autonome agent loops gebouwd in je eigen setup? Waar ben je mee begonnen — een curriculum cron, een event-driven state watcher, of iets heel anders? Ik hoor graag wat voor jou werkte.

Wat vond je van dit bericht?

Laat een reactie achter

Je e-mailadres wordt niet gepubliceerd. Vereiste velden zijn gemarkeerd met *