LLM

Geheugensystemen in AI-assistenten

Geheugensystemen in AI-assistenten

Werkend, gestructureerd en ophaalbaar geheugen voor assistenten.

Geheugen verandert assistenten van reactief naar persistent, maar het is ook waar veel systemen stil verlopen. Onderzoeken betoogen dat de splitsing tussen kortetermijn- en langetermijngeheugen niet langer voldoende is voor modern agentengeheugen; OpenAI en LangGraph SDK’s wijzen op een eenvoudigere stack — werkgeheugen, duurzame staat en ophaling.

AI-assistentarchitectuur: LLM, geheugen, tools, routing, observability

AI-assistentarchitectuur: LLM, geheugen, tools, routing, observability

Hoe serieuze assistenten daadwerkelijk worden gebouwd.

Een productieve AI-assistent is niet zomaar “een LLM met een prompt”. Het is een systeem dat intentie accepteert, staat behoudt, beslist wanneer het moet ophalen of handelen, en voldoende runtime-detail blootlegt om fouten te debuggen.

LLM Wiki - Samengestelde kennis die RAG niet kan vervangen

LLM Wiki - Samengestelde kennis die RAG niet kan vervangen

Gecompileerde kennis voor AI-systemen

De uitgangspunt is eenvoudig: gecompileerde kennis is herbruikbaarder dan opgeroepen fragmenten. RAG (Retrieval-Augmented Generation) is het standaardantwoord geworden op een eenvoudige vraag – hoe geef ik een LLM (Large Language Model) toegang tot externe kennis?

Validatie van gestructureerde LLM-output in Python die stand houdt

Validatie van gestructureerde LLM-output in Python die stand houdt

Stop met het interpreteren van vibes. Valideer contracten.

De meeste tutorials over “gestructureerde output” van GPT-modellen (LLM’s) zijn niet serieus. Ze leren je beleefd om JSON te vragen en hopen daarna dat het model zich gedraagt. Dat is geen validatie. Dat is optimisme met accolades.

Hermes Agent Vaardigheidsontwikkeling — structuur en best practices voor SKILL.md

Hermes Agent Vaardigheidsontwikkeling — structuur en best practices voor SKILL.md

Author Hermes vaardigheden die snel laden en betrouwbaar werken

Hermes Agent behandelt vaardigheden (skills) als de standaardmanier om herhaalbare werkstromen te leren. De officiële documentatie beschrijft ze als kennisdocumenten op aanvraag, afgestemd op de open agentskills.io specificatie, die worden geladen via progressive disclosure (stapsgewijze onthulling), zodat het model eerst een kleine index ziet en volledige instructies alleen ophaalt wanneer een taak dit daadwerkelijk vereist.

Geheugen van AI-systemen — persistente kennis en agentengeheugen

Geheugen van AI-systemen — persistente kennis en agentengeheugen

Persistente kennis buiten een enkele chatthread.

Deze sectie verzamelt handleidingen over duurzame kennis en geheugen voor AI-systemen — hoe assistenten feiten, voorkeuren en gedistilleerde context over sessies heen behouden zonder elk token in één prompt te proppen. Hier staat geheugen voor intentionele retentie (gebruikersgegevens, samenvattingen, door plug-ins ondersteunde opslag), niet voor GPU-ram of modelparameters.

Vergelijking van agentgeheugenaanbieders — Honcho, Mem0, Hindsight en vijf andere

Vergelijking van agentgeheugenaanbieders — Honcho, Mem0, Hindsight en vijf andere

Acht uitbreidbare backends voor persistente agentgeheugen.

Moderne assistenten vergeten nog steeds alles als je het tabblad sluit, tenzij er iets persists buiten het contextvenster. Agent-memoryproviders zijn diensten of bibliotheken die feiten en samenvattingen over sessies heen bewaren — vaak geïntegreerd als plugins, zodat het framework slank blijft terwijl het geheugen schaalt.