Langzeitgedächtnis
Geben Sie einem Agenten ein persistentes Gedächtnis über Sitzungen hinweg, sodass er sich an Fakten, Benutzerpräferenzen und frühere Ergebnisse über ein einzelnes Kontextfenster hinaus erinnert. Ein Schreibpfad entscheidet, was gespeichert wird, fasst es zusammen und dedupliziert es; ein Lesepfad ruft bei Bedarf nur die relevanten Erinnerungen in den Kontext ab. Im Gegensatz zum semantischen Caching, das ganze Antworten zwischenspeichert, um Neuberechnungen zu vermeiden, speichert das Langzeitgedächtnis dauerhafte Fakten und Zustände und setzt diese jedes Mal neu für logische Schlussfolgerungen (Reasoning) zusammen.
Problem
Das Kontextfenster ist begrenzt und wird zwischen den Sitzungen zurückgesetzt. Ein Agent, der nur die aktuelle Konversation sieht, vergisst die geäußerten Präferenzen eines Benutzers, Entscheidungen aus der Vorwoche und die Ergebnisse früherer Aufgaben. Ab einer bestimmten Größenordnung ist es unmöglich, den gesamten Verlauf in jeden Prompt zu packen, und es verschlechtert das Reasoning, da sich das Fenster mit Token von geringem Wert füllt. Teams benötigen eine Möglichkeit, die wenigen entscheidenden Fakten dauerhaft zu speichern und genau dann bereitzustellen, wenn sie relevant sind.
Wann zu verwenden
Verwenden Sie dies, wenn ein Agent wiederholt dieselben Benutzer bedient oder an denselben langlaufenden Aufgaben arbeitet: Assistenten, die Präferenzen lernen, Support-Agenten, die die Historie eines Kunden verfolgen, Coding-Agenten, die sich an Projektkonventionen erinnern, oder mehrstufige Workflows, die sich über Tage erstrecken. Es setzt voraus, dass Sie Daten außerhalb des Modells speichern können (ein Vektorspeicher, eine Datenbank oder ein Memory-Framework) und dass Sie sowohl den Zeitpunkt des Schreibens von Erinnerungen als auch deren Abruf in den Prompt steuern.
Lösung
Trennen Sie den Schreibpfad vom Lesepfad. Auf dem Schreibpfad entscheidet nach Abschluss eines Interaktionsschritts (Turn) oder einer Aufgabe ein Extraktionsschritt, was erinnerungswürdig ist: stabile Fakten, Präferenzen, Zusagen und Ergebnisse – kein flüchtiges Geplauder. Potenzielle Erinnerungen werden in kompakte, in sich geschlossene Aussagen zusammengefasst, mit bestehenden Erinnerungen abgeglichen, um sie zu deduplizieren und Widersprüche zu erkennen, und dann mit Metadaten in einen Speicher geschrieben: einem Erinnerungstyp, einem Zeitstempel, einer Quelle und dem Benutzer oder Scope, zu dem sie gehören. Weniger, aber dafür gut zu schreiben, ist das Ziel; verrauschte Erinnerungen beeinträchtigen den späteren Abruf. Auf dem Lesepfad rufen Sie, bevor der Agent logische Schlussfolgerungen zieht, potenzielle Erinnerungen ab, die für die aktuelle Aufgabe relevant sind – typischerweise durch semantische Ähnlichkeit plus Filter für Scope und Aktualität –, bewerten diese und fügen nur die wichtigsten in den Kontext ein. Betrachten Sie den Abruf als Präzisionsproblem: Eine Handvoll korrekter Erinnerungen ist besser als eine große, lose zusammenhängende Menge. Unterscheiden Sie Erinnerungstypen, um den Abruf gezielt zu steuern: episodisch (was passiert ist), semantisch (dauerhafte Fakten und Präferenzen) und prozedural (wie eine wiederkehrende Aufgabe auszuführen ist). Konsolidieren Sie Erinnerungen regelmäßig und lassen Sie sie ablaufen, damit der Speicher klein, aktuell und frei von Widersprüchen bleibt.
Komponenten
Vorteile
- Der Agent erinnert sich an Präferenzen, Entscheidungen und Ergebnisse aus früheren Sitzungen, sodass Benutzer den Kontext nicht wiederholen müssen und sich der Agent über die Zeit hinweg konsistent verhält.
- Das Abrufen einiger weniger relevanter Erinnerungen sorgt dafür, dass sich das Fenster auf hochwertige Token konzentriert, anstatt den gesamten Verlauf zu laden. Dies erhält die Qualität des Reasonings und senkt die Kosten.
- Da sich stabile Fakten und Präferenzen ansammeln, passt der Agent seine Antworten mit jeder Interaktion präziser an, ohne dass das Modell neu trainiert werden muss.
- Da Erinnerungen in einem externen Speicher mit Metadaten abgelegt werden, können Sie überprüfen, korrigieren, exportieren und löschen, was der Agent weiß – wichtig für Vertrauen und Compliance.
Risiken
- Ohne Konsolidierung und Ablaufdatum sammelt der Speicher veraltete Fakten und widersprüchliche Aussagen an, und der Agent agiert selbstbewusst auf Basis der falschen Informationen.
- Das Speichern von Benutzerdaten bringt Verpflichtungen zur Aufbewahrung, Einwilligung und Zugriffskontrolle mit sich; Erinnerungen können sensible Informationen über Sitzungen oder Benutzer hinweg preisgeben, wenn der Scope nicht erzwungen wird.
- Eine geringe Präzision führt dazu, dass irrelevante oder falsche Erinnerungen eingefügt werden, die das Reasoning in die Irre führen; ein geringer Recall lässt genau die Erinnerung, auf die es ankam, stillschweigend untergehen, was Fehler schwer diagnostizierbar macht.
- Zu eifriges Schreiben bläht den Speicher auf, verlangsamt den Abruf, erhöht die Speicher- und Embedding-Kosten und verwässert das Signal, auf das ein guter Abruf angewiesen ist.
Wann nicht zu verwenden
- Wenn Sitzungen unabhängig sind und nichts übertragen werden muss, erhöht ein persistentes Gedächtnis die Komplexität, die Kosten und die Angriffsfläche für den Datenschutz, ohne einen Nutzen zu bringen.
- Wenn das Ziel darin besteht, eine vorherige Antwort für eine wiederholte Anfrage wiederzuverwenden, ist semantisches Caching das richtige Werkzeug; das Langzeitgedächtnis dient dem Erinnern von Fakten und Zuständen, nicht dem Caching von Ausgaben.
- Wo Vorschriften oder Richtlinien die Aufbewahrung von Benutzerdaten verbieten, sollten Sie keine Erinnerungen persistieren; verlassen Sie sich auf den In-Session-Kontext oder einen expliziten, eingegrenzten Speicher, den der Benutzer kontrolliert.
Technologien
Beispiele
- Über Sitzungen hinweg erinnert es sich an Tonalität, Formate, wiederkehrende Kontakte und ständige Anweisungen und ruft die wenigen ab, die für die aktuelle Anfrage gelten, anstatt erneut nachzufragen.
- Bei jedem Kontakt ruft es die früheren Probleme, Berechtigungen und Lösungen des Kunden ab, die auf dieses Konto bezogen sind, sodass es die Konversation fortsetzt, anstatt sie neu zu starten.
- Es speichert prozedurale Erinnerungen – Build-Befehle, Namensregeln, Review-Präferenzen – und ruft sie ab, wenn in vielen Sitzungen im selben Repository gearbeitet wird.
Praxisbelege
- Kontext
- Single-Operator, Local-First OpenClaw-Bereitstellung, beobachtet über 57 Tage (161 Sitzungen / 2.776 Turns), aggregiert aus den eigenen Trajektorien-Traces des Agenten.
- Szenario
- Der Agent persistiert Workspace-Memory-Dateien und Traces pro Sitzung für die Kontinuität über Turns und Sitzungen hinweg, wobei bei Bedarf ein Plugin für semantischen Abruf zur Verfügung steht.
- Technologie
- Workspace-Speicherdateien (MEMORY.md, IDENTITY.md, SOUL.md, USER.md, HEARTBEAT.md), persistente Session-IDs und Lifecycle-Events sowie ein Active-Memory-Plugin (memory_search/get/recall).
- Last
- 134 persistierte Session-Dateien über das 57-Tage-Fenster; semantischer Abruf (semantic recall) einmal aufgerufen.
- Ergebnisse
- Die Kontinuität blieb über 134 persistierte Sessions hinweg über 57 Tage durch strukturellen Workspace-Speicher erhalten; expliziter semantischer Abruf war in diesem autonomen Workload selten erforderlich (ein Aufruf). Lokale Bereitstellung für einen einzelnen Operator (Local-First).
KPIs
- Retrieval-Präzision (Precision) injizierter Erinnerungen
- Der Anteil der tatsächlich relevanten Erinnerungen unter den in den Kontext eingefügten. Dies ist die Metrik, die die Antwortqualität am direktesten beeinflusst; ein gutes Ergebnis bedeutet, dass die injizierte Menge fast vollständig themenbezogen ist und irrelevante Erinnerungen selten sind.
- Retrieval-Trefferquote (Recall) bei speicherabhängigen Aufgaben
- Bei Aufgaben, die einen bekannten gespeicherten Fakt erfordern, die Häufigkeit, mit der dieser Fakt tatsächlich abgerufen wird. Ein gutes Ergebnis bedeutet, dass die richtige Erinnerung zuverlässig auftaucht; anhaltende Fehlversuche deuten auf Lücken bei der Extraktion oder Indizierung hin.
- Größe und Wachstumsrate des Speichers
- Gesamtzahl der Erinnerungen und wie schnell sie sich pro aktivem Benutzer ansammeln. Ein gutes Ergebnis bedeutet, dass das Wachstum tatsächlich neue, dauerhafte Fakten widerspiegelt und keinen unbegrenzten Anstieg – eine exponentielle Kurve signalisiert ein zu eifriges Schreiben.
- Veraltungs- und Widerspruchsrate
- Anteil der abgerufenen Erinnerungen, die veraltet sind oder im Widerspruch zu einer neueren Wahrheit stehen. Ein gutes Ergebnis bedeutet eine niedrige und stabile Rate, was beweist, dass Konsolidierung und Ablaufdatum mit den Änderungen Schritt halten.
Beobachtete Fehlermuster
- Das Schreiben von allem verwandelt den Speicher in Rauschen; der Abruf liefert dann minderwertige oder falsche Erinnerungen. Beheben Sie dies, indem Sie die Hürde für das Schreiben erhöhen und die Extraktionsqualität überprüfen.
- Ein alter Fakt wird abgerufen und verarbeitet, nachdem sich die Wahrheit geändert hat, ohne dass ein Signal für die Veraltung vorliegt. Mildern Sie dies durch Zeitstempel, nach Aktualität gewichtetes Ranking und explizites Überschreiben beim Schreiben.
- Eine Erinnerung eines Benutzers, Mandanten oder Projekts wird in den Kontext eines anderen abgerufen, weil Scope-Filter fehlten oder fehlerhaft waren – ein gleichzeitiger Verstoß gegen Datenschutz und Korrektheit.
- Um ein schlechtes Ranking zu kompensieren, injizieren Teams viele Erinnerungen, wodurch das Kontextfenster mit marginalen Tokens gefüllt und genau die Argumentation beeinträchtigt wird, die der Speicher eigentlich unterstützen sollte.
Lessons Learned
- Die Qualität entscheidet sich bei der Auswahl dessen, was erinnert werden soll. Ein kleiner, sauberer, deduplizierter Speicher liefert weitaus bessere Abrufergebnisse als ein großer, verrauschter Speicher.
- Einige wenige korrekte Erinnerungen übertreffen viele lose zusammenhängende. Optimieren Sie auf Relevanz und ranken Sie streng, anstatt die Menge der injizierten Daten zu maximieren.
- Speichern Sie Metadaten und bieten Sie Möglichkeiten zum Anzeigen, Bearbeiten, Ablaufenlassen und Löschen von Erinnerungen. Dies ist unerlässlich für das Debugging, das Vertrauen und die Erfüllung von Datenschutzpflichten.
- Fakten veralten und widersprechen sich. Implementieren Sie Konsolidierung, Überschreiben und Ablaufdaten frühzeitig; diese nachträglich in einen großen, verunreinigten Speicher einzubauen, ist mühsam.
FAQs
- Wie unterscheidet sich dies von semantischem Caching?
- Semantisches Caching speichert und gibt ganze Antworten wieder, um die Neuberechnung ähnlicher Anfragen zu vermeiden. Langzeitgedächtnis speichert dauerhafte Fakten, Präferenzen und Ergebnisse und setzt diese dann für jede neue Aufgabe zu neuen logischen Schlüssen zusammen. Das eine verwendet Ausgaben wieder, das andere merkt sich den Zustand.
- Was sollte sich der Agent tatsächlich merken?
- Stabile, wiederverwendbare Signale: Benutzerpräferenzen, Entscheidungen und Zusagen, Ergebnisse früherer Aufgaben und wiederkehrende Abläufe. Vermeiden Sie flüchtigen Smalltalk und alles, dessen Aufbewahrung Sie nicht rechtfertigen können. Weniger, aber dafür gut zu schreiben, macht den späteren Abruf präzise.
- Wie gehen Sie mit personenbezogenen Daten (PII) und Datenschutz um?
- Behandeln Sie den Speicher als regulierte Daten: Setzen Sie Scopes durch, damit Erinnerungen niemals Benutzer oder Mandanten überschreiten, minimieren Sie die Persistierung, unterstützen Sie Einwilligung und Löschung und legen Sie Aufbewahrungs- und Zugriffskontrollen fest. Überprüfbarkeit und eine Richtlinie zum Ablauf von Daten sind Teil der Erfüllung dieser Pflichten.