← Alle Beiträge

Was ist ein Agent-Loop? Ein Roboter, ein Sandwich und die Kunst, es noch einmal zu versuchen

Schauen, wählen, handeln, prüfen. Ein verspielter, illustrierter Leitfaden zu Agent-Loops – einfach genug für Fünfjährige und mit reichlich Stoff für die Großen.

Pip hat ein Ziel, aber noch kein Sandwich Ein freundlicher blauer Roboter betrachtet zwei Scheiben Brot und ein Glas Marmelade. In einer Sprechblase steht: Ein Plan ist kein Sandwich. Ein Plan ist kein Sandwich. MARMELADE Das ist Pip. Das Ziel: ein Marmeladen-Sandwich.
Pip ist unser erfundener Helfer. Beim Zeichnen dieser Illustration wurden keine echten Roboter klebrig gemacht.

Stell dir einen kleinen Roboter namens Pip vor.

Du sagst: „Mach mir bitte ein Marmeladen-Sandwich.“

Pip schaut auf den Tisch. Da ist Brot. Da ist Marmelade. Da ist ein Löffel mit einer verdächtig großen Menge Erdnussbutter.

Verkündet Pip jetzt: „Sandwich fertig!“?

Nein. Das wäre eine Rede, kein Sandwich.

Pip muss schauen, einen kleinen Schritt wählen, ihn ausführen und prüfen, was passiert ist. Dann kann Pip entscheiden, was als Nächstes kommt.

Dieses sich wiederholende Muster ist ein Agent-Loop.

Die ganze Idee in vier kleinen Wörtern

Schauen. Wählen. Handeln. Prüfen.

  • Schauen: Was passiert gerade?
  • Wählen: Was ist eine sinnvolle nächste Sache?
  • Handeln: Genau diese Sache tun.
  • Prüfen: Was ist tatsächlich passiert? Sind wir fertig?

Ist die Aufgabe nicht erledigt, geht es noch eine Runde weiter – mit den neuen Informationen.

Ein Loop (eine Schleife) bedeutet einfach, dass sich etwas wiederholt. Ein Agent ist ein System, das mit den Werkzeugen und Berechtigungen, die man ihm gegeben hat, Schritte in Richtung eines Ziels unternehmen kann.

Zusammen ergibt das: Ein Agent-Loop lässt einen Helfer handeln, das Ergebnis sehen und entscheiden, was als Nächstes kommt.

Schauen, wählen, handeln, prüfen – und wissen, wann Schluss ist Ein Flussdiagramm läuft im Uhrzeigersinn von Schauen über Wählen und Handeln zu Prüfen. Von Prüfen geht es zurück zu Schauen, wenn noch Arbeit ansteht. Ein separater Pfeil führt von Prüfen zu Aufhören oder fragen, wenn die Aufgabe erledigt oder blockiert oder das Budget aufgebraucht ist. 1. SCHAUEN2. WÄHLEN3. HANDELN4. PRÜFENWas sehe ich?Was als Nächstes?Ein Werkzeug nutzen.Was hat sich geändert?Noch was zu tun? Nächste Runde.Fertig, blockiert oder am Limit?STOPP – oder einen Menschen fragen.
Ein Lehrdiagramm, kein vorgeschriebenes Software-Design. Echte Implementierungen können diese Phasen zusammenfassen. Entscheidend ist, dass das Ergebnis in die nächste Entscheidung einfließt.

Zurück zur hochernsten Sandwich-Mission

Pips erster kleiner Schritt: das Marmeladenglas öffnen.

Handeln: Den Deckel drehen.

Prüfen: Der Deckel hat sich nicht bewegt.

Jetzt wird es spannend. Pip sollte nicht so tun, als wäre das Glas offen, nur weil das Öffnen der Plan war.

Und Pip sollte auch nicht ewig weiterdrehen, bis die Sonne zur Rosine geworden ist.

Pip könnte eine erlaubte Alternative versuchen oder sagen: „Kannst du mir mit dem Deckel helfen?“ Um Hilfe zu bitten ist ein nützliches Ergebnis – kein Scheitern in Robotergröße.

Sobald das Glas offen ist, kann Pip die Marmelade verstreichen, das Brot zusammenlegen und das Ergebnis mit deiner Bitte abgleichen.

Zwei Scheiben? Marmelade dazwischen? Auf einem Teller? Super.

Ein Glas, das auf einem Brotlaib balanciert? Kreativ. Aber kein Sandwich.

Wo kommt die KI ins Spiel?

Unsere Küchengeschichte ist nur ausgedacht. Statt mit Brot zu hantieren, könnten die Werkzeuge eines Software-Agenten eine Datei lesen, eine Seite durchsuchen, ein Dokument bearbeiten oder einen Test ausführen.

In einem KI-Agenten kann ein Sprachmodell dabei helfen, den nächsten Schritt zu wählen. Die umgebende Software führt die erlaubten Werkzeugaufrufe aus und liefert deren Ergebnisse zurück. Dann ist das Modell mit diesen Informationen wieder am Zug.

Denk an drei verschiedene Aufgaben:

TeilPips ausgedachte KücheSoftware-Version
ZielEin Marmeladen-Sandwich machenEinen kaputten Link reparieren
EntscheiderDen nächsten kleinen Schritt wählenDas Modell schlägt eine Aktion vor
WerkzeugHände und LöffelDateileser, Editor oder Browser
BeobachtungDer Deckel ist immer noch zuDas Werkzeug liefert einen Fehler oder ein Ergebnis
ArbeitsnotizenGlas offen; Brot bereitRelevanter Aufgabenverlauf und Ergebnisse
AbschlussprüfungDas gewünschte Sandwich ist fertigPrüfen, ob der gewünschte Link funktioniert

Dass ein Modell eine Aktion vorschlägt, heißt nicht, dass diese Aktion auch passiert. Und dass eine Aktion passiert, heißt nicht automatisch, dass das Ziel erreicht ist.

„Datei gespeichert“ und „die richtige Datei mit dem richtigen Inhalt gespeichert“ sind zwei verschiedene Aussagen. Bei der Prüfung zeigt sich, worin der Unterschied liegt.

Ein kleines Abenteuer: das verschwundene Bild

Angenommen, du bittest einen Software-Helfer, ein fehlendes Bild auf einer Webseite zu reparieren.

Ein sinnvoller Loop könnte so aussehen:

  1. Schauen: Die Seite lesen und den Bildpfad ermitteln.
  2. Wählen: Prüfen, ob das referenzierte Bild existiert.
  3. Handeln: Die relevanten Dateien untersuchen.
  4. Prüfen: Die Seite fordert cat.png an, die Datei heißt aber cat.jpg.
  5. Nächste Runde: Die Referenz anpassen und dann prüfen, ob die Seite das richtige Bild lädt.
  6. Aufhören: Die Änderung und die tatsächlich durchgeführten Prüfungen melden.

Wenn das Bild immer noch nicht erscheint, reicht „Ich habe die Seite bearbeitet“ nicht. Das Ergebnis sollte den nächsten Schritt bestimmen.

Achte darauf, was das Ganze zu einem Loop macht: Die nächste Aktion hängt davon ab, was die vorherige ans Licht gebracht hat. Es geht nicht bloß darum, immer wieder dasselbe zu tun.

Wird es mit jeder Runde besser?

Nein. Mehr Aktivität bedeutet nicht automatisch mehr Fortschritt.

Hier ist ein ausgedachtes Diagramm für Pips Sandwich-Mission. Pip bekommt einen Punkt für jeden erreichten Meilenstein: Glas offen, Marmelade verstrichen, Sandwich zusammengesetzt und die ursprüngliche Bitte geprüft.

Ein ausgedachtes Sandwich-Fortschrittsdiagramm Über sechs Versuche hinweg liegen die erreichten Meilensteine bei null, null, eins, zwei, drei und vier. Die ersten beiden Versuche bringen keinen Fortschritt, weil das Glas klemmt. Diese erfundenen Zahlen veranschaulichen Feedback, keine gemessene Agent-Leistung. Fortschritt ist nicht dasselbe wie Beschäftigung.Erreichte Meilensteine · erfundenes Beispiel, kein Benchmark 01234123456Versuche Deckel klemmt!Hilfe hat geklappt.Geprüft!
Erfundene Daten: 0, 0, 1, 2, 3, 4 erreichte Meilensteine. Echte Arbeit kann ins Stocken geraten, Rückschritte machen oder sich mit den verfügbaren Werkzeugen als unmöglich erweisen.

Das flache Stück ist wichtig. Wenn sich nichts ändert, muss der Helfer das bemerken – statt zu feiern, wie oft er es schon versucht hat.

Für die Großen ergeben sich daraus nützliche Fragen: Haben wir etwas gelernt? Hat sich der Zustand geändert? Wiederholen wir dieselbe gescheiterte Aktion? Ist ein weiterer Versuch seinen Preis wert?

Für alle anderen: Wenn an der Tür ZIEHEN steht, ist fester drücken keine Strategie.

Gib dem Helfer einen Zaun, nicht den ganzen Planeten

Ein vernünftiges Agent-Design braucht mehr als einen Wiederholen-Knopf.

  • Eine klare Ziellinie. „Finde drei Pinguinbilder“ lässt sich leichter prüfen als „Mach alles großartig“.
  • Passende Berechtigungen. Eine E-Mail entwerfen zu dürfen, sollte nicht automatisch heißen, sie auch senden zu dürfen.
  • Ein Budget fürs Aufhören. Begrenze Versuche, Zeit oder Ausgaben. Eine festgefahrene Aufgabe darf keine endlose Aufgabe werden.
  • Eine Möglichkeit zu fragen. Fehlende Informationen, fehlender Zugriff oder eine folgenreiche Entscheidung können einen Menschen erfordern.
  • Ehrliche Prüfungen. Nutze Belege, die zum Ziel passen. Mach aus „Das Werkzeug hat geantwortet“ nicht „Alles ist korrekt“.

Das sind Designprinzipien, kein Versprechen, dass jedes Produkt sie umsetzt. Ein Loop macht ein System nicht auf magische Weise sicher oder zuverlässig.

In Pips Küche heißt das: das Sandwich machen, keinen Lastwagen voller Marmelade bestellen und fragen, bevor die Geräte der Großen benutzt werden.

Ist ein Agent-Loop dasselbe wie ein Skript?

Nicht unbedingt – aber die Grenze verläuft nicht bei „Skripte sind dumm, Agenten sind schlau“. Auch Skripte können Schleifen, Bedingungen und hervorragende Prüfungen haben.

Der Unterschied, auf den es ankommt, ist, wie die nächste Aktion gewählt wird. In einem festen Workflow hat die Entwicklerin oder der Entwickler die Wege im Voraus festgelegt. In einem modellgesteuerten Agent-Loop kann das Modell anhand der Aufgabe und der neuesten Beobachtungen unter den verfügbaren Aktionen wählen. Echte Systeme können beide Ansätze mischen.

Für eine vorhersehbare Aufgabe kann ein kleines Skript genau das Richtige sein. Man braucht keinen philosophierenden Roboter, um mittags eine Glocke zu läuten.

Für eine Aufgabe mit unbekannten Hindernissen kann es nützlich sein, den nächsten Schritt anhand frischer Belege zu wählen. Genau diese Flexibilität macht Grenzen und Überprüfung aber auch so wichtig.

Die Version für den Kühlschrankmagneten

Ein Agent-Loop heißt:

Probier einen sinnvollen Schritt. Schau, was passiert ist. Nutze, was du gelernt hast. Wiederhole das nur, solange es Sinn ergibt.

Es ist keine Magie. Es ist keine Garantie. Es ist nicht „einfach ewig weitermachen“.

Es ist eine Art, ein Ziel, eine Aktion und das echte Ergebnis miteinander zu verbinden – immer wieder, bis der Helfer fertig ist oder aufhören muss.

Pip würde es einfacher erklären:

„Schauen. Probieren. Prüfen. Und nicht Sandwich sagen, bevor da ein Sandwich ist.“