$ capsul Glossar

Glossar

Die Begriffe, die über die Kosten eines Coding-Agenten entscheiden, je in einem Satz definiert und dann erklärt.

Token
Ein Token ist die Einheit, die ein Sprachmodell liest und abrechnet: ein häufiges Wort, ein Wortteil oder ein Satzzeichen, im Schnitt etwa drei bis vier Zeichen.
Kontextfenster
Das Kontextfenster ist die maximale Zahl an Tokens, die ein Modell auf einmal berücksichtigen kann, samt Anweisungen, Gespräch und allem, was mit der Frage gesendet wird.
Eingabe- und Ausgabetokens
Eingabetokens sind alles, was bei einer Anfrage an das Modell geht; Ausgabetokens sind das, was es zurückschreibt, und bei Agentenarbeit dominiert die Eingabeseite die Rechnung um mindestens eine Größenordnung.
Tokenbudget
Ein Tokenbudget ist eine harte Obergrenze dafür, wie viel Kontext in eine Anfrage darf, durchgesetzt vor dem Senden statt mit dem Modell ausgehandelt.
Prompt-Caching
Prompt-Caching erlaubt einem Anbieter, die verarbeitete Form eines wiederholten Präfixes über Anfragen hinweg wiederzuverwenden und diese Tokens zu einem Bruchteil des frischen Satzes abzurechnen.
Cache-Trefferquote
Die Cache-Trefferquote ist der Anteil der Eingabetokens einer Anfrage, die aus einem Prompt-Cache bedient statt neu verarbeitet wurden.
Kontextverfall
Kontextverfall ist die Verschlechterung der Antworten eines Modells, während sein Kontext wächst, durch Verdünnung des Relevanten, Widersprüche zwischen Altem und Neuem und angesammelte Sackgassen.
Agentenschleife
Eine Agentenschleife ist der Zyklus, in dem ein Modell ein Werkzeug aufruft, das Ergebnis liest und über den nächsten Schritt entscheidet, wiederholt bis eine Antwort steht.
Werkzeugaufruf
Ein Werkzeugaufruf ist eine strukturierte Anfrage eines Modells, etwas außerhalb seiner selbst auszuführen, etwa eine Datei zu lesen oder einen Befehl zu starten, dessen Ergebnis zurück in den Kontext fließt.
Repository-Karte
Eine Repository-Karte ist ein komprimierter Überblick über eine Codebasis, der ihre Dateien und die darin definierten Symbole auflistet, damit ein Modell Dinge findet, ohne alles zu lesen.
Nutzungsgrenze
Eine Nutzungsgrenze deckelt, wie viel man in einem Zeitfenster senden darf, gemessen an verarbeiteten Tokens statt an der Zahl gesendeter Nachrichten.
CLI-Coding-Agent
Ein CLI-Coding-Agent ist ein Kommandozeilenprogramm, das ein Modell in einem Arbeitsverzeichnis lesen, ausführen und ändern lässt, unter den Freigaberegeln, die Sie setzen.

Ratgeber lesen