OpenCode zeigte bei mir schon nach einer winzigen Anfrage fast 8.000 Tokens an – obwohl mein eigentlicher Prompt nur aus wenigen Wörtern bestand.
Also habe ich ausprobiert, wie weit sich der feste Kontext für ein lokales Modell reduzieren lässt: mit einem kürzeren System-Prompt, ohne ungenutzte Skills, mit weniger Tools und einem eigenen Local-Agenten. Im direkten Vergleich sank die angezeigte Kontextgröße auf ungefähr 3.600 Tokens.
Im neuen Video zeige ich die komplette Konfiguration, den Vorher/Nachher-Vergleich und einen kleinen Praxistest. Welche Tools würdet ihr bei einem lokalen Coding-Agenten auf keinen Fall abschalten?