Ratgeber · 6. Oktober 2026 · 14 Min. Lesezeit

Claude Code Fehler: 7 Dinge, die dich Zeit und Token kosten

Claude Code langsam, teuer oder ungenau? Oft lohnt zuerst ein Blick auf Setup, Kontext und Auftrag. 7 typische Anwendungsfehler und wie du sie behebst.

Das Wichtigste in Kürze

  • Erst unterscheiden: Bedienproblem, technische Störung oder Grenze des Produkts.
  • Wenige Skills und MCP-Server, die du wirklich nutzt, schlagen ein Setup, das du selbst nicht mehr durchblickst.
  • CLAUDE.md und automatische Memory brauchen Pflege, sonst arbeitet Claude auf altem Stand.
  • Erst im Plan-Modus planen lassen, dann bauen, und Modell plus Effort an die Aufgabe anpassen.
  • Große Vorhaben in prüfbare Häppchen zerlegen und wiederkehrende Aufgaben einmal als System aufsetzen.

Wenn Claude Code bei dir langsam läuft, teuer wird oder schwache Ergebnisse liefert, lohnt sich häufig zuerst ein Blick auf Setup, Kontext und Aufgabenstellung. Viele Probleme entstehen durch Gewohnheiten, die sich unbemerkt einschleichen, auch bei erfahrenen Nutzern. Dieser Ratgeber zeigt dir sieben typische Anwendungsfehler, die Zeit, Qualität oder Token kosten, und für jeden einen konkreten Fix. Vorher klärst du kurz, ob überhaupt ein Bedienproblem vorliegt.

Was macht Claude Code langsam, teuer oder schlecht?

Claude Code arbeitet mit dem, was in seinem Kontext steht: deine Anweisungen, deine CLAUDE.md, die Beschreibungen deiner Skills, die Angaben deiner MCP-Server und der bisherige Verlauf der Sitzung. Alles davon belegt Platz und damit Token. Und alles davon beeinflusst, wie gut die Antworten werden.

Viele Probleme entstehen deshalb nicht im Modell, sondern im Setup und in der Arbeitsweise drumherum: zu viel Ballast im Kontext, veraltete Informationen, zu große Aufträge ohne Plan, ein unpassendes Modell für die Aufgabe. Diese vier Punkte stellst du selbst ein, ohne auf ein Update zu warten. Die sieben Fehler unten folgen diesem Muster. Die ersten sechs betreffen Setup und Arbeitsweise, der siebte den Schritt zu wiederverwendbaren Systemen.

Tipp

Mit /context siehst du jederzeit, was gerade in deinem Kontext geladen ist, inklusive CLAUDE.md, Skills und anderer Inhalte. So findest du am schnellsten heraus, wo dein Platz eigentlich hingeht.

Vorher prüfen: Bedienung, Störung oder Grenze?

Nicht jedes Problem ist ein Anwendungsfehler. Bevor du dein Setup umbaust, ordne ein, womit du es zu tun hast:

SymptomMögliche UrsacheErster Schritt
Antworten werden mit der Zeit schlechterLanger Verlauf, veralteter Kontext/context prüfen, bei neuer Aufgabe /clear
Plötzlich Fehlermeldungen oder Abbrüche, auch bei einfachen AufgabenTechnische Störung beim AnbieterStatusseite unter status.anthropic.com prüfen
Meldung, dass ein Limit erreicht istNutzungsgrenze deines Tarifs/usage aufrufen, Meldung lesen: Sie nennt, wann das Limit zurückgesetzt wird
Hoher Verbrauch pro NachrichtViel Kontext, lange Antworten, hoher Denkaufwand oder viele WerkzeugaufrufeMit /usage und /context nachsehen, dann Verlauf, Skills und MCP-Server aufräumen
Aufgabe klappt trotz gutem Setup nichtGrenze des Modells oder unklare AufgabeAufgabe zerlegen, präziser beschreiben, stärkeres Modell testen

Langsam, Limit erreicht und hoher Verbrauch sind drei verschiedene Dinge. Langsam kann an der Last beim Anbieter, am Modell oder an hohem Effort liegen. Ein erreichtes Limit sagt etwas über deinen Tarif. Hoher Verbrauch kann durch viel Kontext, lange Antworten, hohen Denkaufwand oder viele Werkzeugaufrufe innerhalb eines Auftrags entstehen. Erst wenn du weißt, welches der drei vorliegt, lohnen die Fixes unten.

Fehler 1: Du sammelst Skills, statt welche zu meistern

Jede Woche ein neuer Skill, ein neuer MCP-Server, eine fremde Konfiguration aus irgendeinem Video. Es kommen ständig neue Werkzeuge dazu, und du springst von Setup zu Setup. Das fühlt sich produktiv an, bringt aber oft wenig.

Am Ende hast du ein Setup, das du selbst nicht mehr durchblickst. Du weißt nicht mehr, was davon eigentlich läuft und was nur im Weg steht. Dazu kommt der Kontext: Die Beschreibung jedes Skills liegt ständig im Kontext, auch wenn du ihn gerade nicht brauchst. Bei MCP-Servern ist es etwas günstiger: Ihre Werkzeugdefinitionen lädt Claude Code laut Anthropic standardmäßig erst bei Bedarf; zunächst landen nur Werkzeugnamen und Serveranweisungen im Kontext. Viele Server bedeuten trotzdem mehr Auswahl, mehr Rauschen und mehr Möglichkeiten, das falsche Werkzeug zu greifen.

Der Fix: wenige Skills, die du wirklich nutzt. Lieber drei, die du in- und auswendig kennst, als zwanzig, die du nie richtig verstanden hast. So räumst du auf:

Schritt 1: Bestand anschauen

Ruf /mcp auf. Dort siehst du alle eingerichteten MCP-Server und kannst die abschalten, die du gerade nicht aktiv nutzt. Danach gehst du deine Skills durch.

Schritt 2: Die Zwei-Wochen-Frage stellen

Frag dich bei jedem Eintrag: Habe ich das in den letzten zwei Wochen benutzt? Wenn nein, schalte es ab. Als Faustregel reicht dieser Zeitraum, um Werkzeuge für seltene, aber wichtige Aufgaben nicht vorschnell zu verlieren.

Schritt 3: Gegenprüfen

Schau mit /context nach, wie viel Platz jetzt frei geworden ist. Wenn es für eine Aufgabe ein Kommandozeilen-Werkzeug gibt, zum Beispiel gh für GitHub, empfiehlt Anthropic in der Kostendokumentation, das Werkzeug direkt zu nutzen: Es braucht keine eigene Werkzeugliste im Kontext und ist deshalb sparsamer als ein MCP-Server.

Fehler 2: Dein Kontext veraltet, und keiner sagt es der KI

Du legst deine CLAUDE.md an, also die Datei, in der dein Setup, deine Regeln und dein Projektkontext stehen. Dazu ein paar Notizen, ein paar Projektdateien. Einmal. Und dann fasst du sie nie wieder an.

Das ist wie ein Mitarbeiter, dem keiner sagt, dass sich etwas geändert hat. Er arbeitet weiter auf altem Stand und liefert entsprechend schlechtere Ergebnisse. Du wunderst dich über die Antworten, dabei arbeitet die KI nur mit dem, was du ihr vor Wochen aufgeschrieben hast.

Der Fix: pflegen, nachziehen, ausmisten. Wenn sich in deinem Projekt etwas ändert, zieh die CLAUDE.md im selben Zug nach. Hast du noch keine, erzeugt /init dir einen Startpunkt: Claude schaut sich dein Projekt an und schreibt die wichtigsten Befehle und Konventionen hinein. Anthropic empfiehlt, eine CLAUDE.md unter 200 Zeilen zu halten, weil längere Dateien mehr Kontext belegen und schlechter befolgt werden.

Und nutz das Gedächtnis von Claude Code wirklich: Mit der automatischen Memory schreibt Claude sich selbst Notizen zu deinen Korrekturen und Vorlieben und lädt sie in jeder neuen Sitzung wieder, die ersten 200 Zeilen oder 25 KB der Memory-Übersicht. Du musst also nicht jedes Mal alles neu erklären.

Praxis-Tipp

Über /memory siehst du alle CLAUDE.md-Dateien und den Memory-Ordner auf einen Blick und kannst sie direkt öffnen. Schau ab und zu rein, was dort steht, und lösch, was nicht mehr stimmt. Veraltete Regeln sind schlimmer als fehlende, weil Claude sie weiter befolgt.

Fehler 3: Du startest fünf Sachen und kontrollierst keine

Bei größeren Aufgaben kann Claude Code längere Zeit selbstständig arbeiten. Plane anschließend Zeit für die Prüfung ein. Die Wartezeit dazwischen fühlt sich wie Leerlauf an. Also startest du parallel den nächsten Task. Und noch einen. Plötzlich laufen fünf Sachen gleichzeitig.

Das wird schnell unübersichtlich. Du prüfst nur noch oberflächlich, überall halb, nirgends richtig. Die Qualität fällt. Und irgendwann verlierst du den Überblick: Es sind Stunden vergangen, und nichts davon ist wirklich fertig und geprüft.

Der Fix: lieber eine Sache sauber kontrollieren als fünf halb. Ein Task, den du wirklich verstehst und prüfst, bringt dich weiter als fünf, die im Hintergrund vor sich hin driften. Wenn du parallel arbeiten willst, dann nur mit Aufgaben, die sich nicht überschneiden, und nur so viele, wie du am Ende auch wirklich durchsehen kannst. Als Faustregel für den Anfang: eine, höchstens zwei.

Hinweis

Wechselst du zu einer Aufgabe, die mit der vorherigen nichts zu tun hat, starte mit /clear frisch. Alter Verlauf wird sonst bei jeder weiteren Nachricht mitgeschickt. Mit /rename gibst du der Sitzung vorher einen Namen und findest sie später über /resume wieder.

Fehler 4: Du lässt bauen, bevor du briefst

Du tippst „bau mir XY“ und drückst Enter. Claude rennt los. Und zehn Minuten später merkst du: falsche Richtung. Das Ergebnis passt nicht zu dem, was du eigentlich wolltest. Jetzt musst du die Arbeit zurückdrehen und neu ansetzen. Zeit weg, Token weg.

Der Fix: erst planen lassen, dann bauen. So läuft das im Plan-Modus ab:

Schritt 1: Plan-Modus einschalten

Drück Shift+Tab, bis unten „plan mode on“ steht. Ab jetzt liest Claude sich ein und schreibt dir einen Plan, ändert aber noch keine Datei.

Schritt 2: Rückfragen zulassen

Bei größeren Vorhaben lohnt es sich, Claude vorher Rückfragen stellen zu lassen, damit ihr beide dasselbe Bild im Kopf habt. Das kostet kurz Zeit und spart dir später die Richtungskorrektur.

Schritt 3: Plan lesen, korrigieren, freigeben

Du liest den Plan, korrigierst die Richtung und gibst ihn erst dann frei. Einem Mitarbeiter gibst du auch erst das Briefing, bevor er anfängt. Achte dabei besonders auf drei Punkte: welche Dateien geändert werden, was ausdrücklich nicht angefasst wird und wie am Ende geprüft wird, ob es funktioniert.

Fehler 5: Du fährst alles auf demselben Modell

Du hast irgendwann ein Modell eingestellt und lässt seitdem alles darauf laufen, egal ob knifflige Architekturfrage oder simples Umformatieren. Beide Richtungen können kosten. Bei schweren Aufgaben kann niedriger Effort die Qualität begrenzen, etwa wenn Claude eine Datei überspringt oder die Tests nicht laufen lässt. Bei einfachen Aufgaben bringt maximaler Effort häufig wenig zusätzlichen Nutzen.

Der Fix: pass Modell und Effort an die Aufgabe an. Welche Modelle dir zur Verfügung stehen, siehst du in Claude Code mit /model. Die Modellübersicht von Anthropic ordnet die Modellfamilien so ein (Stand Oktober 2026 stehen dort unter anderem Opus 5.5, Sonnet 5.5 und Fable 5.1); die Preise pro Token findest du in der Preisübersicht:

ModellfamilieWofür laut AnthropicWorauf du achtest
OpusKomplexe Denkaufgaben: Architektur, knifflige Fehler, unbekanntes TerrainAuf den meisten Tarifen der Standard; bei schweren Fragen den Effort mit /effort high hochstellen
FableDie leistungsstärksten Modelle, für lange eigenständige Aufgaben über mehr als eine SitzungHöchster Preis pro Token, also gezielt einsetzen
SonnetTägliche Programmierarbeit: präzise Änderungen, RoutineaufgabenGünstiger pro Token als Opus
HaikuEinfache Aufgaben und kleine HandgriffeSchnell und sparsam

Wechseln kannst du jederzeit mit /model, den Effort stellst du mit /effort ein. Die Stufen reichen von low über medium, high und xhigh bis max; welche davon verfügbar sind, hängt vom gewählten Modell ab. So sparst du Token bei den Kleinigkeiten und hast volle Leistung, wo es wirklich zählt.

Tipp

/usage zeigt dir zwei verschiedene Dinge: oben die Token- und Kostenstatistik der aktuellen Sitzung, bei einem Abo zusätzlich deine Nutzungsgrenzen. /cost ist laut Befehlsreferenz nur ein anderer Name für denselben Befehl. Bei enthaltenem Abo-Verbrauch ist die Kostenanzeige der Sitzung eine Schätzung und keine zusätzliche Rechnung; für dich zählen dann die Nutzungsgrenzen deines Tarifs. Bei API-Nutzung, aktivierter Zusatznutzung oder Abrechnung über Cloudanbieter können verbrauchsabhängige Kosten entstehen.

Fehler 6: Du willst die ganze App in einem Rutsch

„Bau mir die komplette App“: ein Prompt, ein Durchlauf. Klingt effizient, führt aber oft zu schlechter Qualität. Der Kontext läuft voll, die KI verliert den Faden, und die Qualität bricht mittendrin ein. Prüfen kannst du das Ganze am Ende auch kaum, weil es zu viel auf einmal ist.

Der Fix: zerleg die Sache in Häppchen, die du prüfen kannst. Schritt für Schritt, nach jedem Stück kurz testen. Für große Brocken gibt es zwei Werkzeuge:

  • Subagents sind Helfer, die eine Teilaufgabe in ihrem eigenen Kontext erledigen und dir nur das Ergebnis zurückgeben. Dein Hauptfenster bleibt dadurch schlank.
  • Worktrees sind getrennte Git-Arbeitsverzeichnisse, jedes auf einem eigenen Zweig. In ihnen können getrennte Claude-Code-Sitzungen parallel an sauber abgegrenzten Stücken arbeiten, zum Beispiel gestartet mit claude --worktree login-seite. Die Änderungen kommen sich so nicht in die Quere, bis du sie zusammenführst.

Achtung

Wird eine lange Sitzung voll, fasst Claude Code den älteren Verlauf zusammen. Mit /compact kannst du das selbst auslösen und sagen, was erhalten bleiben soll. Das Zusammenfassen liest aber den ganzen Verlauf und ist selbst eine große Anfrage. Wenn du keinen Zusammenhang zum Vorherigen brauchst, ist /clear der günstigere Weg.

Fehler 7: Du tippst dieselbe Aufgabe zum hundertsten Mal neu

Es gibt Aufgaben, die du ständig erledigst: Mails beantworten, denselben Report, dieselbe Art von Recherche. Und jedes Mal setzt du dich hin und promptest alles von Hand neu. Das fühlt sich normal an, kostet dich aber jedes Mal Zeit für etwas, das immer gleich abläuft.

Der Fix: setz dich einmal hin und bau ein System. Eine klare Anweisung, eine Vorlage, die passenden Referenzen, einmal sauber aufgesetzt, zum Beispiel als eigener Skill. Ein Skill hat einen Vorteil gegenüber der CLAUDE.md: Ständig im Kontext liegt nur seine kurze Beschreibung, damit Claude weiß, wann er passt. Die vollständige Anleitung wird erst geladen, wenn der Skill benutzt wird. Detaillierte Anleitungen für einzelne Abläufe gehören deshalb in Skills, nicht in die Datei, die in jeder Sitzung komplett mitläuft.

Ein typischer Aufbau für wiederkehrende Kundenmails sieht so aus:

  • Eingang: die Mail, auf die geantwortet werden soll, plus die Fakten zum Fall, etwa Bestellnummer oder Termin.
  • Anweisung: dein Ton, deine Standardfälle (Rückfrage, Reklamation, Terminverschiebung) und zwei, drei Beispielantworten, die dir gefallen.
  • Ergebnis: ein Antwortentwurf, kein automatischer Versand.
  • Kontrolle: Du liest jeden Entwurf, prüfst Fakten und Zusagen und schickst ihn erst dann ab.

Praxis-Tipp

Fang mit dem Fall an, den du am häufigsten schreibst, und ergänze weitere Fälle erst, wenn der erste zuverlässig passt. Wenn du einen Entwurf korrigierst, übernimm die Korrektur in die Anleitung des Skills, statt sie jedes Mal neu zu erklären.

Womit du anfängst

Aufräumen, pflegen, dosieren, planen: Nichts davon ist spektakulär, aber genau das trennt ein Setup, das dich bremst, von einem, das zuverlässig läuft. Fang so an:

  1. Prüf kurz, ob ein Bedienproblem, eine Störung oder ein Limit vorliegt.
  2. Räum dein Setup auf: Skills und MCP-Server, die du zwei Wochen nicht genutzt hast, schaltest du ab.
  3. Zieh deinen Kontext nach: CLAUDE.md aktualisieren, Memory durchsehen.
  4. Wähl pro Aufgabe das passende Modell und den passenden Effort.
  5. Zerleg deine Tasks und plane vor dem Bauen.

Danach kommen Systeme. Sobald diese Grundlagen sitzen, lohnt es sich, die ersten wiederkehrenden Aufgaben als eigene Skills und Vorlagen aufzusetzen.

Häufige Fragen

Warum verbraucht Claude Code so viele Token?

Hoher Verbrauch kann durch viel Kontext, lange Antworten, hohen Denkaufwand oder viele Werkzeugaufrufe entstehen. Ein langer Sitzungsverlauf, viele Skills und eine lange CLAUDE.md werden bei jeder Anfrage mitgeschickt. Mit /context siehst du, was geladen ist, mit /usage die Token- und Kostenstatistik der Sitzung und bei einem Abo deine Nutzungsgrenzen. Aufräumen, /clear zwischen unabhängigen Aufgaben und das passende Modell senken den Verbrauch.

Warum ist Claude Code so langsam?

Das kann an hohem Effort, an einem großen Modell, an einem langen Verlauf oder an hoher Last beim Anbieter liegen. Prüf zuerst die Statusseite, dann Modell und Effort. Für kleine Aufgaben reicht oft ein schnelleres Modell.

Was mache ich, wenn das Limit erreicht ist?

Ein erreichtes Limit ist eine Grenze deines Tarifs, kein Fehler im Setup. Gilt es nur für ein bestimmtes Modell, kannst du mit /model auf ein anderes wechseln; ein Sitzungs- oder Wochenlimit gilt dagegen für alle Modelle, und die Meldung zeigt, wann es zurückgesetzt wird. Ein schlanker Kontext sorgt dafür, dass du später an die Grenze stößt.

Wie schalte ich den Plan-Modus in Claude Code ein?

Drück Shift+Tab, bis unten „plan mode on“ steht. Claude liest sich dann ein und schreibt einen Plan, ändert aber keine Datei, bis du ihn freigibst.

Was ist der Unterschied zwischen /clear und /compact?

/clear startet eine frische Sitzung ohne den bisherigen Verlauf. /compact fasst den bisherigen Verlauf zusammen, damit du mit dem Zusammenhang weiterarbeiten kannst, ist dafür aber selbst eine große Anfrage.

Wie lang sollte eine CLAUDE.md sein?

Anthropic empfiehlt unter 200 Zeilen pro Datei. Alles, was nur für einzelne Abläufe gilt, packst du besser in einen Skill, dessen vollständige Anleitung erst bei Bedarf geladen wird.

Merkt sich Claude Code meine Vorlieben zwischen Sitzungen?

Ja, über die CLAUDE.md und die automatische Memory. Die Memory sind Notizen, die Claude sich selbst zu deinen Korrekturen schreibt und in jeder neuen Sitzung wieder lädt. Über /memory kannst du sie ansehen, bearbeiten oder abschalten.

Fazit

Wenn Claude Code dich bremst, lohnt sich häufig zuerst ein Blick auf Setup, Kontext und Aufgabenstellung, nachdem du Störungen und Limits ausgeschlossen hast. Ein schlankes Setup, gepflegter Kontext, eine Aufgabe nach der anderen, erst planen und dann bauen, das passende Modell pro Job und kleine, prüfbare Schritte: Das sind die Grundlagen, auf denen alles andere aufbaut. Wenn die sitzen, baust du deine ersten Systeme, und aus „ich nutze Claude Code“ wird Schritt für Schritt „Claude Code arbeitet für mich“.

KI Agenten Club

Du willst nicht nur lesen, sondern bauen?

Im KI Agenten Club baust du mit Vishal KI-Agenten für dein Business: Kurse, Live-Calls und fertige Skills. 69 € im Monat, jederzeit kündbar.

KI Agenten Club ansehen

Das könnte dich auch interessieren