KI nutzen, ohne an die
Nutzungslimits zu stoßen
Wie lange das Langdock-Kontingent reicht, hängt vom gewählten Modell ab und davon, wie viel Text es für eine Antwort verarbeiten muss. Die folgenden Hinweise zeigen, wo sich im Alltag am meisten sparen lässt.
Von Dennis Cutraro, Co-Founder und Managing Partner · Stand:
So hält das Kontingent länger
Entscheidend sind ein passendes Modell und eine knappe, vollständige Anfrage. Je weniger unnötiger Text im Chat liegt, desto länger reicht das Kontingent.
1. Das passende Langdock-Modell wählen
Auto ist die Voreinstellung und reicht für die meisten Alltagsaufgaben. Langdock wählt das Modell dann anhand der ersten Nachricht aus. Eine eigene Wahl lohnt sich vor allem bei sehr einfachen oder sehr anspruchsvollen Aufgaben.
Fährt man in der Modellauswahl mit der Maus über einen Modellnamen, zeigt Langdock, wofür sich das Modell eignet und wie hoch sein Verbrauch ungefähr ist. Der Nachbau unten zeigt die Stufen im Überblick.
Modellauswahl
Die Punkte zeigen den Verbrauch je Stufe. Reicht das Ergebnis nicht aus, lohnt sich die nächsthöhere Stufe.
Stufe
Auto
- Automatische Auswahl
Wann sinnvoll?
Für Alltagsaufgaben. Langdock wählt das Modell anhand der ersten Nachricht.
Nutzungsverbrauch
Stufe
Effizient
- GPT-6 Luna
- Claude Haiku 4.5
Wann sinnvoll?
Kurze Mails, Übersetzungen, einfache Zusammenfassungen und Informationen aus Texten heraussuchen.
Nutzungsverbrauch
Stufe
Ausgewogen
- GPT-5.6 Terra
- Claude Sonnet 5
Wann sinnvoll?
Texte und Code erstellen, Informationen vergleichen und mit mehreren Integrationen arbeiten.
Nutzungsverbrauch
Stufe
Komplex
- GPT-6 Sol
- Claude Opus 5.5
Wann sinnvoll?
Schwierige Fragen analysieren, Möglichkeiten abwägen sowie komplexe Datenanalysen und Programmieraufgaben lösen.
Nutzungsverbrauch
Stufe
Maximal
- GPT-6 Astra
- Claude Fable 5.1
Wann sinnvoll?
Die schwierigsten Probleme lösen und lange Aufgaben mit vielen verknüpften Schritten planen, bearbeiten und prüfen.
Nutzungsverbrauch
Modellbeispiele, Stand September 2026. Die Skala ist eine Orientierung, der tatsächliche Verbrauch hängt auch von der jeweiligen Aufgabe ab.
Was jedes Modell pro Million Tokens kostet, listet Langdocks Modellübersicht.
2. Tokens sparen: Aufgaben effizient stellen
- 01
Kurz, klar und vollständig schreiben.
Ziel, nötige Informationen und gewünschtes Ergebnis in einer Nachricht zusammenfassen, ohne Höflichkeitsfloskeln.
- 02
Die Antwortlänge vorgeben.
Zum Beispiel: „Fünf Stichpunkte, maximal 150 Wörter.“ Bei Korrekturen nur die geänderten Abschnitte anfordern.
- 03
Dateien und Suche eingrenzen.
Nur die Seiten oder Kapitel anhängen, die für die Aufgabe nötig sind. Bei Suchaufträgen angeben, welche Ordner oder Zeiträume die KI durchsuchen soll.
- 04
Bei einem neuen Thema einen neuen Chat starten.
Ergebnisse aus dem alten Chat, die weiter gebraucht werden, als kurze Zusammenfassung mitnehmen.
- 05
Vorlagen mit Skills verbinden.
Ein Skill ist ein gespeicherter Arbeitsablauf, etwa eine Angebotsvorlage mit einem fertigen Programm, das sie befüllt. Die KI setzt dann nur die neuen Inhalte ein, statt den Ablauf jedes Mal neu aufzubauen.
- 06
Komplexe Aufgaben mit einem starken Modell lösen.
Ein stärkeres Modell verbraucht pro Anfrage mehr. Bei schwierigen Aufgaben spart es trotzdem oft Tokens, weil weniger Korrekturrunden nötig sind.
Beispiel
„Fasse das Angebot zusammen: Preis, Leistungen, offene Fragen. Maximal fünf Stichpunkte.“
3. Kontextfenster und Verbrauch im Blick behalten
Neben der Modellauswahl im Eingabefeld befindet sich ein kleiner Kreis. Ein Klick darauf öffnet ein Menü mit zwei Bereichen: oben das Kontextfenster, darunter die Nutzung in der 5-Stunden-Session und in der Woche, jeweils mit dem nächsten Reset.
Das Kontextfenster umfasst den gesamten Text, den das Modell bei jeder Antwort vorgelegt bekommt: die festen Anweisungen von Langdock, den bisherigen Chatverlauf, angehängte Dateien und die Beschreibungen der Werkzeuge. Weil das Modell diesen Text jedes Mal vollständig liest, wird jede weitere Runde in einem langen Chat teurer.
Ein neuer Chat beginnt mit einem leeren Kontextfenster, aber nicht mit einer neuen Session. Der bisherige Verbrauch zählt weiter.
Im Nachbau lassen sich die einzelnen Zeilen anklicken. Wer eine PDF in den Chat zieht, sieht, wie viel Platz sie belegt.
Nachricht an Langdock …
Was diese Zeile bedeutet
System-Tools
Werkzeuge, die Langdock jedem Chat mitgibt, etwa Suche und Dateizugriff. Ihre Beschreibungen belegen Platz im Fenster, auch wenn sie in diesem Chat nicht genutzt werden.
Dieser Anteil lässt sich nicht verändern. Er erklärt aber, warum auch ein neuer Chat nicht bei null beginnt.
System-Prompt
Langdocks feste Anweisungen an das Modell: Ton, Regeln, Format. Steht in jedem Chat am Anfang, vor der ersten Nachricht.
Nachrichten
Der bisherige Verlauf mit allen Nachrichten und Antworten. Er wächst mit jeder Runde, weil das Modell bei jeder Antwort den gesamten Verlauf neu liest.
Bei einem neuen Thema einen neuen Chat starten und den Zwischenstand als kurze Zusammenfassung mitnehmen.
Skills
Die Beschreibungen aller Skills, die im Workspace freigeschaltet sind, damit das Modell weiß, was es aufrufen kann. Jeder freigeschaltete Skill belegt deshalb Platz, auch wenn er nicht genutzt wird.
Dateien
Angehängte Dokumente landen komplett im Fenster, jede Seite, jede Tabelle. Ein 40-seitiges PDF kostet mehr als der ganze bisherige Chat zusammen.
Nur die Seiten oder Kapitel anhängen, die die Aufgabe braucht.
Weitere Tools
Ein Link schaltet das Werkzeug „URL öffnen“ frei. Die Beschreibung des Werkzeugs kommt ins Fenster, der Seiteninhalt erst, wenn das Modell sie liest.
Beispielwerte, vereinfacht. Die tatsächlichen Werte zeigt Langdock im jeweiligen Chat.
In den Chat ziehen
Anfassen, in den Chat ziehen, loslassen.
Wozu das Session-Limit da ist
Es begrenzt den Verbrauch innerhalb von fünf Stunden, damit eine einzelne lange Sitzung, etwa am Montagmorgen, nicht bereits das Budget der ganzen Woche aufbraucht.
Tipp: Die erste Nachricht früh am Tag senden.
Mit ihr beginnt die Session. Wer um 8 Uhr die erste Nachricht schickt, hat um 13 Uhr den Reset, auch wenn dazwischen Pausen liegen, und startet am Nachmittag mit einem neuen Fenster. Das Wochenlimit bleibt davon unberührt.
Langdock Limit erreicht: was dann
Ist keine Extra-Nutzung freigeschaltet, antwortet ein sparsameres Ersatzmodell, bis das Fenster zurückgesetzt ist. Zusätzliche, kostenpflichtige Nutzung lässt sich bei der Person anfragen, die Langdock im Unternehmen verwaltet.
Wie die Limits im Detail funktionieren, beschreibt der Artikel Nutzungslimits in Langdock.
Häufige Fragen
Quellen
Autor
Dennis Cutraro ist Co-Founder und Managing Partner von Unfuture. Er führt täglich Gespräche mit Kunden zu Langdock-Rollouts und steht im laufenden Austausch mit dem Langdock-Team.
