Tokenkosten senken: KI und Agenten effizient nutzen
Tokenkosten senken: KI und Agenten effizient nutzen

Tokenkosten senken: KI und Agenten effizient nutzen

Kreuz & Krone: KI begreifen und strategisch nutzen.


12.08.2026 • 30 Min.

Große Modelle, lange Chatverläufe, wiederholte Dokument-Uploads und ausufernde Antworten können den KI-Einsatz unnötig teuer machen. In Episode 16 von „Kreuz & Krone“ sprechen Hermann del Campo und Patrik Breitenmoser darüber, wie sich Tokenverbrauch und Kosten in Chats, Automatisierungen und KI-Agenten gezielt reduzieren lassen. Sie erklären, wann ein kleines oder mittleres Modell ausreicht, warum klar begrenzte Antworten besonders viel sparen und wie kompakte Systemprompts, Zusammenfassungen und eine schrittweise Optimierung für effizientere Workflows sorgen. Dazu teilen sie praktische Erfahrungen mit ChatGPT und Claude, diskutieren Agentenarchitekturen, Prompt-Caching und den Caveman-Ansatz – inklusive der Risiken, wenn Kürze zum Selbstzweck wird. Die wichtigste Erkenntnis: Gute Token-Optimierung beginnt nicht mit maximaler Kürze, sondern mit einer klaren Aufgabe, dem passenden Modell und einem präzise definierten Ergebnis.