KI

Chatbot-Betriebskosten-Rechner

Ein Support-Chatbot verursacht Kosten pro Konversation, die sich aus mehreren Nachrichtenrunden und einem mitwachsenden Kontext zusammensetzen. Dieser Rechner schätzt aus Nutzerzahl, Sessions und durchschnittlichem Token-Verbrauch die monatlichen API-Kosten und die Kosten pro gelöstem Anliegen.

Wozu dient der Chatbot-Betriebskosten-Rechner?

Ein Support- oder Verkaufs-Chatbot auf LLM-Basis verursacht laufende API-Kosten, die viele unterschätzen: Jede Antwort verarbeitet nicht nur die neue Nutzerfrage, sondern den gesamten bisherigen Gesprächsverlauf als Input-Token, und das über mehrere Nachrichtenrunden pro Session.

Dieser Rechner schätzt aus Nutzerzahl pro Tag, Nachrichten pro Session und durchschnittlichem Token-Verbrauch deine täglichen, monatlichen und jährlichen Betriebskosten. Wichtig sind die Pro-Stück-Werte: Kosten pro Session und pro Nachricht zeigen dir, ob sich dein Bot rechnet. Achte besonders auf die Input-Token mit Verlauf, denn dieser mitwachsende Kontext ist meist der größere Kostentreiber als die eigentliche Antwort.

Beispiele

  • Mittlerer Support-Bot: 300 Nutzer/Tag, 6 Nachrichten/Session, 1.800 Input- und 250 Output-Token pro Antwort, Preise 0,80/4 USD pro 1M Token ergeben rund 121 €/Monat.
  • Kosten pro Gespräch: Bei 1.800 Antworten am Tag und gut 4 € Tageskosten kostet eine komplette Session nur etwa 0,01 €.
  • Verlauf kostet mehr als die Antwort: 1.800 × 1.800 Input-Token ergeben 3,24 Mio. Input-Token/Tag gegenüber nur 0,45 Mio. Output-Token.
  • Günstiges Modell skaliert: Verdoppelst du auf 600 Nutzer/Tag, verdoppeln sich Kosten und Token-Verbrauch linear auf rund 242 €/Monat.

Häufige Fragen zum Chatbot-Betriebskosten-Rechner

Warum kosten die Input-Token oft mehr als die Antwort?

Weil bei jeder neuen Nachricht der komplette bisherige Verlauf plus Systemprompt erneut als Input mitgeschickt und bezahlt wird. Über sechs Runden summiert sich das schnell auf ein Vielfaches der reinen Antwort-Token.

Was sind realistische Token-Werte pro Antwort?

Eine kurze Support-Antwort liegt bei 100 bis 400 Output-Token. Der Input mit Verlauf hängt stark von der Session-Länge ab, oft 1.000 bis 4.000 Token. Prompt-Caching kann den Input deutlich vergünstigen.

Wie senke ich die Chatbot-Kosten?

Nutze ein günstigeres Modell für einfache Anfragen, kürze den mitgeschickten Verlauf, fasse alte Nachrichten zusammen und aktiviere Prompt-Caching für den festen Systemprompt und Wissensbausteine.

Rechnet der Rechner mit Brutto- oder Netto-Preisen?

Mit den von dir eingegebenen API-Preisen pro 1M Token in USD, umgerechnet über den Wechselkurs. Anbieter weisen API-Preise meist netto aus; eine eventuelle Umsatzsteuer ist hier nicht enthalten.