Taschenrechner, Notizen und Brille auf einem Arbeitstisch.

Ein kleiner KI-Assistent kann bei den reinen Modellkosten nur wenige Dollar im Monat verursachen. Ein zuverlässig betreuter Unternehmensservice kostet mehr: Jemand muss Inhalte vorbereiten, Zugriffe absichern, Antworten prüfen und Änderungen pflegen. Wer nur den Token-Preis vergleicht, vergleicht den Stromverbrauch einer Maschine mit den Kosten der ganzen Werkstatt.

Für einen überschaubaren Website-Assistenten kann ein illustratives Planungsbudget von 1.500 bis 5.000 Euro für die Einrichtung, zuzüglich Hosting, Modellnutzung und laufender Betreuung, ein sinnvoller Ausgangspunkt sein. Das ist eine redaktionelle Schätzung für den unten beschriebenen Umfang, keine Marktstatistik und kein Angebot von LindenTech. Bestehende Standardprodukte können darunter liegen; individuelle Integrationen deutlich darüber.

Drei Kostenarten, die auf jedes Angebot gehören

Kostenblock Was damit bezahlt wird Wie er abgerechnet werden kann
Setup Ziele, Wissensaufbereitung, Konfiguration, Einbindung, Tests und Übergabe Einmalig oder nach Projektphasen
Technischer Betrieb Anwendung, Datenbank, Suche, Backups und Monitoring Monatliche Grundkosten plus Verbrauch
Nutzung und Betreuung Modellaufrufe, Nachrichtenkanäle, Qualitätskontrolle und Änderungen Nach Verbrauch, Stunden oder vereinbartem Paket

Eine niedrige Monatsgebühr sagt wenig aus, wenn Dokumente nur gegen Aufpreis aktualisiert werden oder jede Übergabe an einen Menschen zusätzlich kostet. Umgekehrt ist ein höheres Paket nicht automatisch teuer, wenn es tatsächlich laufende Arbeit ersetzt. Entscheidend ist die vollständige Leistungsgrenze.

Welche Setup-Spanne passt zu welchem Vorhaben?

Die folgenden Beträge sind bewusst als Planungsannahmen in Euro netto gekennzeichnet. Sie lassen sich über einen angenommenen Aufwand von 15 bis 50, 50 bis 150 beziehungsweise 150 bis 400 Stunden bei einem rein kalkulatorischen Satz von 100 Euro pro Stunde nachvollziehen. Dieser Satz ist keine veröffentlichte LindenTech-Preisliste.

Beispielumfang Einmaliges Planungsbudget Damit wird hier gerechnet
Website-Auskunft 1.500–5.000 € Eine Sprache, vorhandene geprüfte Inhalte, keine Kundendaten-Abfrage, einfache Kontaktübergabe
Assistent mit einer Integration 5.000–15.000 € Zusätzlich eine dokumentierte Schnittstelle, definierte Zugriffsrechte und fachliche Abnahmetests
Individueller Prozessassistent 15.000–40.000 € und mehr Mehrere Systeme, Rollen, Freigaben, Fehlerbehandlung und umfangreichere Betriebsanforderungen

Nicht enthalten sind beispielsweise die Sanierung alter Kundendaten, eine umfassende Rechtsberatung, neu zu entwickelnde Fremdschnittstellen oder ein durchgehend besetzter menschlicher Kundendienst. Gerade diese Positionen sollten vor einem Festpreis geklärt werden. Die Anzahl der PDFs allein ist kein brauchbarer Aufwandsschlüssel: Zehn widersprüchliche Preislisten können mehr Arbeit machen als hundert saubere Hilfeseiten.

Vier Kostenblöcke eines KI-Assistenten: einmaliges Setup sowie laufendes Hosting, Modellverbrauch und Betreuung.

Grafik vergrößern ↗

Token-Kosten: eine Rechnung, die Sie nachrechnen können

Für das Beispiel wählen wir GPT-5 mini, ohne damit eine Empfehlung für jede Aufgabe auszusprechen. Der am 10. September 2026 geprüfte Standardpreis beträgt 0,25 US-Dollar je Million Eingabe-Token und 2,00 US-Dollar je Million Ausgabe-Token. Es gibt einen günstigeren Preis für wiederverwendete Eingaben, den wir hier nicht ansetzen. Quelle: offizielle Modell- und Preisdokumentation.

Eine „Anfrage“ bedeutet in dieser Rechnung genau einen Modellaufruf, nicht einen vollständigen Chat. Wir nehmen durchschnittlich 3.000 Eingabe-Token für Anweisung, Frage, Verlauf und gefundene Textstellen sowie 600 abgerechnete Ausgabe-Token an. Letztere müssen gegebenenfalls auch interne Reasoning-Token umfassen; 600 sichtbare Antwort-Token wären dafür keine verlässliche Obergrenze.

Kosten je Anfrage = (3.000 × 0,25 + 600 × 2,00) / 1.000.000 = 0,00195 USD.

Sie kennen Ihr eigenes Volumen? Im Rechner am Ende des Artikels können Sie die Anzahl der Aufrufe und Token direkt verändern.

Modellaufrufe pro Monat Eingabe-Token Ausgabe-Token Reine Modellkosten pro Monat
500 1,5 Mio. 0,3 Mio. 0,975 USD, gerundet 0,98 USD
2.000 6 Mio. 1,2 Mio. 3,90 USD
10.000 30 Mio. 6 Mio. 19,50 USD

Das sind Rechenergebnisse unter festen Annahmen, keine gemessenen Kundendaten. Ein Gespräch mit fünf solchen Aufrufen verursacht entsprechend fünfmal so viel. Suchwerkzeuge, Embeddings, Dateispeicherung, Sprache, Bilder, weitere Modellaufrufe, Wiederholungen und Kanalgebühren sind nicht enthalten. Auch Steuern, Wechselkurs und Zahlungsgebühren fehlen. Dollarbeträge werden deshalb nicht scheinpräzise in Euro umgerechnet.

Hosting und Betreuung sind eigene Budgetzeilen

Die nächste Tabelle ist eine zusätzliche redaktionelle Budgetskizze, keine Ableitung aus den Anbieterpreisen. Unterstellt wird eine kleine verwaltete Anwendung mit begrenzter Datenmenge, Backups und einfacher Überwachung, ohne zugesicherte Rund-um-die-Uhr-Reaktionszeit. Die Betreuungsannahmen entsprechen ein bis drei, zwei bis sechs und vier bis zwölf Stunden monatlich zum oben genannten kalkulatorischen Satz.

Modellaufrufe pro Monat Hosting, Datenbank und Suche Betreuung und Inhaltskontrolle Modellkosten aus dem Beispiel
500 20–80 € / Monat 100–300 € / Monat 0,98 USD / Monat
2.000 40–150 € / Monat 200–600 € / Monat 3,90 USD / Monat
10.000 100–400 € / Monat 400–1.200 € / Monat 19,50 USD / Monat

Die Zeilen beschreiben drei Planungsszenarien, keine technisch notwendigen Verbrauchsstufen. Eine gut konfigurierte Anwendung kann 10.000 Aufrufe im kleineren Hosting-Paket bedienen. Hohe Gleichzeitigkeit, große Suchindizes oder strenge Verfügbarkeitsanforderungen können dagegen schon bei wenig Verkehr höhere Kosten auslösen. Bei Eigenbetreuung verschwindet der Aufwand nicht, sondern liegt beim eigenen Team.

Wann lohnt sich das wirtschaftlich?

Rechnen Sie mit nachweislich entlasteten Minuten, nicht mit der Zahl ausgegebener Antworten. Ein Beispiel: Werden monatlich 300 Vorgänge tatsächlich um jeweils vier Minuten verkürzt, entstehen 20 Stunden Zeitgewinn. Bei angenommenen internen Vollkosten von 40 Euro pro Stunde entspricht das 800 Euro rechnerischer Kapazität. Davon ziehen Sie Kontrolle, Nacharbeit und Betrieb ab. Freie Kapazität ist noch keine entsprechende Einsparung auf dem Bankkonto.

Vergleichen Sie im Pilot ähnliche Vorgänge vor und nach der Einführung. Erfassen Sie auch falsche Antworten, abgebrochene Chats und notwendige Rückfragen. Ein Bot, der Anfragen scheinbar „erledigt“, aber anschließend zusätzliche Telefonate auslöst, verbessert die Bilanz nicht.

Fünf Fragen vor der Beauftragung

  1. Was zählt als Anfrage: Nachricht, Gespräch, Modellaufruf oder erledigter Vorgang?
  2. Welche Änderungen, Sprachen und Dokumentmengen sind enthalten?
  3. Welche Kostenobergrenze und welcher Ersatzweg gelten bei Überlastung?
  4. Wer prüft regelmäßig die Antwortqualität und übernimmt unklare Fälle?
  5. Können Inhalte, Konfiguration und Daten bei einem Anbieterwechsel exportiert werden?

Mit diesen Antworten lässt sich ein Angebot vernünftig vergleichen. Mehr zum Aufbau finden Sie bei unseren AI- und Automatisierungsleistungen. Für die Kanalgebühren ergänzt der WhatsApp-Leitfaden diese Rechnung.

Preis- und Quellenstand: 10. September 2026. Anbieterpreise können sich ändern. Vor einer Investition gehören gemessene Nutzung, aktueller Tarif und der konkrete Leistungsumfang in dieselbe Kalkulation.

Mit Ihren Annahmen rechnen

Wie verändert sich der Modellanteil?

Ein Modellaufruf ist eine Anfrage. Ein Gespräch kann mehrere Aufrufe auslösen. Ändern Sie Volumen und durchschnittliche Tokenmenge; die Rechnung bleibt vollständig in Ihrem Browser.

Ausgabe-Token einschließlich eventuell abgerechneter Reasoning-Token. Eingaben enthalten auch Anweisung, Verlauf und Dokumentauszüge.

Reine Modellkosten pro Monat3,90 $

GPT-5 mini: 0,25 USD je Million Eingabe-Token und 2,00 USD je Million Ausgabe-Token. Stand: 10.09.2026. Ohne Cache-Rabatt, Werkzeuge, Hosting, Betreuung, Kanalgebühren und Steuern. Offizielle Preisgrundlage.