Verbrauch & Abrechnung
Paket, KI-Verbrauch in EUR, Läufe und abrechenbare Konversationen pro Monat: KI-gelöst vs. Team-gelöst, Tageslimit, KI-Modellwahl und Aufschlüsselung nach Desk und Skill.
Überblick
Unter Einstellungen, Verbrauch und Abrechnung sehen Sie Ihr Paket, was der KI-Einsatz Ihres Workspace kostet und wie viele Konversationen im Monat abrechenbar gelöst wurden. Die Seite gilt für den gesamten Workspace, nicht nur für einen Desk, und ist Workspace-Admins vorbehalten. Alle Beträge stehen in EUR.
Oben blättern Sie mit den Pfeilen durch die Kalendermonate (UTC). Drei Kacheln fassen den Monat zusammen: KI-Verbrauch (Monat, EUR) als Endbetrag inklusive Aufschlag, Läufe als Anzahl aller KI-Läufe (Triage, Recherche, Entwürfe und mehr) und Kosten heute für den laufenden Tag.
- 1Monat wählen, mit den Pfeilen blätterst du zurück
- 2KI-Verbrauch (Monat, EUR): Endbetrag aller KI-Läufe inklusive Aufschlag
- 3Kosten heute: die Basis für das Tageslimit
- 7Der Menüpunkt Verbrauch und Abrechnung im Bereich Workspace
Hinweis: Ohne Admin-Rolle zeigt die Seite den Hinweis Nur für Workspace-Admins. Fragen Sie in dem Fall die Person, die Ihren Workspace verwaltet.
Ihr Paket: Studio, Signature oder Maison
Die Karte Paket zeigt das gebuchte Paket und wie weit das inkludierte Volumen reicht: Bezahlt wird pro gelöster Konversation, mit unbegrenzten Nutzer:innen in jedem Paket. Studio (690 € pro Monat) enthält bis 750 gelöste Konversationen, Signature (1.690 €) bis 2.500, Maison (ab 3.990 €) ab 6.000.
Über dem Balken sehen Sie die gelösten Konversationen gegen das inkludierte Volumen, daneben die Überziehung (je angefangene 100 Konversationen: 69 € im Studio, 49 € im Signature, individuell im Maison) und den voraussichtlichen Monatsbetrag aus Paketpreis, Überziehung und KI-Verbrauch. Mit den Paketkarten darunter wechseln Sie das Paket direkt.
Hinweis: Aktuell ist das reines Tracking: Die Zahlen sind korrekt gemessen, Rechnungen erstellt hermine.ai desk hier aber noch nicht. Die Rechnungsstellung folgt mit dem hermine.ai Abrechnungssystem.
KI-Tipp: Der KI-Verbrauch kommt transparent nach tatsächlicher Nutzung dazu, im Schnitt etwa 0,45 bis 0,75 € pro gelöster Konversation. Einfache Anfragen liegen eher bei 10 Cent, tiefe Recherchen selten über 1,70 €.
Was passiert, wenn ich das inkludierte Volumen überschreite?
Nichts wird abgeschaltet. Zusätzliche gelöste Konversationen werden in Blöcken von 100 gezählt und mit dem Blockpreis Ihres Pakets ausgewiesen; im Maison-Paket wird die Überziehung individuell vereinbart.
KI-Modelle: starkes und Standard-Modell wählen
Unter Einstellungen, KI-Modelle legen Sie fest, mit welchen Modellen Ihr Workspace arbeitet, getrennt nach zwei Rollen: Das starke Modell übernimmt anspruchsvolle Aufgaben (Recherche, Antwortentwürfe, Assistent, Widget-Antworten), das Standard-Modell die einfachen, häufigen (Triage, Datenextraktion, Bewertungen).
Zur Wahl stehen die europäischen Plattform-Standards (GLM und Qwen, gehostet in Paris), Anthropic-Modelle (Claude Opus, Sonnet, Haiku) über AWS Bedrock in Frankfurt sowie OpenAI-Modelle (GPT-5.5, GPT-5.4, GPT-5.4 mini) über Azure in Schweden, alles EU-Regionen. Zu jedem Modell stehen die Endpreise in EUR pro 1 Mio. Tokens dabei, inklusive Aufschlag auf die reinen Anbieterkosten (Faktor 1,4, bei Premium-Modellen wie Opus oder GPT-5.5 auf 1,2 gedeckelt). Plattform-Standard wählt immer die empfohlene Voreinstellung.
Hinweis: Bedrock- und Azure-Modelle erscheinen ausgegraut, solange der Betreiber die jeweiligen Zugangsdaten nicht hinterlegt hat. Ihre Auswahl wirkt sofort auf alle neuen KI-Läufe des Workspace.
Ändert die Modellwahl mein Paket oder meine Grundgebühr?
Nein. Die Modellwahl beeinflusst nur den KI-Verbrauch, der nach tatsächlicher Nutzung abgerechnet wird. Teurere Modelle bedeuten höhere Tokenpreise, die Sie vor der Auswahl transparent sehen.
So rechnet hermine.ai desk ab: KI-gelöst vs. Team-gelöst
Die Karte Abrechenbare Konversationen zeigt das Abrechnungsmodell: Jede im Monat gelöste Konversation zählt genau einmal, entweder als KI-gelöst oder als Team-gelöst. Beides zusammen ergibt Gelöst gesamt.
Als KI-gelöst zählen Widget-Konversationen, die die KI ohne das Team von Anfang bis Ende beantwortet hat. Sobald ein Mensch beteiligt war (Übergabe ans Team, freigegebener Entwurf, eigene Antwort), zählt die Konversation als Team-gelöst.
KI-Tipp: Das Modell belohnt gutes Wissen: Je besser Ihre Wissensbasis, desto mehr Konversationen löst die KI im Widget allein, und desto klarer sehen Sie hier, was sich die Automatisierung verdient. Die Kontrolle bleibt bei Ihnen, denn außerhalb des Widgets antwortet die KI nur nach Freigabe.
Zählt eine Konversation doppelt, wenn sie mehrfach angefasst wird?
Nein. Jede im Monat gelöste Konversation zählt genau einmal, in genau einer der beiden Kategorien.
Das Tageslimit: die Notbremse für KI-Kosten
Die Karte Tageslimit zeigt den Kosten-Guard: einen Balken, der die heutigen KI-Ausgaben mit dem konfigurierten EUR-Tagesbudget vergleicht. Er ist eine Notbremse, keine Rechnung.
Wird das Limit überschritten, pausieren die KI-Läufe bis Mitternacht (UTC) und laufen dann automatisch wieder an. Ist kein Tageslimit konfiguriert, ist der Kosten-Guard deaktiviert und die Karte sagt Ihnen das.
Achtung: Während der Pause entstehen keine neuen KI-Entwürfe und keine KI-Antworten im Widget, eingehende Nachrichten bleiben aber normal in der Inbox und Ihr Team kann weiter antworten. Färbt sich der Balken gelb oder rot, lohnt ein Blick, welcher Desk oder Skill die Kosten treibt.
Speicher: das Dateikontingent des Workspace
Die Karte Speicher zeigt, wie viel des Dateikontingents Ihr Workspace belegt: Anhänge aus Konversationen, CRM-Dokumente, Wissensdateien und Avatare zählen zusammen auf ein gemeinsames Kontingent (standardmäßig 10 GB). Der Balken färbt sich ab 80 Prozent gelb und bei vollem Kontingent rot.
Ist das Kontingent ausgeschöpft, blockiert hermine.ai desk neue Uploads mit einer klaren Fehlermeldung, bis Dateien gelöscht werden oder das Kontingent erhöht wird. Bestehende Dateien bleiben unverändert abrufbar.
Tipp: Wird es eng, lohnt ein Blick in alte Konversationsanhänge und abgelaufene CRM-Dokumente: Gelöschte Dateien geben ihren Platz sofort wieder frei.
Aufschlüsselung nach Desk und Skill
Zwei Tabellen zeigen, wohin die Kosten fließen: Nach Desk listet je Desk die Läufe und Kosten (EUR), Jobs ohne Desk-Bezug erscheinen als Ohne Desk (Workspace-Jobs). Nach Skill schlüsselt dieselben Zahlen nach dem auslösenden Skill oder der Quelle auf, etwa Triage, Recherche oder Entwurf.
Warum weicht die Kachel KI-Verbrauch von der Summe der Tabellen ab?
Die Tabellen zeigen die reinen Einkaufskosten der KI-Anbieter, die Kachel den Endbetrag inklusive Aufschlag (Faktor 1,4, bei Premium-Modellen 1,2). Beides steht in EUR.
Kann ich vergangene Monate ansehen?
Ja, mit dem Pfeil neben dem Monatsnamen blättern Sie beliebig weit zurück. Nur in die Zukunft geht es nicht.
Berichte
Kennzahlen und Trends des aktiven Desks: Reaktionszeiten, KI-Anteil, SLA, Zufriedenheit, Volumen nach Kanal und Kategorie, dazu die Auslastung des Teams und automatisch erkannte Themen.
Das Widget aus Kundensicht
So erleben Kund:innen den Chat auf Ihrer Website: KI antwortet zuerst und gekennzeichnet, Übergabe ans Team, Lösen mit Sterne-Bewertung, dazu Ankündigungen für Störungen, Wartungsfenster und Neuigkeiten.