AI-Quota erreicht
Für die KI gelten zwei verschiedene Grenzen: ein Takt pro Minute und ein Kontingent pro Monat. Dazu kommen Störungen beim KI-Anbieter, die ähnlich klingen, aber nichts mit deinem Kontingent zu tun haben. Der erste Schritt ist deshalb immer, die Meldung genau zu lesen.
Die Meldung einordnen
| Meldung | Was dahintersteckt | Was du tust |
|---|---|---|
| „Zu viele KI-Anfragen. Bitte kurz warten." | Der Takt. Der Zähler hält 30 Anfragen Vorrat und füllt etwa 30 pro Minute nach. | Kurz warten und die Aktion erneut auslösen. Nichts ist verbraucht. |
| „Dein monatliches KI-Kontingent ist aufgebraucht. Bitte upgrade deinen Plan oder warte auf den Monatsreset." | Das Monatskontingent des Mandanten, geprüft vor dem Modellaufruf. | Auf den Monatswechsel warten oder den Tarif wechseln. |
| „Das KI-Kontingent dieses Mandanten ist aufgebraucht. Bitte den Administrator um eine Erhöhung des Kontingents bitten." | Dieselbe Grenze, gemeldet bei einer KI-Aktion statt im Chat. | Den Administrator des Mandanten ansprechen. |
| „Das KI-Kontingent ist erschoepft. Bitte spaeter erneut versuchen." | Dieselbe Grenze, gemeldet beim Anlegen eines Workflows. | Wie oben. |
| „KI-Kontingent erschöpft. Bitte Administrator kontaktieren." | Nicht dein Kontingent, sondern das Konto beim KI-Anbieter. | Den Betreiber informieren. Für dich ist hier nichts einzustellen. |
| „KI-Dienst nicht verfügbar: API-Schlüssel ungültig oder fehlt. Bitte Administrator kontaktieren." | Auf dem Server fehlt der Schlüssel für den KI-Anbieter. | Den Betreiber informieren. |
| „Der KI-Dienst ist momentan überlastet. Bitte in einem Moment erneut versuchen." | Der Anbieter drosselt. | Kurz warten und erneut auslösen. |
| „Die KI-Antwort hat zu lange gedauert. Bitte erneut versuchen." | Zeitüberschreitung beim Modell. | Erneut auslösen, bei langen Eingaben kürzer fragen. |
Kurz gesagt: „Zu viele Anfragen" ist der Takt und in einer Minute vorbei. „Kontingent aufgebraucht" ist der Monat. Alles mit „KI-Dienst" liegt am Anbieter.
Grenzen je Tarif
| Tarif | KI-Aktionen pro Monat | API-Takt pro Minute |
|---|---|---|
| free | 50 | 30 |
| starter | 500 | 60 |
| professional | 2.000 | 300 |
| enterprise | unbegrenzt | 2.000 |
Zusätzlich sind KI-Anfragen im Mandanten auf 60 pro Minute begrenzt. Bezahlte Tarife werden nicht hart abgeschnitten, wenn das enthaltene Kontingent aufgebraucht ist. Die Anfrage läuft dann weiter und wird als Mehrverbrauch gezählt.
Wenn der Takt bremst
- Warte eine Minute.
- Löse die Aktion erneut aus.
- Stoße nicht mehrere KI-Aktionen gleichzeitig an, etwa in mehreren Tabs.
Die KI antwortet danach wieder normal. Die Antwort auf die abgelehnte Anfrage trägt den Kopf Retry-After mit der Wartezeit in Sekunden.
Wenn das Monatskontingent leer ist
- Prüfe zuerst über die Tabelle oben, welchen Tarif ihr habt.
- Sprich den Administrator des Mandanten an. Nur er kann den Tarif wechseln.
- Bis dahin arbeitest du ohne KI weiter. Alle übrigen Funktionen sind davon nicht betroffen.
- Zum Monatsanfang steht das Kontingent wieder voll zur Verfügung.
Der Zähler läuft je Kalendermonat. Eine Nachfrage beim Support beschleunigt das nicht.
Verbrauch ansehen
- Öffne
/ai. - Klicke die Kachel „KI-Monitoring".
- Auf der Seite „KI-Observability" wählst du oben den Zeitraum „24h", „7 Tage" oder „30 Tage".
- Lies die Karten „Input-Tokens", „Output-Tokens" und „Kosten".
- Prüfe die Karte „Monatsbudget" mit der Zeile „Verbraucht: … von …" und den Balken.
- In „Nutzung pro User (aktueller Monat)" siehst du, wer wie viel verbraucht hat.
Danach weißt du, wohin der Verbrauch geht. Steht dort „Kein Monatsbudget hinterlegt — es wird nur der laufende Verbrauch angezeigt.", ist kein Euro-Budget gesetzt und der Balken bleibt leer.
Diese Seite rechnet in Euro und Tokens. Die Zahl der noch offenen KI-Aktionen zeigt sie nicht, und auch sonst keine Seite. Diese Zahl steht ausschließlich im Antwortkopf X-AI-Quota-Remaining, das Rücksetzdatum in X-AI-Quota-Reset.
Persönliches Budget und harte Sperre
Neben dem Kontingent an Aktionen gibt es Budgets in Euro. Sie greifen unabhängig davon.
| Fall | Kennzeichen | Bedeutung |
|---|---|---|
| Persönliches Budget aufgebraucht | user_quota_exceeded | Nur dein Budget ist leer. Die Antwort nennt Budget, Verbrauch und Rücksetzzeitpunkt. |
| Monatsbudget des Mandanten gesprengt | ai_hard_lock mit monthly_budget_exhausted | Eine harte Sperre für den ganzen Mandanten. |
Beides löst der Administrator im Mandanten, nicht der Support.
Wenn die KI ganz ausfällt
Fällt der KI-Dienst aus, laufen Lesen und Erfassen normal weiter. Nur die KI-Funktionen antworten nicht. Ein Banner mit dem Satz „AI-Layer down — Read-Only-Mode aktiv" ist zwar gebaut, wird aber an keiner Stelle eingebunden. Du siehst diesen Satz in der Oberfläche also nicht und musst dich an den Meldungen der einzelnen KI-Aktionen orientieren.
Umgekehrt gilt: Kann Nemix das Kontingent nicht sicher ermitteln, lässt es die Anfrage bewusst durch. Ein Messfehler blockiert die KI also nicht.