Skip to main content

Kurzübersicht zu den Abrechnungsmodi

Eine kurze Vergleichsanleitung zur Auswahl zwischen den Abrechnungsmodi „Benutzerabschlüsse“ und „Nutzung nach Modell“.

Schneller Vergleich

Wann die einzelnen Modi verwendet werden sollten

Benutzervervollständigungsmodus

Wählen Sie dies, wenn:
  • ✅ Sie wollen vorhersehbare, feste Kosten
  • ✅ Sie liegen innerhalb der bestehenden Lizenzgrenzen
  • ✅ Du baust interne Tools
  • ✅ Sie möchten bestehende Kontingentzuteilungen nutzen
  • ✅ Sie benötigen ein einfaches Kostenmanagement
Beispielhafte Anwendungsfälle:
  • Interne Chatbots
  • Entwicklung und Tests
  • Anwendungen mit geringem Volumen
  • Projekte mit festem Budget

Nutzung nach Modellmodus

Wählen Sie dies, wenn:
  • ✅ Sie benötigen eine detaillierte Kostenverfolgung
  • ✅ Du verwendest häufig teure Modelle
  • ✅ Sie möchten nur für die tatsächliche Nutzung bezahlen
  • ✅ Sie benötigen eine detaillierte Nutzungsanalyse
  • ✅ Sie haben einen hohen Volumenbedarf
Beispielhafte Anwendungsfälle:
  • Produktionsanwendungen
  • KI-Dienste mit hohem Volumen
  • Kostensensible Projekte
  • Multi-Modell-Anwendungen

API-Nutzung

Bei Verwendung der externen API mit Abrechnungsmodi:

Tarifbegrenzungen

Standardratenbegrenzungen

  • Anfragen pro Minute: 60 (konfigurierbar)
  • Anfragen pro Stunde: 1.000 (konfigurierbar)
  • Tageslimits: 100 Anfragen (konfigurierbar)
  • Monatliche Limits: 10.000 Anfragen (konfigurierbar)

Spezifische Beschränkungen für den Abrechnungsmodus

  • Benutzerabschlüsse: Basierend auf dem Lizenzkontingent
  • Nutzung nach Modell: Zusätzliche Dollar-basierte Limits

SMLTP-Richtlinienintegration

Beide Abrechnungsmodi unterstützen die Durchsetzung von SMLTP-Richtlinien:

SMLTP-Konfigurationsbeispiel

Konfigurationsbeispiele

Konfiguration der Benutzervervollständigungen

Nutzung nach Modellkonfiguration

Fehlerszenarien

Fehler bei Benutzerabschlüssen

Verwendung durch Modellfehler

Migrationsleitfaden

Von Benutzervervollständigungen bis zur Nutzung nach Modell

  1. Nutzung nach Modell für den Benutzer aktivieren
  2. API-Schlüsselkonfiguration aktualisieren
  3. Nutzung und Kosten überwachen
    • Verfolgen Sie die Token-Nutzung
    • Überwachen Sie die monatlichen Ausgaben
    • Passen Sie die Grenzwerte nach Bedarf an

Von der Nutzung durch Modell zu Benutzervervollständigungen

  1. Überprüfen Sie, ob der Benutzer über ein ausreichendes Kontingent verfügt
    • Überprüfen Sie die Lizenzstufe
    • Überprüfen Sie die monatlichen Limits
  2. API-Schlüsselkonfiguration aktualisieren
  3. Abschlussnutzung überwachen
    • Verfolgen Sie die Anzahl der abgeschlossenen Arbeiten – Stellen Sie sicher, dass das Fallback-Verhalten funktioniert

Kostenschätzung

Kosten für Benutzerabschlüsse

  • Fixkosten: Basierend auf der Lizenzstufe
  • Keine zusätzlichen Kosten: Über die bestehende Lizenz hinaus
  • Vorhersehbar: Identisch mit der Nutzung der Webschnittstelle

Nutzung nach Modellkosten

  • Variable Kosten: Basierend auf der Token-Nutzung
  • Modellspezifische Preise: Unterschiedliche Tarife pro Modell
  • Beispielkosten:
    • GPT-5.1: Es gelten die Anbieterpreise
    • Claude Sonnet 4.6: Es gelten die Anbieterpreise
    • GPT-5 Nano: Es gelten die Anbieterpreise

Überwachungstipps

Überwachung der Benutzerabschlüsse

  • Verfolgen Sie die Anzahl der abgeschlossenen Arbeiten täglich
  • Überwachen Sie den Kontingentverbrauch
  • Legen Sie Warnungen fest, wenn sich Grenzen nähern
  • Überprüfen Sie monatlich die Nutzungsmuster

Nutzung durch Modellüberwachung

  • Verfolgen Sie die Token-Nutzung und -Kosten
  • Überwachen Sie die monatlichen Ausgaben
  • Legen Sie Dollar-Limit-Benachrichtigungen fest
  • Überprüfen Sie die Kostenaufschlüsselung nach Modell

Sicherheitsüberlegungen

Beide Modi

  • Verwenden Sie IP-Einschränkungen für sensible Apps
  • API-Schlüssel regelmäßig rotieren
  • Achten Sie auf ungewöhnliche Aktivitäten
  • Implementieren Sie eine ordnungsgemäße Fehlerbehandlung

Verwendung je nach Modell

  • Legen Sie angemessene Dollar-Limits fest
  • Überwachen Sie Kostenspitzen
  • Überprüfen Sie die Modellnutzungsmuster
  • Verfolgen Sie die Nutzung teurer Modelle

Support-Ressourcen

Dokumentation

Admin-Panel

  • API-Bereich: API-Schlüssel erstellen und verwalten
  • Benutzerbereich: Nutzung nach Modell aktivieren

Häufige Probleme

  1. Nutzung nach Modell funktioniert nicht: Überprüfen Sie die Benutzerberechtigungen
  2. Kontingent überschritten: Aktivieren Sie die Nutzung nach Modell oder erhöhen Sie die Grenzwerte
  3. Kostenspitzen: Überprüfen Sie die Modellnutzung und legen Sie Grenzen fest
  4. Authentifizierungsfehler: API-Schlüssel und Berechtigungen überprüfen