> ## Documentation Index
> Fetch the complete documentation index at: https://docs.varios-ai.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Sizing-Leitfaden

> Empfohlene Serverausstattung für On-Premise-Installationen nach Mitarbeiterzahl oder gleichzeitig aktiven Nutzern

Dieser Leitfaden nennt die empfohlene Serverausstattung für eine On-Premise-Installation von VARIOS AI. Die Sprachmodelle laufen bei Ihrem Modellanbieter oder auf einem separaten Modellserver, VARIOS AI selbst benötigt keine GPU.

Die Empfehlungen sind in fünf Stufen XS, S, M, L und XL zusammengefasst. Ohne Nutzer belegt VARIOS AI rund 5 GB Arbeitsspeicher und 15 GB Festplatte.

<Info>
  Die Werte sind Richtwerte für die Planung. Prüfen Sie nach der Einführung die Auslastung und passen Sie die Stufe bei Bedarf an.
</Info>

***

## Empfehlung nach Mitarbeiterzahl

Zählen Sie alle Personen mit Zugang zu VARIOS AI. Angenommen wird, dass an einem Arbeitstag 40 % davon VARIOS AI nutzen und dabei durchschnittlich 8 Nachrichten senden. Lastspitzen sind berücksichtigt.

| Mitarbeitende | Stufe | Prozessor und Arbeitsspeicher | Festplatte |
| ------------- | ----- | ----------------------------- | ---------- |
| bis 100       | XS    | 4 vCPU, 8 GB                  | 80 GB SSD  |
| bis 200       | S     | 4 vCPU, 16 GB                 | 100 GB SSD |
| bis 600       | M     | 8 vCPU, 32 GB                 | 200 GB SSD |
| bis 1.250     | L     | 16 vCPU, 64 GB                | 400 GB SSD |
| bis 2.000     | XL    | 24 vCPU, 96 GB                | 800 GB SSD |
| über 2.000    |       | verteilte Installation        |            |

<Tip>
  Ist die Nutzung in Ihrer Organisation verpflichtend oder sehr verbreitet, wählen Sie die nächsthöhere Stufe.
</Tip>

***

## Empfehlung nach gleichzeitig aktiven Nutzern

Nutzen Sie diese Tabelle, wenn Sie die erwartete Gleichzeitigkeit kennen, etwa aus einer Pilotphase. Ein gleichzeitig aktiver Nutzer chattet gerade und sendet etwa alle zwei bis drei Minuten eine Nachricht. Geöffnete Browser-Tabs ohne Interaktion zählen nicht.

| Gleichzeitig aktive Nutzer | Stufe | Prozessor und Arbeitsspeicher | Festplatte |
| -------------------------- | ----- | ----------------------------- | ---------- |
| bis 10                     | XS    | 4 vCPU, 8 GB                  | 80 GB SSD  |
| bis 20                     | S     | 4 vCPU, 16 GB                 | 100 GB SSD |
| bis 60                     | M     | 8 vCPU, 32 GB                 | 200 GB SSD |
| bis 125                    | L     | 16 vCPU, 64 GB                | 400 GB SSD |
| bis 200                    | XL    | 24 vCPU, 96 GB                | 800 GB SSD |
| über 200                   |       | verteilte Installation        |            |

Haben Sie die Gleichzeitigkeit zu normalen Zeiten gemessen, rechnen Sie mit dem Dreifachen als Reserve für Spitzenzeiten, bevor Sie die Stufe ablesen. Liefern beide Tabellen unterschiedliche Stufen, gilt die höhere.

***

## Speicherbedarf im Betrieb

Die Datenbank wächst mit den Chats. Bei gemischter Nutzung aus Text und Dokumenten sind es im Durchschnitt rund 100 KB je Frage, also etwa 80 GB pro Jahr je 1.000 Mitarbeitende. Der genaue Wert hängt stark von der Nutzung ab, reine Textchats benötigen deutlich weniger. Mit einer [Aufbewahrungsdauer von Chats](/de/extended-support/admin/einstellungen/allgemein#aufbewahrung) von 90 Tagen bleibt sie bei rund 20 GB je 1.000 Mitarbeitende. Hochgeladene Dateien kommen in voller Größe hinzu; ihr Umfang hängt von der Nutzung ab und sollte großzügig eingeplant werden. Wissensdatenbanken benötigen rund 7 MB je 100 Seiten Dokumenttext. Planen Sie für Datenbank-Backups den doppelten Platz der Datenbank ein.

***

## Was die Werte verschiebt

* **Wissensdatenbanken und Dateiuploads.** Große Dokumentmengen erhöhen die Last der DLP-Analyse. Befüllen Sie große Wissensdatenbanken außerhalb der Arbeitszeit oder wählen Sie eine Stufe höher. Bei Spezialanforderungen, etwa der DLP-Prüfung sehr vieler oder sehr großer Dokumente, kann die DLP-Analyse auf einen eigenen Server ausgelagert werden. Sprechen Sie dafür den Support an.
* **API-Integrationen.** Anwendungen, die über API-Keys anfragen, senden ohne Pausen und oft mehrere Anfragen parallel. Zählen Sie jede gleichzeitig laufende API-Anfrage wie drei gleichzeitig aktive Nutzer.

***

## Verteilte Installation

Für mehr als 2.000 Mitarbeitende oder 200 gleichzeitig aktive Nutzer wird VARIOS AI auf mehrere Server verteilt. Diese Installation planen wir gemeinsam mit Ihnen, wenden Sie sich dafür an den Support.

***

## Hochverfügbarkeit

VARIOS AI verteilt die Last bei Bedarf auf mehrere Server, bietet derzeit aber kein Clustering mit automatischem Failover. Für Hochverfügbarkeit empfehlen wir den Betrieb auf einer Virtualisierungsplattform mit eigenen HA-Funktionen, etwa VMware vSphere HA, Proxmox HA oder einem Hyper-V-Failovercluster. Fällt ein Host aus, startet die Plattform die virtuelle Maschine auf einem anderen Host neu. Ergänzen Sie dies um regelmäßige Backups der Datenbank und des Datenverzeichnisses.
