Dimensionierung

Welcher Server für lokale KI
zwei Klassen, eine klare Untergrenze.

Die häufigste Frage vor dem Kauf: Wie groß muss die Maschine sein? Die Antwort hängt an drei Zahlen: Nutzer, Dokumente, Gleichzeitigkeit. Alles andere folgt daraus.

Für wen
Betriebe, die zwischen Einstieg und Produktivgröße entscheiden
Aufwand
15 Arbeitstage bis zur Spezifikation
Förderung
Wird für Ihr Bundesland geprüft
Datenhaltung
Komplett auf Ihrem Server, nichts geht nach außen
Erster Schritt
Dreißig Minuten Erstgespräch per Video

Für lokale KI gibt es zwei sinnvolle Größenklassen. Die Einstiegsklasse mit einer Profi-Grafikkarte mit 96 Gigabyte trägt ein großes Modell für etwa zwanzig Nutzer. Die Produktivklasse mit zwei solchen Karten trägt mehrere Power-User, Bildanalyse und Agentenketten im Dauerbetrieb. Eine Spielkarte mit 32 Gigabyte reicht nur für Einzeltests, nicht für ein Büro.

Stand: September 2026

Ein Dokumentenstapel unter einer Glasglocke, ein Kupferfaden führt von oben genau in ein bestimmtes Blatt
Die Unterlagen bleiben liegen, wo sie liegen. Gelesen wird darin, kopiert wird nichts, und die Antwort nennt das Blatt, aus dem sie stammt.

Sechs Fragen, die die Größe bestimmen

Diese sechs Antworten beantworten wir im Audit, daraus entsteht die Spezifikation.

  • Wie viele Menschen fragen das System, und wie viele davon gleichzeitig zur Mittagszeit
  • Wie viele Dokumente liegen im Bestand, und wie viel davon sind Scans
  • Kommen Bilder und Pläne dazu, die beschrieben werden sollen
  • Läuft Spracherkennung für Protokolle auf derselben Maschine
  • Soll das System nachts durcharbeiten, etwa für Einlesen und Neuindexierung
  • Sind Agentenketten geplant, die mehrere Schritte hintereinander rechnen

Für wen sich das lohnt

Geschäftsführung

Sie entscheiden über die Investition. Sie bekommen zwei Varianten mit klarer Aussage, was jede trägt.

IT und Administration

Sie planen Serverraum und Strom. Beide Klassen sind vorher beschrieben, inklusive Kühlung.

Einkauf

Mit der Spezifikation holen Sie Angebote ein und vergleichen, ohne KI-Wissen aufbauen zu müssen.

Warum zu klein teurer ist als zu groß

Ein zu kleiner Server macht die KI langsam, und eine langsame KI benutzt niemand. Dann war die ganze Einführung umsonst, inklusive Einlesen und Schulung. Aufrüsten heißt meist neue Karte, oft neues Gehäuse, manchmal neues Netzteil. Deshalb sagen wir lieber vorher eine unbequeme Zahl als hinterher eine Entschuldigung.

Wie Sie die richtige Größe bestimmen

Sie dimensionieren nicht nach Mitarbeiterzahl, sondern nach gleichzeitigen Anfragen. Von dreißig Leuten im Haus stellen selten mehr als drei zur selben Sekunde eine Frage. Entscheidend ist deshalb, wie lange eine Antwort dauern darf und wie viele Anfragen sich in dieser Zeit überlappen.

Die zweite Größe ist die Länge. Eine Frage an ein kurzes Protokoll braucht wenig, eine Frage, die zehn lange Dokumente einbezieht, deutlich mehr. Wer viel mit umfangreichen Verträgen und Gutachten arbeitet, braucht mehr Speicher als jemand mit kurzen Notizen, bei gleicher Nutzerzahl.

Deshalb entsteht die Spezifikation aus Ihrem Testsatz und nicht aus einer Tabelle. Wir messen mit Ihren echten Dokumenten und Ihren echten Fragen, wie lange eine Antwort dauert, und leiten daraus die Maschine ab. Das dauert zwei Tage und erspart eine Fehlinvestition.

Was wir dafür entwickeln

  1. 1

    Büro-Gedächtnis: Ihr KI-Gedächtnis, dessen Antwortzeit über die Akzeptanz entscheidet

    Büro-Gedächtnis im Detail
  2. 2

    Post-Lotse: Posteingang, der morgens eine Lastspitze erzeugt

    Post-Lotse im Detail
  3. 3

    Baustellen-Agent: Baustelle und Protokoll, zusätzliche Last durch Sprache und Bilder

    Baustellen-Agent im Detail

Nicht die Mitarbeiterzahl entscheidet, sondern wie viele Anfragen sich überlappen.

PhoenixOne AI

So bestimmen wir Ihre Größe

  1. 01

    Daten- und Netz-Audit

    Was liegt wo, wie viele Scans, welche Rechtegruppen, welcher Serverraum. Fünfzehn Arbeitstage, am Ende die Spezifikation für Server und Software.

  2. 02

    Aufbau im getrennten Netz

    Server im eigenen Netzsegment, Modell lauffähig, Anmeldung über Ihr Active Directory, erster Test mit hundert echten Dokumenten.

  3. 03

    Einlesen, Härten, Betrieb

    Bestand einlesen, Rechte vererben, Sicherheitsprüfung durch Dritte, Pilot mit einer Abteilung, dann Betrieb mit monatlichem Bericht.

◆Fachwörter auf dieser Seite

Erklärt im Glossar

Im Detail als Fachartikel

Was Betriebe an dieser Stelle fragen

Einwand

Können wir klein anfangen und später aufrüsten?

Ja, wenn Gehäuse, Netzteil und Kühlung von Anfang an für zwei Karten ausgelegt sind. Das planen wir in der Spezifikation ein, es kostet beim Kauf wenig.

Einwand

Wie viele Nutzer trägt eine Karte wirklich?

Etwa zwanzig in normaler Nutzung, also nicht alle gleichzeitig. Bei Dauerlast durch Einlesen und Bilder entsprechend weniger.

Einwand

Was ist mit kleinen Büros unter fünf Leuten?

Da reicht oft eine kleinere Karte mit einem mittelgroßen Modell. Das prüfen wir am Testsatz, bevor Sie kaufen.

Einwand

Brauchen wir einen zweiten Server für Ausfallsicherheit?

Für echte Ausfallsicherheit ja. Häufiger ist ein Warmstandby als zweite Phase, mit einem Zwischenstück davor, das später umschaltet.

Einwand

Gibt es Fördermittel für lokale KI?

Oft ja. Ob ein Zuschuss oder ein Darlehen greift, hängt an Ihrem Bundesland, an der Betriebsgröße und am Vorhaben. Hardware zählt in der Regel mit, wenn sie Teil des Vorhabens ist. Wir prüfen das vor dem Termin und sagen Ihnen, ob sich der Antragsaufwand lohnt.

Verwandte Seiten

Programme, mit denen Sie arbeiten

Zu jedem steht, was sich anbinden lässt, was dabei herauskommt und wo die Grenze liegt.

Alle Programme →

Sehen wir uns Ihren Bestand an.

Dreißig Minuten, per Video oder Telefon. Danach wissen Sie, ob lokale KI bei Ihnen trägt und was der erste Schritt ist.