Ratgeber Eigenbau

Von Carlo Pfefferkorn, Geschäftsführer der Mindspace Solutions GmbH, leitet die IT · Stand:

KI-Server selbst bauen oder kaufen?

Einen KI-Server selbst zu bauen lohnt sich, wenn jemand im Haus Linux, Netzwerk und KI-Software sicher betreiben kann. Die Software ist frei: Ollama als Motor, Open WebUI als Oberfläche, dazu offene Modelle. Die eigentliche Arbeit liegt in Einrichtung, Rechten, Back-ups und Updates. Fehlt diese Person, ist ein fertig eingerichteter KI-Server der kürzere Weg.

Diese Seite ist für alle, die über einen eigenen KI-Server nachdenken: was Sie für den Eigenbau brauchen, was die Hardware kostet, was lokale KI heute schon kann und wie der Weg ohne eigenen Admin aussieht.

Helion Ultra KI-Server mit Glasseite auf einem Sideboard im Büro
Wege

Wie können Unternehmen lokale KI heute schon nutzen?

Im Kern gibt es zwei Wege, lokale KI im Unternehmen zu betreiben. Erstens: selbst bauen, mit offener Software wie Ollama und Open WebUI auf eigener Hardware. Zweitens: große KI-Hardware von Nvidia oder Apple kaufen und selbst einrichten. Beide brauchen jemanden im Haus, der den Betrieb übernimmt. Ein dritter Weg ist ein fertig eingerichteter KI-Server.

Selbst bauen, mit offener Software

Sie brauchen Hardware, auf der das läuft, und jemanden im Haus, der das kann. Es gibt Open WebUI, Ollama, offene Modelle und Anleitungen, die Sie herunterladen und bei sich lokal laufen lassen. Die Chat-Oberfläche von Open WebUI ist ChatGPT ziemlich ähnlich.

Große KI-Hardware kaufen

Nvidia, Apple und Systeme mit RTX-Pro-Karten sind Hardware, die enorm gut darin ist, KI-Modelle zu verarbeiten. Der Nachteil sind Einrichtung und Betrieb: Auch hier brauchen Sie einen Admin und viel Zeit und Geld, bis es läuft.

Fertig eingerichtet kaufen

Der dritte Weg ist ein KI-Server, der vorinstalliert ankommt: bestellen, anschließen, im Browser loslegen. Genau dafür haben wir den Helion KI-Server gebaut. Mehr dazu weiter unten.

Wie lokale KI technisch funktioniert, warum die Daten dabei im Haus bleiben und welche Modelle es gibt, erklären wir im Ratgeber lokale KI für Unternehmen.

Selbst bauen

Was brauchen Sie, um einen KI-Server selber zu bauen?

Für einen selbst gebauten KI-Server brauchen Sie einen Rechner mit viel Grafikspeicher, einen Motor wie Ollama, offene Sprachmodelle und eine Oberfläche wie Open WebUI. Die Software kostet nichts. Danach legen Sie Nutzer an, binden Dokumente an und testen. Für Rechte, Back-ups, Updates und Modellwechsel braucht es dauerhaft jemanden im Haus.

Mann arbeitet am Laptop an einer KI-Oberfläche in einem Büro
Die eigentliche Arbeit beim Eigenbau: einrichten, Rechte vergeben, Dokumente anbinden und testen.
  1. Rechner mit viel Grafikspeicher

    Das Modell wird im Grafikspeicher gerechnet. Je größer das Modell und je mehr Menschen gleichzeitig fragen, desto mehr Speicher brauchen Sie. Je besser die Grafikkarte, desto schneller die Antwort.

  2. Motor installieren

    Ollama führt die Modelle aus. Es ist kostenlos, steht unter der MIT-Lizenz und läuft auf macOS, Windows und Linux (Ollama auf GitHub).

  3. Modelle herunterladen

    Offene Modelle wie Qwen, Gemma oder gpt-oss sind große Dateien, Dutzende bis einige Hundert Gigabyte. Welches Modell passt, hängt von Ihrem Grafikspeicher und Ihren Aufgaben ab.

  4. Oberfläche aufsetzen und Nutzer anlegen

    Open WebUI ist die Chat-Oberfläche im Browser, mit Nutzerkonten und Rollen. Installiert wird sie meist per Docker (Open WebUI Dokumentation).

  5. Dokumente anbinden und testen

    Hier liegt die eigentliche Arbeit: Unterlagen einlesen, Wissensbereiche und Rechte festlegen, prüfen, ob die Antworten stimmen.

  6. Betreiben

    Rechte, Back-ups, Updates, Modellwechsel, Betrieb: Es muss einfach jemand im Haus sein, der das gut kann. Und zwar auf Dauer, nicht nur am ersten Tag.

„Wenn Sie Leute im Haus haben, die das können: Machen Sie das. Das ist jeden Cent wert.“

Giannina Pfefferkorn, Mitgründerin der Mindspace Solutions GmbH, beim Launch des Helion KI-Servers

Worauf müssen Sie beim Eigenbau achten?

Auf den Zugang. Ollama hat an seiner Schnittstelle keine eigene Anmeldung und ist ab Werk nur auf dem Rechner selbst erreichbar (Ollama FAQ). Wer es fürs Team im Netzwerk freigibt, muss den Zugang selbst absichern. Wie oft das schiefgeht, zeigt eine Auswertung von Cisco Talos aus dem September 2025: Über 1.100 Ollama-Server waren offen aus dem Internet erreichbar, 8,9 Prozent davon in Deutschland (The Register).

Auf die Lizenz. Ollama steht unter der MIT-Lizenz. Open WebUI verlangt seit Version 0.6.6, dass Name und Logo sichtbar bleiben, sobald mehr als 50 Personen in 30 Tagen die Oberfläche nutzen. Wer das Erscheinungsbild ändern will, braucht dann eine Enterprise-Lizenz (Lizenz von Open WebUI).

Hardware

Was kostet die Hardware für einen eigenen KI-Server?

Hardware für lokale KI ist 2026 deutlich teurer geworden, weil Speicherbausteine knapp sind. Eine Nvidia DGX Spark kostet 4.800 €, ein Mac Studio mit M5 Ultra ab 8.029 €, eine einzelne RTX Pro 6000 mit 96 GB rund 14.000 €. Dazu kommen Einrichtung und Betrieb, die beim Eigenbau Ihre eigene Arbeitszeit kosten.

Hardware für lokale KI, Preise laut Quelle (Stand: 1. Oktober 2026)
SystemSpeicher für KIPreisHinweis
Nvidia DGX Spark128 GB gemeinsamer Speicher4.800 € (Founders Edition)Kompakter Rechner für KI-Entwicklung, Preis seit Februar 2026
Apple Mac Studio M5 Ultra96 GB oder 256 GB gemeinsamer Speicherab 8.029 €, mit 256 GB 10.999 €Ab 22. September 2026 erhältlich
Nvidia RTX Pro 6000 Blackwell96 GB Grafikspeicherrund 14.000 €, nur die KarteRechner, Netzteil und Kühlung kommen hinzu
Helion KI-Server32, 48 oder 64 GB KI-Speicher6.490 € bis 14.990 € nettoKomplettgerät, vorinstalliert, für Teams bis 100 Personen

Preise von Drittanbietern laut den verlinkten Berichten, in der Regel inklusive Mehrwertsteuer, und schwankend. Preise des Helion KI-Servers netto zuzüglich Mehrwertsteuer. Speicherangaben sind nur grob vergleichbar: Bei DGX Spark und Mac Studio teilen sich Prozessor und KI denselben Speicher.

„Da zahlt man für Hardware, die enorm gut darin ist, KI-Modelle zu verarbeiten. Der Nachteil sind Einrichtung und Betrieb.“

Giannina Pfefferkorn, Mitgründerin der Mindspace Solutions GmbH, beim Launch des Helion KI-Servers
Vergleich

Eigenbau oder fertiger KI-Server: Was ist der Unterschied?

Beim Eigenbau bekommen Sie volle Freiheit und zahlen mit Arbeitszeit: Auswahl, Installation, Rechte, Sicherheit und Updates liegen bei Ihnen. Ein fertiger KI-Server wie der Helion KI-Server kommt vorinstalliert, wird im Browser bedient und ist in 10 Minuten startklar. Beides hält Ihre Daten im Haus. Der Unterschied liegt darin, wer den Betrieb trägt.

Eigenbau, KI-Hardware und Helion KI-Server im Vergleich (Stand: 1. Oktober 2026)
FrageEigenbau mit Ollama und Open WebUIKI-Hardware, z. B. DGX Spark, Mac StudioHelion KI-Server
Hardwareselbst auswählen und zusammenbauenfertiges Gerät vom Herstellerfertiges Gerät, im Werk geprüft
SoftwareOllama, Open WebUI und Modelle selbst installierenselbst installierenvorinstalliert: KI-Chat, Unternehmensgedächtnis, Wissensspeicher, Skills, Erinnerungen, Diktat und Vorlesen
StartTage bis Wochen, je nach ErfahrungTage bis Wochen, je nach Erfahrungmit Schritt-für-Schritt-Anleitung in 10 Minuten startklar
Nutzer und Rechtein Open WebUI selbst einrichtenselbst einrichtenim Browser, 2-Faktor-Login je Nutzer
Eigene Dokumenteselbst anbinden und testenselbst anbinden und testenWissensspeicher „My World“, jede Antwort mit Quelle
Zugang und Netzwerkselbst absichernselbst absichernkein WLAN, kein Bluetooth, nur über Ihr Netzwerk erreichbar
Updates und BetreuungIhr AdminIhr Adminsignierte Updates per USB-Stick, Betreuung im individuellen Plan
KostenHardware plus Arbeitszeitab 4.800 € plus Arbeitszeit6.490 € netto, 8.990 € netto oder 14.990 € netto, keine Gebühr je Nutzer
Passt zuUnternehmen mit erfahrener IT im HausEntwicklern und EinzelplätzenTeams bis 100 Personen ohne eigenen KI-Admin

Zeitangaben für den Eigenbau sind Erfahrungswerte, kein fester Wert. Einrichtung des Helion KI-Servers per Videocall 350 € netto, vor Ort 1.200 € netto zuzüglich Anfahrt, in Eigenregie inklusive. Versand innerhalb Deutschlands kostenlos, Lieferung in 14 Werktagen.

Anwendungen

Was kann lokale KI heute schon?

Lokale KI übernimmt heute schon mühsame Arbeit mit sensiblen Daten: Protokolle schreiben, Lastenhefte gegen Normen prüfen, E-Mails und Angebote vorformulieren. Drei Beispiele zeigen, wie das mit dem Helion KI-Server aussieht. Die ersten beiden gehen mit dem Standardgerät. Das dritte braucht die Anbindung an Ihr Postfach und ist Teil der Enterprise-Version.

Team im Gespräch in einem hellen Büro
Was im Meeting besprochen wird, bleibt mit lokaler KI im eigenen Haus.

Standardausführung

Meeting und Protokoll

Gesellschafterversammlung, Teammeeting: Da wird viel gesagt, das nachbereitet werden muss, und niemand hat mehr Lust, Protokolle zu schreiben. Max spricht seine Notizen direkt nach dem Termin ein, der Helion KI-Server schreibt mit und macht daraus ein Protokoll. Es kann um die sensibelsten Themen gegangen sein, um neue Produktlinien oder die nächsten Schritte im Wettbewerb. Alles bleibt im eigenen Haus.

Standardausführung

Normprüfung eines Kundenlastenhefts

Ein Kundenlastenheft kommt rein, und Max fragt sich: Erfüllt unsere Baureihe X die Anforderungen? Das händisch zu prüfen, ist eine Heidenarbeit. Max gibt das Lastenheft hinein, der Helion KI-Server prüft es gegen die hinterlegten Normen und Datenblätter, nennt die Stellen, die mit dem Kunden zu klären sind, und schreibt auf Wunsch gleich die E-Mail dazu. Max prüft und spart sich Stunden.

Enterprise-Version

Angebot aus dem Postfach

Kurz vor Feierabend kommt eine Anfrage, die heute noch raus muss. In der Enterprise-Version ist der Helion KI-Server an die Infrastruktur des Unternehmens angebunden, zum Beispiel an das Microsoft-Postfach. Der Helion KI-Server liest die Anfrage, erstellt aus dem Firmenwissen ein Angebot im Corporate Design und legt die Antwortmail als Entwurf ins Postfach. Max liest gegen und drückt auf Senden.

Standardausführung des Helion KI-Servers: KI-Chat, Unternehmensgedächtnis, Wissensspeicher, Skills, Erinnerungen, Diktat und Vorlesen, ohne Schnittstelle zu anderen Programmen. Enterprise-Version: individuelle Anbindung an Ihre Systeme, Umfang und Preis auf Anfrage.

Mythen

Stimmen die Mythen über lokale KI?

Die gängigen Mythen über lokale KI sind Herausforderungen, aber kein Grund, auf sie zu verzichten. Tempo und Leistung hängen von der Hardware ab, die Kosten fallen einmal statt jeden Monat an, und eigene Dokumente kann lokale KI sehr wohl lesen. Ohne Internet beruhen die Antworten auf Ihrem Firmenwissen. Die Antworten auf alle sechs Mythen stehen unten in den Fragen.

  1. Lokale KI ist zu langsam.
  2. Lokale KI ist zu teuer.
  3. Lokale KI ist nicht performant.
  4. Lokale KI kann keine Daten lesen und ausgeben.
  5. Wie soll sie so gut sein, wenn sie nicht im Internet ist?
  6. Das ist nur was für Terminal-Nerds.

„Ich bin auch kein Terminal-Nerd.“

Giannina Pfefferkorn, Mitgründerin der Mindspace Solutions GmbH, beim Launch des Helion KI-Servers
Plug-and-Play

Wie nutzen Sie lokale KI ohne eigenen Admin?

Ohne eigenen Admin brauchen Sie einen KI-Server, der fertig eingerichtet ankommt: bestellen, anschließen, Laptop aufklappen und loslegen. Der Helion KI-Server ist genau so gebaut. Es gibt ihn in drei Größen für 20, 50 und 100 Mitarbeitende, vorinstalliert und im Werk geprüft. Bedient wird er im Browser.

Giannina Pfefferkorn vergleicht das gern mit ihrem MacBook: Sie will nicht wissen, welche Hardware verbaut ist oder wie die Software funktioniert. Sie will es bestellen, aufklappen und nutzen können. Und wenn der Kaffee drüberläuft, gibt es einen Support. Genau das braucht es auch für lokale KI: bezahlbar, im Alltag einfach zu nutzen und einfach zu starten.

Helion Pro KI-Server mit Echtholzfront auf einem Sideboard im Büro
Der Helion Pro im Büro: anschließen, einschalten, im Browser loslegen.
Helion KI-Server, Preise netto zzgl. MwSt. (Stand: 1. Oktober 2026)
ModellMitarbeitendeGleichzeitig aktivKI-KartenWissenPreis
Helion Probis 20 Mitarbeitendeca. 5 Personen1 KI-Karte mit 32 GB KI-Speicherbis 1 Mio. Seiten6.490 € netto
Helion Maxbis 50 Mitarbeitendeca. 10 bis 12 Personen2 KI-Karten, zusammen 48 GB KI-Speicherbis 2,5 Mio. Seiten8.990 € netto
Helion Ultrabis 100 Mitarbeitendeca. 20 Personen2 KI-Karten, zusammen 64 GB KI-Speicherbis 5 Mio. Seiten14.990 € netto

Die Modelle unterscheiden sich in KI-Speicher und Datenspeicher, denn unterschiedlich starke Hardware verarbeitet unterschiedlich viele Anfragen. Was der Betrieb über drei und fünf Jahre kostet, rechnen wir im Ratgeber KI-Server-Kosten vor.

Selbst bauen oder fertig kaufen: Was passt zu Ihnen?

Sagen Sie uns, wie viele Personen mit der KI arbeiten sollen und wer bei Ihnen die IT betreut. Im kostenlosen Erstgespräch klären wir ehrlich, ob sich der Eigenbau für Sie lohnt oder ein Helion KI-Server der bessere Weg ist.

„Wenn Wissen unser wichtigstes Kapital ist, warum geben wir die Infrastruktur, die es verarbeitet, aus der Hand? Sie gehört in unsere eigenen Hände.“

Häufig gestellte
Fragen

Antworten zu den Mythen über lokale KI und zum Eigenbau. Ihre Frage ist nicht dabei? Schreiben Sie uns.

Nein, wenn die Hardware zur Nutzerzahl passt. Wie schnell eine lokale KI antwortet, hängt vor allem von der Grafikkarte und der Größe des Modells ab. Beim Helion KI-Server kommen Antworten in wenigen Sekunden. Der Helion Pro ist für ca. 5 Personen gleichzeitig ausgelegt, der Helion Max für ca. 10 bis 12 Personen und der Helion Ultra für ca. 20 Personen.

Ein eigener KI-Server kostet einmalig, ein Cloud-Abo jeden Monat pro Kopf. Der Helion Pro kostet 6.490 € netto, ohne Gebühr je Nutzer. Gegenüber einem Abo zu 25 € je Nutzer und Monat ist er inklusive geschätztem Strom über fünf Jahre ab 6 Nutzern günstiger, über drei Jahre ab 9. Die ganze Rechnung steht im Ratgeber KI-Server-Kosten.

Bei sehr komplexen Aufgaben sind die stärksten Cloud-Modelle weiterhin vorn. Für den Arbeitsalltag reichen offene Modelle gut aus: E-Mails und Angebote entwerfen, lange Texte zusammenfassen, Fragen zu den eigenen Unterlagen beantworten. Je mehr KI-Speicher der Server hat, desto größere Modelle trägt er. Beim Helion KI-Server sind es 32, 48 oder 64 GB.

Ja. Im Wissensspeicher „My World“ des Helion KI-Servers lassen sich Verträge, Handbücher, Normen und Richtlinien einlesen und durchsuchen, bis 1 Mio. Seiten beim Pro, bis 2,5 Mio. Seiten beim Max und bis 5 Mio. Seiten beim Ultra. Zu jeder Antwort nennt die KI die Quelle. Beim Eigenbau übernimmt diese Aufgabe zum Beispiel die Dokumentenfunktion von Open WebUI, die Ihr Admin einrichtet.

Das Sprachwissen steckt im Modell selbst, dafür braucht es kein Internet. Dazu kommt Ihr Firmenwissen aus den eigenen Dokumenten. Weil die Antworten auf geprüften Unterlagen beruhen und die Quelle genannt wird, lassen sie sich leichter nachprüfen als Ergebnisse einer Websuche. Fehler schließt keine KI ganz aus, deshalb bleibt das Gegenlesen wichtig. Aktuelle Nachrichten kennt eine lokale KI nicht.

Beim Eigenbau oft ja: Ollama, Open WebUI und die Modelle werden über Kommandozeile oder Docker eingerichtet und betrieben. Der Helion KI-Server kommt vorinstalliert, wird im Browser bedient und ist mit Schritt-für-Schritt-Anleitung in 10 Minuten startklar. Für die Nutzung braucht niemand Programmierkenntnisse.

Üblich sind drei Bausteine: ein Motor, der die Modelle ausführt, zum Beispiel Ollama, eine Chat-Oberfläche wie Open WebUI und ein offenes Sprachmodell wie Qwen, Gemma oder gpt-oss. Ollama steht unter der freien MIT-Lizenz. Open WebUI verlangt seit Version 0.6.6 ab mehr als 50 Nutzern, dass Name und Logo sichtbar bleiben, sonst ist eine Enterprise-Lizenz nötig. LM Studio ist eher ein Programm für den einzelnen Rechner.

Ja, meist zusammen mit Open WebUI, das Nutzerkonten und Rollen verwaltet. Ollama selbst hat an seiner Schnittstelle keine Anmeldung und ist ab Werk nur auf dem eigenen Rechner erreichbar. Wer es im Netzwerk freigibt, muss den Zugang selbst absichern. Wie viele Anfragen gleichzeitig laufen, stellt der Admin ein, und jede parallele Anfrage braucht zusätzlichen Grafikspeicher.

Entscheidend ist der Grafikspeicher, denn darin muss das Modell vollständig Platz finden. Die Modelldateien sind Dutzende bis einige Hundert Gigabyte groß. Für ein Team braucht es zusätzlich Reserve für gleichzeitige Anfragen und schnellen Speicher für die Dokumente. Der Helion KI-Server hat dafür eine oder zwei KI-Karten mit zusammen 32 bis 64 GB KI-Speicher und 1 bis 4 TB NVMe-Speicher.

Für Entwickler und Einzelplätze ja. Die DGX Spark kostet laut ComputerBase seit Februar 2026 in der Founders Edition 4.800 €, ein Mac Studio mit M5 Ultra ab 8.029 €. Beide bringen viel Speicher für KI-Modelle mit, aber keine fertige Lösung fürs Team: Oberfläche, Nutzer, Rechte, Dokumente und Sicherung richten Sie selbst ein.

Der Helion KI-Server in der Standardausführung hat zum Start keine Schnittstelle zu anderen Programmen, eine Schnittstelle ist geplant. Er arbeitet mit dem, was Sie im Browser eingeben und in den Wissensspeicher hochladen. Die Anbindung an Ihre Infrastruktur, etwa an ein Microsoft-Postfach, ist Teil der Enterprise-Version des Helion KI-Servers, die wir individuell mit Ihnen aufbauen.

Porträt einer Frau mit offener, fragender Geste.