On-Premise KI · betreut aus Deutschland
On-Premise KI.
Ihr Server.
Ihre Daten.
PrivatGPT ist eine schlüsselfertige On-Premise KI für Unternehmen: leistungsfähige generative KI in Ihrer Infrastruktur, ohne dass sensible Inhalte an eine öffentliche KI-Cloud gesendet werden.
Abb. 01 · Private Chat-Oberfläche im Firmennetz
Was ist eine On-Premise KI?
Eine On-Premise KI ist ein generatives KI-System, das vollständig auf Servern im eigenen Unternehmen läuft. Prompts, Dokumente, Nutzerkonten und Antworten werden in der eigenen Infrastruktur verarbeitet. Dadurch behalten Unternehmen die Kontrolle über Datenstandort, Zugriffe, Modelle und Updates und können auch vertrauliche Anwendungsfälle gezielt freigeben.
- Verarbeitung von Prompts und Dokumenten im eigenen Firmennetz
- Kontrolle über Modelle, Benutzerrechte, Updates und Protokolle
- Betrieb mit Active Directory oder Microsoft Entra ID
- Optional vollständig abgeschottet ohne öffentliche KI-Cloud
01 / Das Problem
Warum On-Premise KI statt Public Cloud?
Konstruktionsdaten, Mandatsakten, Gesundheitsdaten oder Verträge sind genau die Informationen, bei denen KI hilft — und die nicht unkontrolliert an externe Dienste fließen dürfen.
35 Mio. EUR
maximale Bußgeldhöhe bei bestimmten Verstößen gegen den EU AI Act
Volle Kontrolle
über Speicherort, Modelle, Updates und Zugriffsregeln
Kein Schatten-IT-Zwang
weil es eine intern freigegebene Alternative gibt
Status quo: öffentliche KI-Cloud
- Vertrauliche Daten werden an externe Cloud-Anbieter übertragen.
- Nutzungsbedingungen und Speicherorte liegen nicht vollständig in Ihrer Hand.
- Drittlandtransfers können zusätzliche Datenschutzprüfungen auslösen.
- IT-Sicherheit oder Betriebsrat blockieren die Einführung.
PrivatGPT: KI im eigenen Haus
- Prompts, Dokumente und Antworten bleiben in Ihrer Infrastruktur.
- Sie kontrollieren Modelle, Updates, Rollen und Zugriffe.
- Ein abgeschotteter Betrieb ohne öffentliche Cloud ist möglich.
- Die KI kann nach Ihren internen Sicherheitsregeln freigegeben werden.
02 / Die Lösung
Wie funktioniert PrivatGPT als On-Premise KI?
Wir planen Hardware, Plattform, Modelle, Sicherheit und Betrieb gemeinsam. So erhält Ihre IT ein betreibbares System und Ihre Belegschaft ein Werkzeug, das sie tatsächlich nutzen kann.
Vertraute Chat-Oberfläche
Anmelden, fragen, arbeiten: mit eigenen Chats, Verläufen und Vorlagen für jeden Mitarbeiter.
Persönliche Konten
Rollen und Rechte legen fest, wer welche Modelle, Wissensquellen und Funktionen nutzen darf.
Login mit Firmenzugang
Anbindung an Active Directory oder Microsoft Entra ID mit dem bestehenden Firmen-Login.
KI mit Firmenwissen
Optional verbinden wir Dokumente, SharePoint, Intranet oder Netzlaufwerke samt Rechteprüfung.
Aktuelle Modelle
Neue Modellgenerationen werden geprüft und nach Ihrer Freigabe kontrolliert eingespielt.
Managed Betrieb
Monitoring, Sicherheitsupdates, Modellwechsel und Support halten das System verlässlich aktuell.
03 / Die Technik
Welche Technik braucht eine lokale Firmen-KI?
Die Modellschicht bleibt flexibel. Wenn eine neue Generation Ihre Tests besteht und zur Hardware passt, kann sie kontrolliert ergänzt oder ersetzt werden.
Sicherheit & Betrieb
SSO, Rollen, Audit-Logs, verschlüsselte Backups und laufendes Monitoring.
Firmenwissen
Berechtigungssensible Anbindung Ihrer Dokumente und Wissensquellen.
Chat-Plattform
Private Konten, Chatverläufe, Prompt-Bibliothek und Admin-Bereich.
KI-Server & Modelle
GPU-Server, lokaler Inference-Stack und austauschbare Open-Source-Modelle.
| Modell | Anbieter | Lizenz | Einordnung |
|---|---|---|---|
| GPT-oss-120B | OpenAI | Apache 2.0 | Allrounder für Text und Analyse |
| Qwen 3.5 | Alibaba | Apache 2.0 | Mehrsprachige Büroaufgaben |
| DeepSeek V4 Flash | DeepSeek | MIT | Schnelle, wirtschaftliche Anfragen |
| Kimi K2.5 | Moonshot AI | MIT | Anspruchsvolle Wissensarbeit |
| GLM-5 | Z.ai | MIT | Analyse- und Entwicklungsaufgaben |
Finale Modellauswahl nach Lizenz-, Qualitäts- und Sicherheitsprüfung
04 / Kosten & Konfigurationen
Was kostet On-Premise KI für Unternehmen?
Jede Stufe umfasst Hardware, Software, Einrichtung und Schulung. Die genaue Konfiguration entsteht nach der technischen Analyse.
Starter
20 bis 100 Mitarbeiter
bis ca. 30 gleichzeitige Nutzer
- Kompakter Server oder leiser Tower
- 1× NVIDIA RTX PRO 6000 (96 GB)
- Geeignet für GPT-oss-120B
- Chat-Oberfläche mit SSO
- Einrichtung, Schulung und Dokumentation
Professional
100 bis 500 Mitarbeiter
ca. 30 bis 150 gleichzeitige Nutzer
- Server-System für den Serverraum
- 4× NVIDIA RTX PRO 6000 (384 GB)
- Mehrere leistungsstarke Modelle
- Zweitmodell für schnelle Anfragen
- Firmenwissen-Anbindung optional
- Branding, Schulung und Dokumentation
Enterprise
500+ Mitarbeiter, Klinik oder Konzern
150+ gleichzeitige Nutzer
- Rack-System inklusive Infrastruktur
- Bis zu 8× NVIDIA H200 mit NVLink
- Große Frontier-Open-Source-Modelle
- Hochverfügbarkeit und Air-Gap-Option
- Individuelle Integrationen und Workflows
- Dedizierter Ansprechpartner
Alle Preise netto und abhängig von Ausstattung, Verfügbarkeit sowie Integrationstiefe. Verbindlich ist ausschließlich das individuelle Angebot nach technischer Prüfung.
05 / Der Ablauf
Wie kommt On-Premise KI ins Unternehmen?
Vom ersten Gespräch bis zum produktiven System vergehen typischerweise vier bis acht Wochen — abhängig von Ausstattung und Integrationen.
Erstgespräch & Analyse
Wir klären Anwendungsfälle, Nutzerzahlen, IT-Umgebung und Schutzbedarf.
ca. 1 Woche
Konfiguration & Angebot
Sie erhalten eine konkrete Empfehlung mit Hardware, Modellen, Integrationen und Festpreis.
1 bis 2 Wochen
Installation vor Ort
Wir liefern, integrieren, konfigurieren und schulen Ihr Team direkt in Ihrer Umgebung.
2 bis 4 Wochen
Betrieb & Weiterentwicklung
Monitoring, Updates und neue Modellgenerationen laufen im vereinbarten Managed Service.
laufend
06 / Für wen
Für welche Branchen eignet sich On-Premise KI?
Maschinenbau & Industrie
Konstruktionsdaten und Fertigungswissen bleiben im Haus.
Kanzleien & Steuerberatung
Vertrauliche Mandatsinformationen bleiben unter Ihrer Kontrolle.
Gesundheitswesen
Sensible Gesundheitsdaten verlassen nicht Ihre Infrastruktur.
Banken & Versicherungen
Technische Kontrolle unterstützt regulatorische Anforderungen.
Öffentliche Hand
Digitale Souveränität ohne Abhängigkeit von einer US-Cloud.
KRITIS & Hochsicherheit
Abgeschotteter Air-Gap-Betrieb ist als Option planbar.
Weiterführende Inhalte
Wie lässt sich On-Premise KI weiterdenken?
KI-Automatisierung für Geschäftsprozesse
Individuelle Workflows, Schnittstellen und KI-gestützte Abläufe für Ihr Tagesgeschäft.
Mehr erfahrenLeistungsübersichtDigitalisierung aus einer Hand
Software, Web, Marketing und Recruiting als abgestimmte Bausteine für den Mittelstand.
Mehr erfahrenPersönliche EinordnungOn-Premise KI unverbindlich besprechen
Anwendungsfälle, IT-Umgebung, Nutzerzahlen und Schutzbedarf gemeinsam einordnen.
Mehr erfahren07 / Häufige Fragen
Was Unternehmen über On-Premise KI wissen wollen.
Ihre Frage ist nicht dabei? Wir beantworten sie im Erstgespräch gern gemeinsam mit Ihrer IT-Abteilung.
08 / Kontakt
On-Premise KI im Unternehmen live erleben.
Im kostenfreien Erstgespräch zeigen wir das System an realistischen Aufgaben, klären Ihre Anforderungen und skizzieren die passende Ausbaustufe.
30 Minuten Erstgespräch
Live-Demo inklusive, ohne Verpflichtung
info@my-scale.de
Antwort in der Regel innerhalb eines Werktags
Gemeinsam mit Ihrer IT
Vor Ort oder per Videocall, deutschlandweit
