PrivatGPT Logo
PrivatGPTby my-scale

On-Premise KI · betreut aus Deutschland

On-Premise KI.
Ihr Server.
Ihre Daten.

PrivatGPT ist eine schlüsselfertige On-Premise KI für Unternehmen: leistungsfähige generative KI in Ihrer Infrastruktur, ohne dass sensible Inhalte an eine öffentliche KI-Cloud gesendet werden.

DSGVO-konform betreibbar100 % in Ihrer InfrastrukturFür EU AI Act & NIS2 vorbereitet
ki.ihre-firma.local ONLINE
Sichere Sitzung wird vorbereitet …
Modell: lokal betrieben0 Byte an eine öffentliche KI-Cloud

Abb. 01 · Private Chat-Oberfläche im Firmennetz

Was ist eine On-Premise KI?

Eine On-Premise KI ist ein generatives KI-System, das vollständig auf Servern im eigenen Unternehmen läuft. Prompts, Dokumente, Nutzerkonten und Antworten werden in der eigenen Infrastruktur verarbeitet. Dadurch behalten Unternehmen die Kontrolle über Datenstandort, Zugriffe, Modelle und Updates und können auch vertrauliche Anwendungsfälle gezielt freigeben.

  • Verarbeitung von Prompts und Dokumenten im eigenen Firmennetz
  • Kontrolle über Modelle, Benutzerrechte, Updates und Protokolle
  • Betrieb mit Active Directory oder Microsoft Entra ID
  • Optional vollständig abgeschottet ohne öffentliche KI-Cloud

01 / Das Problem

Warum On-Premise KI statt Public Cloud?

Konstruktionsdaten, Mandatsakten, Gesundheitsdaten oder Verträge sind genau die Informationen, bei denen KI hilft — und die nicht unkontrolliert an externe Dienste fließen dürfen.

35 Mio. EUR

maximale Bußgeldhöhe bei bestimmten Verstößen gegen den EU AI Act

Volle Kontrolle

über Speicherort, Modelle, Updates und Zugriffsregeln

Kein Schatten-IT-Zwang

weil es eine intern freigegebene Alternative gibt

Status quo: öffentliche KI-Cloud

  • Vertrauliche Daten werden an externe Cloud-Anbieter übertragen.
  • Nutzungsbedingungen und Speicherorte liegen nicht vollständig in Ihrer Hand.
  • Drittlandtransfers können zusätzliche Datenschutzprüfungen auslösen.
  • IT-Sicherheit oder Betriebsrat blockieren die Einführung.

PrivatGPT: KI im eigenen Haus

  • Prompts, Dokumente und Antworten bleiben in Ihrer Infrastruktur.
  • Sie kontrollieren Modelle, Updates, Rollen und Zugriffe.
  • Ein abgeschotteter Betrieb ohne öffentliche Cloud ist möglich.
  • Die KI kann nach Ihren internen Sicherheitsregeln freigegeben werden.
Abb. 02 · Ihr Team arbeitet wie gewohnt, nur souverän

02 / Die Lösung

Wie funktioniert PrivatGPT als On-Premise KI?

Wir planen Hardware, Plattform, Modelle, Sicherheit und Betrieb gemeinsam. So erhält Ihre IT ein betreibbares System und Ihre Belegschaft ein Werkzeug, das sie tatsächlich nutzen kann.

Abb. 03 · Der PrivatGPT-Server: kompakt, lokal, vor Ort
01

Vertraute Chat-Oberfläche

Anmelden, fragen, arbeiten: mit eigenen Chats, Verläufen und Vorlagen für jeden Mitarbeiter.

02

Persönliche Konten

Rollen und Rechte legen fest, wer welche Modelle, Wissensquellen und Funktionen nutzen darf.

03

Login mit Firmenzugang

Anbindung an Active Directory oder Microsoft Entra ID mit dem bestehenden Firmen-Login.

04

KI mit Firmenwissen

Optional verbinden wir Dokumente, SharePoint, Intranet oder Netzlaufwerke samt Rechteprüfung.

05

Aktuelle Modelle

Neue Modellgenerationen werden geprüft und nach Ihrer Freigabe kontrolliert eingespielt.

06

Managed Betrieb

Monitoring, Sicherheitsupdates, Modellwechsel und Support halten das System verlässlich aktuell.

03 / Die Technik

Welche Technik braucht eine lokale Firmen-KI?

Die Modellschicht bleibt flexibel. Wenn eine neue Generation Ihre Tests besteht und zur Hardware passt, kann sie kontrolliert ergänzt oder ersetzt werden.

04

Sicherheit & Betrieb

SSO, Rollen, Audit-Logs, verschlüsselte Backups und laufendes Monitoring.

03

Firmenwissen

Berechtigungssensible Anbindung Ihrer Dokumente und Wissensquellen.

02

Chat-Plattform

Private Konten, Chatverläufe, Prompt-Bibliothek und Admin-Bereich.

01

KI-Server & Modelle

GPU-Server, lokaler Inference-Stack und austauschbare Open-Source-Modelle.

Abb. 04 · GPU-Technik für leistungsfähige lokale Inferenz
Mögliche ModellkonfigurationenStand 07/2026
ModellAnbieterLizenzEinordnung
GPT-oss-120BOpenAIApache 2.0Allrounder für Text und Analyse
Qwen 3.5AlibabaApache 2.0Mehrsprachige Büroaufgaben
DeepSeek V4 FlashDeepSeekMITSchnelle, wirtschaftliche Anfragen
Kimi K2.5Moonshot AIMITAnspruchsvolle Wissensarbeit
GLM-5Z.aiMITAnalyse- und Entwicklungsaufgaben

Finale Modellauswahl nach Lizenz-, Qualitäts- und Sicherheitsprüfung

04 / Kosten & Konfigurationen

Was kostet On-Premise KI für Unternehmen?

Jede Stufe umfasst Hardware, Software, Einrichtung und Schulung. Die genaue Konfiguration entsteht nach der technischen Analyse.

SPEC S

Starter

20 bis 100 Mitarbeiter

bis ca. 30 gleichzeitige Nutzer

  • Kompakter Server oder leiser Tower
  • 1× NVIDIA RTX PRO 6000 (96 GB)
  • Geeignet für GPT-oss-120B
  • Chat-Oberfläche mit SSO
  • Einrichtung, Schulung und Dokumentation

ab 35.000 EUR

Managed Service ab 990 EUR / Monat

Starter anfragen
SPEC MMeistgewählt

Professional

100 bis 500 Mitarbeiter

ca. 30 bis 150 gleichzeitige Nutzer

  • Server-System für den Serverraum
  • 4× NVIDIA RTX PRO 6000 (384 GB)
  • Mehrere leistungsstarke Modelle
  • Zweitmodell für schnelle Anfragen
  • Firmenwissen-Anbindung optional
  • Branding, Schulung und Dokumentation

ab 100.000 EUR

Managed Service ab 2.500 EUR / Monat

Professional anfragen
SPEC L

Enterprise

500+ Mitarbeiter, Klinik oder Konzern

150+ gleichzeitige Nutzer

  • Rack-System inklusive Infrastruktur
  • Bis zu 8× NVIDIA H200 mit NVLink
  • Große Frontier-Open-Source-Modelle
  • Hochverfügbarkeit und Air-Gap-Option
  • Individuelle Integrationen und Workflows
  • Dedizierter Ansprechpartner

ab 500.000 EUR

Managed Service ab 8.000 EUR / Monat

Enterprise anfragen

Alle Preise netto und abhängig von Ausstattung, Verfügbarkeit sowie Integrationstiefe. Verbindlich ist ausschließlich das individuelle Angebot nach technischer Prüfung.

05 / Der Ablauf

Wie kommt On-Premise KI ins Unternehmen?

Vom ersten Gespräch bis zum produktiven System vergehen typischerweise vier bis acht Wochen — abhängig von Ausstattung und Integrationen.

Schritt 01

Erstgespräch & Analyse

Wir klären Anwendungsfälle, Nutzerzahlen, IT-Umgebung und Schutzbedarf.

ca. 1 Woche

Schritt 02

Konfiguration & Angebot

Sie erhalten eine konkrete Empfehlung mit Hardware, Modellen, Integrationen und Festpreis.

1 bis 2 Wochen

Schritt 03

Installation vor Ort

Wir liefern, integrieren, konfigurieren und schulen Ihr Team direkt in Ihrer Umgebung.

2 bis 4 Wochen

Schritt 04

Betrieb & Weiterentwicklung

Monitoring, Updates und neue Modellgenerationen laufen im vereinbarten Managed Service.

laufend

06 / Für wen

Für welche Branchen eignet sich On-Premise KI?

Maschinenbau & Industrie

Konstruktionsdaten und Fertigungswissen bleiben im Haus.

Kanzleien & Steuerberatung

Vertrauliche Mandatsinformationen bleiben unter Ihrer Kontrolle.

Gesundheitswesen

Sensible Gesundheitsdaten verlassen nicht Ihre Infrastruktur.

Banken & Versicherungen

Technische Kontrolle unterstützt regulatorische Anforderungen.

Öffentliche Hand

Digitale Souveränität ohne Abhängigkeit von einer US-Cloud.

KRITIS & Hochsicherheit

Abgeschotteter Air-Gap-Betrieb ist als Option planbar.

07 / Häufige Fragen

Was Unternehmen über On-Premise KI wissen wollen.

Ihre Frage ist nicht dabei? Wir beantworten sie im Erstgespräch gern gemeinsam mit Ihrer IT-Abteilung.

08 / Kontakt

On-Premise KI im Unternehmen live erleben.

Im kostenfreien Erstgespräch zeigen wir das System an realistischen Aufgaben, klären Ihre Anforderungen und skizzieren die passende Ausbaustufe.

30 Minuten Erstgespräch

Live-Demo inklusive, ohne Verpflichtung

info@my-scale.de

Antwort in der Regel innerhalb eines Werktags

Gemeinsam mit Ihrer IT

Vor Ort oder per Videocall, deutschlandweit

Kostenfreie Erstberatung

Anforderungen kurz einordnen lassen

Wir melden uns in der Regel innerhalb eines Werktags.

Mit dem Absenden stimmen Sie der Verarbeitung zur Bearbeitung Ihrer Anfrage zu. Details in der Datenschutzerklärung.