Privates LLM für sensible Dokumente
Verträge, Personaldokumente oder Konstruktionsdaten werden mit einer privaten Modellinstanz verarbeitet — ohne dass Inhalte an externe Modellanbieter gehen.
Eine private KI-Umgebung aufzubauen ist das eine — sie sicher, aktuell und wirtschaftlich zu betreiben das andere. Die Managed AI Runtime ist unser Betriebsangebot: eine containerisierte, private KI-Umgebung mit Ihren Modellen und Ihren Daten, von uns betrieben — zu einer planbaren monatlichen Pauschale zzgl. transparent durchgereichter Compute-Kosten.
Der Leistungsumfang gliedert sich in vier Bereiche. Betrieb: containerisierte Runtime, private Model-Endpoints auf modernen Inference-Servern (z. B. vLLM), Updates, Patches und Backups. Sicherheit: Single Sign-on über Entra ID/OIDC, rollenbasierte Berechtigungen, Secrets-Management und private Netzwerke. Compliance: AVV, technische und organisatorische Maßnahmen, Subprozessorliste, Logging- und Löschkonzept sowie ein Dokumentationspaket, das Sie bei den Pflichten aus DSGVO und AI Act unterstützt. Kostenkontrolle: laufendes Monitoring von Token- und GPU-Verbrauch mit monatlichem Reporting.
Beim Thema Compute gehen wir einen ungewöhnlichen Weg: GPU- und Infrastrukturkosten reichen wir transparent zu Selbstkosten an Sie durch. Wir verdienen am Betrieb — nicht daran, Ihnen Rechenzeit teurer weiterzuverkaufen. Das macht Ihre Kosten planbar und unsere Empfehlungen unabhängig: Wenn ein günstigerer Provider für Ihren Workload besser passt, wechseln wir ihn.
Auch beim Betrieb gilt unser Portabilitätsversprechen: Ihre KI kann uns verlassen. Deployments sind containerisiert, Konfiguration und Datenpfade sind dokumentiert, die Exit-Dokumentation gehört zum Leistungsumfang. Auf Wunsch testen wir einmal jährlich im AI Exit Drill, ob sich Ihr Stack tatsächlich auf alternativer Infrastruktur wiederherstellen lässt — digitale Souveränität wird bei uns nicht behauptet, sondern getestet. Unsere Support-Zusagen sind ehrlich kalkuliert: Wir vereinbaren Reaktionszeiten, die wir organisatorisch halten können, statt Enterprise-Versprechen abzugeben, die auf dem Papier stehen bleiben.
Verträge, Personaldokumente oder Konstruktionsdaten werden mit einer privaten Modellinstanz verarbeitet — ohne dass Inhalte an externe Modellanbieter gehen.
RAG über technische Dokumentation, Wissensdatenbank und Ablagen: Mitarbeitende finden Antworten statt Dokumente — betrieben in Ihrer kontrollierten Umgebung.
Ihre Anwendungen nutzen private Inference-Endpoints für Klassifikation, Extraktion oder Textgenerierung — mit stabilen Kosten pro Monat statt überraschender API-Rechnungen.
Übernahme oder Aufbau der Umgebung nach Ziel-Architektur
Härtung und Anbindung: SSO, Netzwerk, Berechtigungen
Betriebsstart mit Monitoring, Backup und Runbooks
Regelbetrieb mit monatlichem Kosten- und Statusreport
Support- und Reaktionszeiten werden individuell vereinbart und so kalkuliert, dass sie organisatorisch verlässlich einzuhalten sind. Alle Preisangaben sind Nettopreise; verbindlich ist das individuelle Angebot.
Noch offene Punkte? Wir klären sie gern im Erstgespräch.
Die strukturierte Bestandsaufnahme: Wo steht Ihre KI heute, was kostet sie wirklich — und welches Betriebsmodell passt zu Ihrem Unternehmen?
In 5–10 Arbeitstagen vom unscharfen KI-Vorhaben zur belastbaren Ziel-Architektur — mit dem AI Infrastructure Passport als greifbarem Ergebnis.
Stellen Sie Ihrem ERP endlich Fragen: private KI über Business Central, Dokumenten und Wissensdatenbank — Ihre Daten bleiben unter Ihrer Kontrolle.
Kostenloses Erstgespräch, 30–45 Minuten, remote. Eine ehrliche Einschätzung — auch wenn die Antwort lautet, dass Sie das eigentlich gar nicht brauchen.