Souveräne KI
Europas Antwort auf KI-Souveränität
In einer Ära, in der Unternehmen monatlich Tausende von Euro an Big-Tech-KI-Anbieter verlieren — und gleichzeitig die Modelle dieser Anbieter mit ihren eigenen proprietären Daten und ihrem geistigen Eigentum trainieren —, bietet ein Wiener Startup eine radikale Alternative. Xinity baut Europas souveräne KI-Infrastruktursoftware auf, die es Unternehmen ermöglicht, generative KI On-Premise zu betreiben, ohne auf Hyperscaler angewiesen zu sein oder sensible Daten über ihre Grenzen hinweg zu exportieren.
Das Problem: Die versteckten Kosten von Cloud-KI
Jeder API-Aufruf an einen externen KI-Anbieter ist nicht nur eine Ausgabe — es ist ein Datenexport. Ihre Prompts, Antworten und Ihre Geschäftslogik fließen an Server außerhalb Ihrer Kontrolle und trainieren Modelle, die Sie nicht besitzen, zu Bedingungen, die sich mit einer E-Mail zur Preisaktualisierung ändern können. Für europäische Unternehmen, die mit der DSGVO-Konformität, Anforderungen an die Datensouveränität oder einfach unvorhersehbaren tokenbasierten Kosten konfrontiert sind, wird dieses Modell untragbar.
Die Zahlen sprechen für sich: Die LLM-Kosten explodieren. Was mit ein paar hundert Euro beim Experimentieren beginnt, skaliert schnell auf Zehntausende monatlich, sobald KI-Integrationen in die Produktion gehen. Die Token-Preise sind volatil, intransparent und binden Ihre Infrastrukturkosten direkt an die Preisstrategien externer Anbieter.
Die Xinity-Lösung: Souveräne KI-Infrastruktursoftware
Die Plattform von Xinity ist im Konzept denkbar einfach, in der Ausführung jedoch extrem leistungsstark. Es handelt sich um eine europäische souveräne KI-Infrastruktursoftwareschicht, die es Unternehmen ermöglicht, von öffentlichen KI-APIs auf vollständig kontrollierte, lokale KI-Workloads umzusteigen — in der Regel in Tagen statt in Monaten. Xinity Runtime wird direkt auf Ihren bestehenden Servern installiert. Keine neue Hardware erforderlich. Keine Cloud-Abhängigkeit. Keine Daten, die Ihre Umgebung verlassen.
Das ist es, was den Unterschied ausmacht:
Drop-In-Migration Xinity bietet eine OpenAI-kompatible API, die mit standardmäßigen KI-Integrationsmustern funktioniert. Die Migration von Cloud-KI auf souveräne KI erfordert die Änderung von genau zwei Dingen in Ihrer Codebasis: der Basis-URL und Ihrem API-Schlüssel. Ihre bestehenden SDKs, Anfrageformate, Streaming-Implementierungen, der JSON-Modus und Funktionsaufrufe funktionieren unverändert. Viele Teams beginnen mit A/B-Routing — sie senden 5–10 % des Datenverkehrs an Xinity, um Qualität und Kosten zu validieren, bevor sie hochskalieren.
Echte On-Premise-Bereitstellung Im Gegensatz zu Managed-Cloud-Services führt Xinity Runtime KI-Modelle auf Ihrer eigenen Hardware in Ihrem eigenen Gebäude aus. Die KI kommt zu Ihren Daten — nicht umgekehrt. Das ist nicht nur gut für die Compliance; es verändert Ihre Kostenstruktur grundlegend von unvorhersehbaren Preisen pro Token hin zu infrastrukturbasierten Kosten, die Sie prognostizieren und budgetieren können.
Orchestrierung auf Produktionsniveau Xinity paketiert nicht nur Open-Source-Modelle. Die Plattform bietet intelligentes Modell-Routing über GPUs hinweg, automatischen Lastenausgleich, hochentwickelte Observability und Kostenverfolgung pro Anfrage. Sie bewältigt die betriebliche Komplexität, die On-Premise-KI so anspruchsvoll macht: GPU-bewusstes Scheduling, Fehlertoleranz, Monitoring und Audit-Logs.
Datensouveränität durch Design Jede Designentscheidung priorisiert die Beibehaltung der Kontrolle über Ihre Daten. Xinity ermöglicht DSGVO-konforme Bereitstellungen mit vollständiger Auditierbarkeit, mTLS-Sicherheit, rollenbasierter Zugriffskontrolle und der Möglichkeit, den Datensitz in bestimmten Jurisdiktionen zu belassen. Für regulierte Branchen — Finanzen, Gesundheitswesen, Recht, Regierung, Verteidigung und industrielle Fertigung — ist dies nicht nur nett zu haben, sondern oft zwingend erforderlich. Die vollständige Einhaltung der DSGVO und des EU-KI-Gesetzes ist in die Architektur integriert und nicht nachträglich als Richtlinie aufgesetzt.
Der dreistufige Migrationsprozess
Xinity hat die Migration auf drei klare Phasen verfeinert:
1. Bewertung Eine kurze Bewertung des Setups erfasst Ihre Ziele: Kostenoptimierung, Latenzziele, Anforderungen an die Datenkontrolle oder Compliance-Anforderungen. Xinity dimensioniert die Softwarebereitstellung basierend auf Ihren Zielen für gleichzeitige Anfragen, Token-Volumina und gewünschten Modellfähigkeiten. Sie können vorhandene GPUs mitbringen oder sich von Xinity bei der Beschaffung und Spezifikation der richtigen Hardware unterstützen lassen. Das Ergebnis ist ein konkreter Blueprint mit dem erwarteten Durchsatz, Latenzprofilen und dem Zeitplan für den Go-Live.
2. Runtime-Installation Xinity verwandelt Ihre bestehende Infrastruktur in sichere, hochperformante Inferenz-Nodes. Dies umfasst ein gehärtetes Basis-Image mit festen Treibern und GPU-Bibliotheken sowie die Xinity Runtime für Orchestrierung, Streaming, automatisches Fine-Tuning und Observability. Guardrails orientieren sich an Ihren Richtlinien — JSON-Modus, Funktionsaufrufe, Protokollierungskontrollen. Für Air-Gapped-Umgebungen richtet Xinity private Registry-Spiegelungen, SSO, projektbezogene API-Schlüssel und Audit-Logs ein.
3. Plug and Play Die Umstellung ist bewusst unspektakulär. Sie tauschen die Basis-URL und den API-Schlüssel aus — das ist alles. Ihre Anwendungslogik bleibt unberührt. Teams stellen Open-Source-Modelle lokal bereit, die ihrer gewählten Leistungsklasse entsprechen, mit der Möglichkeit, Modelle pro Route im laufenden Betrieb auszutauschen, um Latenz oder Kosten zu optimieren, ohne den Anwendungscode zu ändern.
Praxisnahe Auswirkungen
Xinity hat bereits Kunden, die ihre eigene KI-Infrastruktur betreiben. Wie der Leiter der KI-Abteilung eines führenden österreichischen Medienunternehmens es beschreibt: „Datensouveränität ist nicht nur eine Strategie, sie ist ein Mandat. Xinity hat es uns ermöglicht, unsere bestehenden Serverräume in eine moderne KI-Plattform zu verwandeln, komplett mit spezialisierten LLMs und nahtloser Integration in unseren Software-Stack.“
Die wirtschaftlichen Aspekte sind überzeugend. Xinity-Kunden berichten von:
60–80 % geringeren KI-Kosten durch den Besitz der Infrastruktur anstelle von Preisen pro Token
Einem durchschnittlichen ROI von 4 Monaten mit vorhersehbaren, infrastrukturbasierten Kosten
Sofortigen Compliance-Gewinnen für die Anforderungen der DSGVO und des EU-KI-Gesetzes
Verbesserter Performance mit kontrollierbarer Latenz und steuerbarem Durchsatz
Die Technologie: Mehr als nur Modell-Hosting
Was Xinity auszeichnet, ist nicht nur das Ausführen von Open-Source-Modellen auf lokaler Hardware — es ist die produktionsreife Softwareschicht, die den souveränen KI-Betrieb erst betrieblich tragfähig macht:
Nahtlose Systemintegration mit vereinheitlichten Datenverbindungen und Echtzeitsynchronisierung
Zentrale KI-Steuerungsebene zur Verwaltung von Workloads über Teams hinweg mit zentralisiertem Routing, Richtlinien und Observability
Enterprise-Grade-Funktionen einschließlich der Unterstützung für Open-Source- und benutzerdefinierte Modelle, feingetunte domänenspezifische Modelle und GPU-bewusstes Scheduling
Kosten- und Nutzungstransparenz mit vollständiger Protokollierung, Überwachung und vorhersehbaren Kosten
Compliance-Dashboard für die Berichterstattung zum EU-KI-Gesetz, integriert in die SME- und Enterprise-Tarife
Die Vision: Ein ressourcenunabhängiges Europa
Hinter Xinity stehen die Gründer Jonas Vander und Alexander Zehetmaier, die jeweils ein Jahrzehnt an KI-Expertise mit komplementären Fähigkeiten einbringen. Sie haben über 10 Millionen Euro an EU-KI-Startup-Förderungen organisiert und werden von erfahrenen Business Angels mit nachgewiesener Erfolgsbilanz bei KI-Investitionen unterstützt.
Das Team hat seine technische Kompetenz durch die Entwicklung von CircuitVision unter Beweis gestellt, einem weltweit führenden Sprachmodell für die Analyse elektronischer Schaltungen — ein Beweis dafür, dass spezialisierte, domänenspezifische KI in bestimmten Nischen mit Allzweckmodellen mithalten oder diese sogar übertreffen kann.
Ihre Mission geht über den Erfolg des einzelnen Kunden hinaus. Wie sie es beschreiben: „Wenn die Migration so einfach ist, kann sie jeder schaffen — und wir bei Xinity sind unserem Ziel einen Schritt näher: ein von Rechenressourcen unabhängiges Europa.“
Flexible Preisgestaltung für jede Phase
Xinity bietet drei Tarife an, alle als Software-Abonnements, die auf Ihrer bestehenden Infrastruktur installiert werden. Die Kapazität wird nach GPU-Speicher und nicht nach der Anzahl der Instanzen lizenziert, und die Preise setzen voraus, dass die GPUs bereits in Ihrem Besitz sind.
Community (Kostenlos): Für Entwickler, die souveräne KI evaluieren und Proof-of-Concepts erstellen. Beinhaltet Xinity Runtime, die OpenAI-kompatible API, 120 GB VRAM, unbegrenzte API-Schlüssel, unbegrenzte Dashboard-Benutzer, eine Organisation, grundlegendes Modellmanagement und Community-Support. Nur für die nicht-kommerzielle Nutzung.
SME (€ 999,-/Monat bei jährlicher Abrechnung oder € 1.199,- monatlich): Für Produktions-Workloads mit Governance-Anforderungen über mehrere Teams hinweg. Erweitert den Leistungsumfang um die Lizenz für die kommerzielle Nutzung, 800 GB VRAM, SSO/LDAP-Integration, rollenbasierte Zugriffskontrolle, Audit-Protokollierung und Priority-Support mit einer 24-Stunden-SLA.
Enterprise (individuelle Preisgestaltung): Für eine unternehmensweite souveräne KI-Infrastruktur mit tiefgehender Integrationsunterstützung. Erweitert den Leistungsumfang um unbegrenzten VRAM, einen jährlichen KI-Architekten vor Ort, dedizierten Slack/Teams-Support, eine maßgeschneiderte SLA, Bereitstellung an mehreren Standorten und einen festen Account Manager.
Das große Ganze
Die Anforderungen des EU-KI-Gesetzes für Hochrisikosysteme treten am 2. August 2026 vollumfänglich in Kraft. Für Unternehmen in den Bereichen Finanzen, Gesundheitswesen, Recht und im öffentlichen Sektor schließt sich das Zeitfenster, um eine konforme KI-Infrastruktur einzurichten. Xinity ist die einzige in Europa entwickelte, in Wien ansässige souveräne KI-Softwareplattform, die Compliance zu einer technischen Garantie macht — und nicht zu einem vertraglichen Versprechen.
Hierbei geht es nicht nur um Kosteneinsparungen oder die Einhaltung gesetzlicher Vorschriften, obwohl beides von Bedeutung ist. Es geht um strategische Autonomie. In einer Welt, in der KI-Fähigkeiten zu einem grundlegenden Wettbewerbsvorteil werden, bedeutet der Besitz der eigenen KI-Infrastruktur, das eigene Schicksal selbst in der Hand zu haben.
Da immer mehr Unternehmen erkennen, dass ihre Daten und ihre Domänenexpertise wertvolle Vermögenswerte sind — und keine Handelswaren, die exportiert werden sollten —, wird eine souveräne KI-Infrastruktur nicht nur zu einer Option, sondern zu einem strategischen Imperativ. Xinity positioniert Europa so, dass es in diesem neuen Paradigma eine Führungsrolle übernehmen kann.
Xinity hat ihren Hauptsitz Am Gestade 5/2, 1010 Wien, Österreich. Weitere Informationen: xinity.ai
Aktualisiert am 9. September 2026: Die Preis- und Tarifinformationen in diesem Artikel wurden korrigiert, um die aktuellen Pläne widerzuspiegeln.
Dieser Artikel wurde mit KI-Unterstützung entworfen und vom Xinity-Team überprüft, auf Fakten kontrolliert und bearbeitet, welches die volle redaktionelle Verantwortung für den Inhalt übernimmt.