Souveräne KI für den Mittelstand · Modell aus Deutschland

Ihr Implementierungspartner für Soofi: souveräne KI in Ihrer eigenen Infrastruktur

Kurz gesagt

Soofi ist ein souveränes, offenes KI-Modell aus Deutschland, gebaut auf der Industrial AI Cloud der Telekom in München. Pexon Consulting ist Ihr unabhängiger Soofi-Implementierungspartner und bringt Soofi in Ihre eigene Umgebung, on-premise oder in der EU-Cloud, ohne dass Ihre Daten je einen US-Anbieter erreichen. Soofi ist noch in der Beta, Sie starten heute auf einem gleichwertigen offenen Modell wie Llama oder Qwen und schalten auf Soofi um, sobald die Gewichte verfügbar sind. Datenschutz ist laut Bitkom 2026 mit 77 Prozent die größte Hürde bei der Digitalisierung, genau hier setzt eine souveräne KI-Plattform an.

Open-Source-Modell aus Deutschland
On-Premise & EU-Cloud
Herstellerunabhängig
Microsoft Solutions Partner (Digital & App Innovation, Infrastructure Azure, Data & AI Azure), ISO/IEC 27001, Google Cloud Partner, AWS Partner

Warum Abhängigkeit von US-KI-Modellen teuer wird

53 Prozent der deutschen KI-Unternehmen setzen laut einer GreenPT-Analyse 2026 mindestens einen US-Frontier-Anbieter wie OpenAI oder Google ein. Jeder Prompt, jedes Dokument, jeder Kundendatensatz läuft damit über eine Infrastruktur, die dem US Cloud Act unterliegt.

Rechtsrisiko Cloud Act
US-Anbieter müssen Daten auf behördliche Anordnung herausgeben, auch wenn das Rechenzentrum in Frankfurt steht. OpenAI oder Azure mit einem Auftragsverarbeitungsvertrag weiterzunutzen löst das nicht, die US-Herausgabepflicht bleibt bestehen. Für personenbezogene Daten, Forschungsdaten und Berufsgeheimnisse ist das ein DSGVO-Problem.
Lock-in und Preissprünge
Wer auf einem proprietären Frontier-Modell aufbaut, hängt an dessen API-Preisen, Rate-Limits und Modellwechseln. 85 Prozent der deutschen Firmen halten Deutschlands Abhängigkeit von US-Cloud-Anbietern laut Bitkom bereits für zu hoch.
Daten trainieren fremde Modelle
Bei vielen SaaS-KI-Diensten bleibt unklar, ob Eingaben zu Trainingszwecken genutzt werden. Interne Dokumente, Quellcode und Vertragsdaten verlassen Ihre Kontrolle, ohne dass Sie es nachweisen können.

Was souveräne KI messbar bringt

Die Zahlen kommen teils aus dem Soofi-Konsortium, teils aus dem Markt. Sie zeigen, warum ein souveränes Modell jetzt zählt.

3 von 30 Mrd. Parametern aktiv
Soofi S ist ein Mixture-of-Experts-Modell: Nur rund 3 von 30 Milliarden Parametern sind pro Anfrage aktiv. Das senkt den GPU-Bedarf gegenüber dichten Modellen gleicher Größe. (Soofi-Konsortium 2026)
0 EUR Lizenzkosten
Als offenes Modell ist Soofi langfristig lizenzkostenfrei für die Industrie. Sie zahlen für Betrieb und Integration, nicht pro Token an einen US-Anbieter. (Soofi-Konsortium 2026)
100 % Datenhoheit
Soofi läuft vollständig in Ihrer Umgebung, on-premise oder in der EU-Cloud. Kein Prompt und kein Dokument erreicht einen externen Anbieter. (Architekturprinzip)
85 % halten US-Abhängigkeit für zu hoch
Die meisten deutschen Firmen halten Deutschlands Abhängigkeit von US-Cloud-Anbietern für zu hoch, nur 8 Prozent würden US-Cloud bevorzugen. Ein souveränes Modell dreht das um. (Bitkom 2026)

Ab wann sich eine souveräne KI-Plattform mit Soofi lohnt

Eine souveräne KI-Plattform mit Soofi lohnt sich, sobald mehr als 50 Mitarbeitende KI nutzen sollen, sensible Datenklassen im Spiel sind oder ein US-Modell aus Compliance-Gründen ausscheidet.
ab 50
Mitarbeitende sollen KI nutzen
ab 3
Anwendungsfälle mit sensiblen Daten
0
Toleranz für Datenabfluss

Anwendungsbeispiele

Use Case 01

Technische Dokumentation durchsuchbar machen

Ein Maschinenbauer lässt Soofi Handbücher, Normen und Serviceberichte in natürlicher Sprache beantworten, statt PDFs manuell zu durchsuchen.

Minuten statt Stunden für die Antwortsuche im Servicefall.
Use Case 02

Regulatorische Dokumente vorprüfen

Compliance-Teams lassen Verträge und Richtlinien gegen interne Vorgaben abgleichen, die finale Freigabe bleibt beim Menschen.

Erste Vorabprüfung in Minuten, Prüfpfad dokumentiert.
Use Case 03

Code-Assistenz auf eigenem Code

Entwicklungsteams nutzen Soofi als Coding-Assistenten, ohne dass Quellcode an eine US-API gesendet wird.

Kein Zeilen-Abfluss, die Codebasis bleibt im Haus.
Use Case 04

Agentische Workflows verknüpfen

Soofi-Agenten verbinden interne Systeme wie Ticketsystem, Wissensdatenbank und ERP für wiederkehrende Abläufe.

Routine-Rückfragen automatisiert, Eskalation an den Menschen definiert.

Integration in Ihre Umgebung

Passt Soofi in unsere Landschaft? In der Regel ja, als offenes Modell mit Standard-Schnittstellen.

Betrieb und Infrastruktur

On-Premise · Auf Ihrer eigenen Hardware oder im deutschen Rechenzentrum, GPU-Sizing nach Last.
EU-Cloud · Managed in einer EU-Cloud wie der Industrial AI Cloud der Telekom, Daten bleiben in Deutschland.
OpenAI-kompatibel · Bereitstellung über einen OpenAI-kompatiblen Endpoint mit vLLM, bestehende Tools sprechen Soofi ohne Umbau an.

Anbindung und Daten

RAG auf Ihren Daten · Anbindung an SharePoint, Confluence, DMS oder Fileshares über Retrieval, ohne die Quellen zu kopieren.
SSO und Rechte · Anbindung an Entra ID oder LDAP, Zugriff und Modell-Rechte pro Rolle.
Fine-Tuning · Optionales Fine-Tuning auf Ihrer Fachsprache, da die Modellgewichte offen vorliegen.

Wie eine souveräne KI-Plattform mit Soofi funktioniert

1
Readiness-Assessment
Wir sichten Use-Cases, Datenklassen und Infrastruktur und definieren, was souverän laufen muss.
2
Architektur-Blueprint
On-Premise oder EU-Cloud, GPU-Sizing, Netz- und Rechtekonzept, Integrationspunkte.
3
Plattform aufsetzen
vLLM-Serving, OpenAI-kompatibler Endpoint, Monitoring und Zugriffskontrolle.
4
Soofi integrieren
Soofi S einbinden, sobald die offenen Gewichte vorliegen. Bis dahin entwickeln wir auf einem gleichwertigen Open-Weight-Modell wie Llama oder Qwen, der Umstieg ist ein Konfigurationswechsel.
5
Anwendungsfall bauen
RAG, Assistent oder Agent auf Ihren Daten, mit Confidence-Schwellen und definiertem Klärfall.
6
Betrieb und Übergabe
Managed Service oder Enablement Ihres Teams, inklusive Updates und neuer Soofi-Varianten.
Erfahren Sie mehr über souveräne KI-Plattformen

Warum Pexon statt Inhouse-Entwicklung

Inhouse allein
-KI- und MLOps-Kompetenz muss erst aufgebaut werden.
-GPU-Sizing und vLLM-Betrieb sind Spezialwissen, Fehler sind teuer.
-Ohne Erfahrung dauert der Weg zur produktiven Plattform Monate.
Hyperscaler-Consulting
-Drängt oft zurück auf die eigene proprietäre Cloud und deren Modelle.
-Souveränität endet dort, wo der Anbieter seine Plattform verkauft.
-Lock-in wird verschoben, nicht gelöst.
Mit Pexon
Herstellerunabhängig: wir bauen um Soofi und Open-Weight-Modelle, nicht um eine Cloud.
Souveräne KI-Plattformen sind unser Kerngeschäft, on-premise wie EU-Cloud.
Vom Readiness-Assessment bis zum Betrieb, ein Ansprechpartner.

In 4 Phasen zur produktiven Lösung

1
Woche 1-2
Assessment und Blueprint
Use-Cases, Datenklassen und Ziel-Architektur sind festgelegt.
2
Woche 3-4
Plattform-Setup
Serving, Endpoint, Zugriff und Monitoring stehen.
3
Woche 5-6
Erster Anwendungsfall
Ein produktiver Use-Case läuft auf Ihren Daten, messbar.
4
ab Woche 7
Betrieb und Rollout
Weitere Use-Cases, Soofi-Varianten, Managed Service oder Enablement.

Pilot zum Festpreis

Wollen Sie Soofi einführen, ist der Einstieg ein Festpreis-Assessment, kein offenes Projekt. Danach setzen wir nach klarem Scoping um.

Microsoft Solutions Partner (Digital & App Innovation, Infrastructure Azure, Data & AI Azure), ISO/IEC 27001, Google Cloud Partner, AWS Partner
Ihre Investition
ab 7.500 EUR
Festpreis · Readiness-Assessment · 2-3 Wochen
Enthält:

Was drin ist · Use-Case- und Datenklassen-Analyse, Ziel-Architektur on-premise oder EU-Cloud, GPU-Sizing und Kostenrahmen.

Was Sie bekommen · Einen umsetzbaren Blueprint plus Aufwands- und Betriebskostenschätzung für die Plattform.

Danach · Umsetzung nach Scoping, Plattform-Setup ab 35.000 EUR als Projektpreis mit definierten Abnahme-Kriterien, Endpreis nach Assessment.
Jetzt Kontakt aufnehmen
100 % unverbindlich, ohne Verpflichtung

Häufige Fragen

Ist Soofi schon verfügbar?

Soofi S ist seit Juni 2026 im Beta-Test mit ausgewählten Industriepartnern, die Modellgewichte werden offen veröffentlicht. Wir bereiten Ihre Plattform jetzt vor und binden Soofi ein, sobald die Gewichte vorliegen. Bis dahin entwickeln wir auf einem gleichwertigen offenen Modell wie Llama oder Qwen, damit Sie ohne Wartezeit starten. Der spätere Umstieg auf Soofi ist ein Konfigurationswechsel, kein neues Projekt.
Ist Pexon offizieller Soofi-Partner?

Nein. Pexon ist ein herstellerunabhängiger Implementierungspartner und gehört nicht zum Soofi-Konsortium. Wir bringen das offene Modell für Sie in Produktion, so wie ein SAP-Implementierungspartner nicht SAP selbst ist. Das hält uns frei, immer das für Sie beste Modell einzusetzen.
Was kostet das?

Der Einstieg ist ein Readiness-Assessment als Festpreis ab 7.500 EUR über 2-3 Wochen. Die Plattform-Umsetzung liegt je nach Umfang ab 35.000 EUR als Projektpreis, GPU und Betrieb transparent getrennt. Den Endpreis legen wir nach dem Assessment fest. Der laufende Betrieb aus GPU und Managed Service beginnt je nach Last und Modellgröße bei rund 1.500 EUR pro Monat, ohne Token-Kosten an einen US-Anbieter.
On-Premise oder Cloud?

Beides. Soofi läuft on-premise auf Ihrer Hardware oder managed in einer EU-Cloud wie der Industrial AI Cloud der Telekom. Entscheidend ist, dass Ihre Daten Ihr Netz oder Deutschland nicht verlassen. Welche Variante passt, klären wir im Assessment anhand von Last, Datenklassen und Budget.
Wo passt Soofi nicht?

Wenn Sie ein multimodales Frontier-Modell für Bild und Video oder maximale Reasoning-Leistung am absoluten Stand der Technik brauchen, sind US-Frontier-Modelle wie ChatGPT oder Gemini heute noch voraus. Soofi ist die richtige Wahl, wenn Datenhoheit und deutsche Sprache zählen, nicht der letzte Benchmark-Punkt.
Was brauchen Sie von uns?

Für das Assessment brauchen wir einen Ansprechpartner aus IT und Fachbereich, eine grobe Use-Case-Liste und Angaben zu Datenklassen und vorhandener Infrastruktur. Für die spätere Umsetzung GPU-Kapazität, eigene oder gemietet, und die Anbindung an Ihre relevanten Datenquellen.

Soofi souverän einsetzen, sprechen wir über Ihre Plattform

Soofi kommt, die Weichen stellen Sie jetzt. In 30 Minuten klären wir, ob eine souveräne KI-Plattform für Sie sinnvoll ist und wie ein Readiness-Assessment konkret aussieht.

Jetzt Kontakt aufnehmen

Nachricht senden

Kein passender Termin? Schreiben Sie uns, wir melden uns innerhalb von 24 Stunden.

Antwort innerhalb von 24 Stunden
Unverbindliches Erstgespräch
Persönlicher Ansprechpartner
Phillip Pham
Phillip Pham
CEO @ Pexon Consulting
Aktualisiert am 18. Juli 2026

Sie suchen einen Partner für Ihr Projekt?

Wir analysieren Ihren individuellen Bedarf, geben erste Empfehlungen zu Umsetzungsstrategien und bieten Ihnen transparente Einblicke in unsere Methoden, Technologien und Referenzen.

Vertrieb kontaktieren
Microsoft Solutions Partner (Digital & App Innovation, Infrastructure Azure, Data & AI Azure), ISO/IEC 27001, Google Cloud Partner, AWS Partner
400+Projekte seit 2020
100+Kunden im DACH-Raum
ISO27001 zertifiziert
3Hyperscaler Partner