KI-Beratung · Open-Source-KI-Plattform

Eigene KI-Assistenten, im Unternehmen und im eigenen Repo

Kurz gesagt

Auf der eigenen Plattform: Assistenten je Team, Wissen und Rechte intern, Modellwahl am Gateway. Prompts und Skills liegen im Unternehmens-Git, nicht im Tenant eines Chat-Vendors. Fachbereiche bekommen gesteuerte Chats mit Wissen. Wenn Sie den Anbieter wechseln, bleiben die Assistenten. Pexon Consulting, 80 Mitarbeitende in Deutschland, legt Prompts und Skills ins Git des Unternehmens. Ein Assistent ist kein Agent.

Microsoft Partner
ISO 27001 zertifiziert
80 MA Deutschland
Microsoft Solutions Partner (Digital & App Innovation, Infrastructure Azure, Data & AI Azure), ISO/IEC 27001, Google Cloud Partner, AWS Partner

Chat für alle vs. Assistenten je Fachbereich

Ein Chat für alle ist nach dem Pilot bequem und für Fachbereiche zu dünn. Einkauf, Qualität und Recht brauchen eigene Assistenten mit Wissen, Rechten und Modellwahl, nicht denselben Prompt für alle Fachbereiche. Die Open-Source-KI-Plattform trägt Assistenten im eigenen Tenant. Pexon Consulting hat 80 Mitarbeitende in Deutschland, Microsoft Partner, ISO 27001. Wer Spaces nur im Seat-Produkt mietet, mietet den Tenant, nicht das Repo.

Ein Chat, alle Fachbereiche
Der globale Chat kennt keine Ablage von Einkauf und keine Sperre von Recht. Fachwissen vermischt sich. Die Antwort klingt freundlich und ist für den Vorgang falsch. Teams umgehen die Plattform und legen Schatten-Chats an.
Wissen sitzt im Vendor-Tenant
Gemietete Custom-GPTs und Spaces speichern Prompts, Dateien und Rechte beim Anbieter. Wechselt der Vertrag, bleibt das Wissen oft im fremden Tenant. IT kann weder Modell noch Auswertung zentral steuern.
Rechte und Modell ohne Gateway
Ohne Gateway wählt jedes Team das Modell selbst, oft am privaten Key. Ohne Rechtekonzept sieht der Assistent zu viel oder zu wenig. Auswertung fehlt: niemand sieht, welcher Assistent welche Quelle genutzt hat.

Was auf der eigenen Plattform zählt

Organisationsangaben von Pexon Consulting, keine Assistenten-Projekt-KPIs.

80 MA in Deutschland
80 Mitarbeitende in Deutschland, Microsoft Partner, ISO 27001. Assistenten, Gateway und Handover sitzen bei einem Team, das den Stack kennt. (Pexon, Stand 2026)
400+ Projekte
400+ Projekte als Organisationsrahmen, nicht als Erfolgsquote je Assistent. Die Zahl zeigt Lieferfähigkeit, keine Garantie für Ihren Fachbereich. (Pexon, Organisationsangabe)
100+ DACH-Kunden
100+ DACH-Kunden. Assistenten je Team brauchen Enablement und Rechte, nicht nur eine weitere Chat-Oberfläche. (Pexon, Organisationsangabe)
8x5 Betrieb statt Folie
Betrieb Mo-Fr in der Servicezeit. Kein Rund-um-die-Uhr-Claim. Assistenten bleiben Chat mit Wissen, kein unbeaufsichtigter Nachtlauf. (Pexon Betriebsmodell, MEZ)

Was ein Assistent braucht: Wissen, Tools, Rechte, Modell, Auswertung

Eigene KI-Assistenten lohnen sich, sobald der Chat-Pilot steht und Fachbereiche Wissen, Rechte und ein eigenes Repo brauchen, statt eines globalen Chats für alle. Die Schwelle liegt bei Assistenten je Team, nicht bei einem weiteren Seat-Produkt. Ein Assistent ist ein gesteuerter Chat mit Wissen. Ein Agent ist Harness, Tools und unbeaufsichtigter Lauf. Multi-Agent-Systeme mit Routing, Delegation und Kommunikation schreiben wir in Python, mit LangGraph oder Pydantic AI als vergleichbarem Framework, Modelle OpenAI-kompatibel hinter LiteLLM. Vertiefung: LangGraph oder Pydantic AI im Betrieb. Das gehört auf die Agenten-Plattform und die Harness-Entwicklung, nicht auf diese Seite. Die Sandbox für Modell-Python ist Pydantic Monty, nicht dieser Assistent. Modellwahl und Auswertung laufen über das Gateway. Prompts und Skills liegen im Git, beschrieben unter Code und IP. Pexon Consulting baut die Schicht auf der Open-Source-KI-Plattform. Betrieb ist 8x5, kein Rund-um-die-Uhr-Claim. Stand 31. August 2026.
Team
eigener Assistent, nicht global
Git
Prompts und Skills intern
1
Gateway für Modell und Auswertung

Unterschied zu Copilot Studio und gemieteten Custom-GPTs: Tenant und IP

Copilot Studio und gemietete Custom-GPTs liefern das Bediengefühl, das Fachbereiche kennen: Wissen hochladen, einen Raum teilen, im Tenant des Anbieters bleiben. IP, Prompts und Exit sitzen dann oft nicht in Ihrem Git. Die Copilot-Hybrid-Seite beschreibt, wann Copilot parallel bleibt. Code und IP beschreibt, was übertragen wird. Private-AI bleibt Beratung, kein zweites Assistenten-Produkt.

Use Case 01

Tenant bleibt Ihrer, nicht gemietet

Fachbereiche wollen Assistenten wie in Seat-Produkten: Wissen, Dateien, eigene Räume. Bei uns liegen sie auf der Kundenplattform, nicht im Vendor-Tenant. Die Copilot-Hybrid-Seite bleibt für Office-Breite parallel.

Ein Assistent je Team, Ownership intern
Use Case 02

Prompts und Skills im Git

Systemprompts, Quellenlisten und Skills liegen im Repository, das Ihnen gehört. Code und IP beschreibt den Transfer, nicht diese Seite. Kein gemietetes Gedächtnis in einer Blackbox.

Wechseln Sie den Anbieter, bleiben die Assistenten
Use Case 03

Rechte je Fachbereich

Einkauf liest Lieferantenakten, Recht sieht Verträge, der Rest sieht sie nicht. Der globale Chat kann das nicht trennen. Rechte hängen am Assistenten und an der Rolle, nicht am privaten Account.

Wissen intern, Zugriff nach Rolle
Use Case 04

Modellwahl und Auswertung am Gateway

Welches Modell welcher Assistent nutzt, steuert das Gateway. Ein Satz auf dem LiteLLM-Hub: Modelle, Keys, Logs. Auswertung zeigt Nutzung und Spend, nicht nur lizenzierte Köpfe.

Ein Gateway, viele Assistenten

Wann aus dem Assistenten ein Agent wird

Der Assistent bleibt Chat mit Wissen. Sobald Tools ins Fachsystem schreiben, ohne Person im Fenster, oder ein Harness Loops steuert, wird daraus ein Agent. Dann gilt die Agenten-Plattform, nicht diese Seite. Hintergrund-Agenten sind unbeaufsichtigter Betrieb, 8x5 Support.

Assistent bleibt Chat, Agent wird Harness

Assistent · Gesteuerter Chat mit Wissen, Rechten und Modellwahl. Ein Mensch sitzt im Fenster und prüft die Antwort.
Agent · Harness, Tools, Stopp. Vertiefung auf der Agenten-Plattform.
Kein Cutover · Copilot und Chat bleiben an. Assistenten kommen je Team dazu.

Power-User, Gateway, Enablement

Hermes · Hermes Agent ist Power-User und Desktop, nicht Assistenten-Admin. Die rund 50 von 1.000, nicht die Fachbereichs-Verwaltung.
Gateway · Modell, Key und Auswertung über ein Gateway. Ohne Gateway kein Team-Assistent mit Nachweis.
8x5 · Plattform-Betrieb und Plattform-Setup hängen danach. Servicezeit Mo-Fr, kein Rund-um-die-Uhr-Claim.

Enablement: wer darf Assistenten anlegen

1
IT gibt frei, Fachbereich nutzt
Nicht jedes Team legt Assistenten selbst an. Platform prüft Wissen, Rechte und Modellklasse. Enablement beschreibt Rollen und Rollout, nicht nur eine Schulungsfolie.
2
Erste Use-Cases je Team
Ein Assistent pro Fachbereich zuerst, mit klarer Quelle und klarer Sperre. Der globale Chat bleibt für Alltag. Die Breite kommt in Wellen, nicht als Big-Bang.
3
Admin ist nicht der Power-User
Wer Assistenten anlegt, ist nicht automatisch Hermes-Nutzer. Hermes Agent bleibt Desktop für Power-User. Assistenten-Admin ist eine Plattformrolle.
4
Artefakte beim Kunden
Playbooks, Prompt-Vorlagen und Rechte-Matrizen liegen im Git des Unternehmens. Enablement ist Lieferkette, kein Seat-Abo.
5
Messung am Gateway
Aktive Nutzung und Spend zählen, nicht lizenzierte Köpfe. Wer den Assistenten nicht öffnet, braucht keinen Seat.
6
Handover in den 8x5-Betrieb
Runbooks und Servicezeit. Setup und Betrieb übernehmen, sobald Rechte und Gateway greifen.
Zur Agenten-Plattform

Chat für alle, gemietetes Custom-GPT oder Assistent mit Pexon

Chat für alle
-Ein Prompt, keine Fachquellen, Rechte vermischt
-Kein Git, Auswertung nur als Chat-Verlauf
-Passt für den Pilot, nicht für Fachbereiche
Gemietetes Custom-GPT / Seat-Space
-Wissen und Prompts oft im Vendor-Tenant
-IP und Exit unsicher, Modellwahl beim Anbieter
-Passt parallel in Office, ersetzt eigene Assistenten nicht
Mit Pexon
Assistenten auf der Open-Source-KI-Plattform, Git beim Kunden
Wissen, Rechte, Modell, Auswertung über das Gateway
45 Minuten Plattform-Check, Betrieb 8x5, ohne Paketpreis auf dieser Seite

In vier Phasen zu Assistenten je Fachbereich

1
45 Min
Plattform-Check
Welche Teams, welches Wissen, welche Rechte. Ob Seat-Spaces warten müssen. Kein Angebot aus der Luft, kein Listenpreis.
2
Scope
Assistenten schneiden
Ein Fachbereich, Quellen, Gateway, Git. Copilot bleibt an. Agenten bleiben eine andere Schicht.
3
Pilot
Rechte und Auswertung greifen
Der Assistent nutzt nur freigegebenes Wissen. Abnahme an Quelle, Rolle und Log, nicht an einer Chat-Demo.
4
8x5
Handover in den Betrieb
Runbooks und Servicezeit. Enablement trägt die Breite, Betrieb übernimmt den Stack.

Chat für alle, gemietetes Custom-GPT oder eigener Assistent

Drei Wege nach dem Chat-Pilot. Der globale Chat bleibt Alltag. Gemietete Custom-GPTs bleiben Seat-Spaces. Eigene Assistenten sind gesteuerte Chats mit Wissen auf Ihrer Plattform. Ein Agent ist Harness, nicht diese Tabelle.

KriteriumChat für alleGemietetes Custom-GPT / SpaceEigener Assistent (Pexon)
Wissen je FachbereichNein, ein PromptJa, im Vendor-TenantJa, intern, Rechte pro Team
Prompts und SkillsIn der Chat-UIBeim AnbieterIm Git des Kunden
ModellwahlWas die UI anbietetVendor-StackAm Gateway, zentral
AuswertungChat-VerlaufAdmin-Center des AnbietersNutzung und Spend am Gateway
RechteMeist ein Chat-UserTenant-Rollen, Exit unsicherRolle und Assistent, nachweisbar
Was es nicht istKein Fach-AssistentKein eigenes RepoKein Agent, kein Unattended
Passt, wennFragen beantworten reichtSeat-SaaS trägt die BreiteFachwissen, Git und Wechselrecht zählen

Was der Plattform-Check klärt, ohne Paketpreis

Der Plattform-Check dauert 45 Minuten und klärt Teams, Wissen, Rechte und Gateway. Den Endpreis nennt Pexon Consulting nach Scope, nicht als Paketpreis auf dieser Seite. Danach Setup und Enablement.

Microsoft Solutions Partner (Digital & App Innovation, Infrastructure Azure, Data & AI Azure), ISO/IEC 27001, Google Cloud Partner, AWS Partner
Ihre Investition
nach Scope 45 Min
kein Paketpreis · nach Scope
Enthält:

Check · 45 Minuten: Chat für alle gegen Assistenten je Team, Copilot parallel, Git ja oder nein.

Scope · Ein Fachbereich, Quellen, Rechte, Gateway. Festpreis erst wenn der Scope steht.

Abnahme · Wissen intern, Rechte nachweisbar, Modell am Gateway. Betrieb 8x5, kein SLA rund um die Uhr.
Plattform-Check buchen (45 Min)
Plattform-Check, 45 Minuten, ohne Verpflichtung

Häufige Fragen zu eigenen KI-Assistenten

Was unterscheidet einen Assistenten von einem Agenten?

Ein Assistent ist ein gesteuerter Chat mit Wissen, Rechten und Modellwahl. Ein Mensch prüft die Antwort. Ein Agent ist Harness: Tools, Loops, oft ohne Person im Fenster. Die Agenten-Plattform trägt Harness. Hintergrund-Agenten tragen Unattended. Diese Seite bleibt bei Team-Assistenten.
Warum nicht einfach gemietete Custom-GPTs?

Custom-GPTs und Spaces in einem Seat-Tenant speichern oft Prompts und Wissen beim Anbieter. Fachbereiche wollen genau das Bediengefühl. Ownership und Exit liegen dann nicht bei Ihnen. Code und IP und die Copilot-Hybrid-Seite trennen Miete von Repo. Private-AI bleibt Beratung, kein zweites Assistenten-Produkt.
Was kostet das?

Es gibt keinen Paketpreis auf dieser Seite. Der Plattform-Check dauert 45 Minuten und klärt Teams, Wissen, Rechte und Gateway. Einen Festpreis nennt Pexon Consulting nach Scope, wenn Fachbereich, Quellen und Abnahme festliegen. Betrieb läuft 8x5. Setup und Enablement hängen als eigene Schritte danach.
Wer darf Assistenten anlegen?

Fachbereiche schlagen Wissen und Zweck vor. Platform gibt frei: Quellen, Rechte, Modellklasse. Enablement beschreibt Rollen, Wellen und Messung. Nicht jedes Team bekommt Admin. Hermes Agent ist Power-User, nicht Assistenten-Admin.
Wo passen eigene Assistenten nicht?

Wenn der Chat-Pilot noch fehlt, zuerst die Oberfläche, nicht Team-Assistenten. Wenn unter 200 Nutzer, ohne IT-Kapazität und in vier Wochen live alle drei Bedingungen der Mutter zutreffen, bleibt Seat-SaaS ehrlich. Kein Agent und kein Unattended auf dieser Seite. Kein 24-Stunden-Betrieb. Keine Paketpreise hier.
Bleibt Microsoft Copilot erhalten?

Ja. Copilot bleibt für die Office-Breite der Belegschaft. Die Copilot-Hybrid-Seite beschreibt das Parallel-Modell. Eigene Assistenten decken Fachwissen, Rechte und Git, die ein gemietetes Custom-GPT so nicht trägt. Kein Cutover. Microsoft 365 bleibt an, während Team-Assistenten über die eigene Plattform laufen.

Assistenten prüfen, bevor Spaces gemietet werden

Sobald Fachbereiche eigene Assistenten wollen und Seat-Spaces im Raum sind, fehlt das Repo. 45 Minuten Plattform-Check: Wissen, Rechte, Gateway, Git.

Plattform-Check buchen (45 Min)

Nachricht senden

Kein passender Termin? Schreiben Sie uns, wir melden uns innerhalb von 24 Stunden.

Antwort innerhalb von 24 Stunden
Unverbindliches Erstgespräch
Persönlicher Ansprechpartner
Phillip Pham
Phillip Pham
CEO @ Pexon Consulting
Aktualisiert am 31. August 2026

Sie suchen einen Partner für Ihr Projekt?

Wir analysieren Ihren individuellen Bedarf, geben erste Empfehlungen zu Umsetzungsstrategien und bieten Ihnen transparente Einblicke in unsere Methoden, Technologien und Referenzen.

Vertrieb kontaktieren
Microsoft Solutions Partner (Digital & App Innovation, Infrastructure Azure, Data & AI Azure), ISO/IEC 27001, Google Cloud Partner, AWS Partner
400+Projekte seit 2020
100+Kunden im DACH-Raum
ISO27001 zertifiziert
3Hyperscaler Partner