München, 29. September 2026 – Wer heute eine KI-Anwendung baut, schickt seine Daten meist an einen Anbieter in den USA. Das muss nicht sein: Frei verfügbare Sprachmodelle lassen sich inzwischen auf eigenen Servern betreiben oder in einer europäischen Cloud-Umgebung, die das Unternehmen selbst kontrolliert. b.telligent begleitet Unternehmen ab sofort auf diesem Weg: von der Frage, welche Anwendungen sich dafür überhaupt lohnen, bis hin zum laufenden Betrieb.
Die Empfehlungen stützen sich dabei auf eigene Messungen. Ein eigens entwickeltes Testverfahren prüft über ein Wochenende diverse Modelle von Coding Assistance bis Speech-to-Text auf einer festgelegten Hardware und beantwortet gleichzeitig die drei Fragen, die in Projekten immer wieder auftauchen: Wie gut passt die Hardware? Wie schnell antwortet das Modell? Wie viele Menschen können gleichzeitig damit arbeiten?
Gute Ideen sollten nicht an kritischen Daten scheitern
In Kundengesprächen hört b.telligent oft dieselbe Geschichte: Die KI darf nur an die unkritischen Daten und ausgerechnet die Anwendungen, die am meisten bringen würden, bleiben oft liegen. Warum? Weil die Daten dahinter zu sensibel sind. Dazu kommt die Unsicherheit bei der Rechtslage. Ob Daten in die USA übertragen werden dürfen, muss laufend neu bewertet werden; nach einer Entscheidung des US Supreme Court im Sommer hat der Europäische Datenschutzausschuss die EU-Kommission im Juli 2026 gebeten, die Grundlage dafür zu überprüfen. Wer also die Modelle im eigenen Haus betreibt, ist hier auf der sicheren Seite, denn: die Daten bleiben einfach, wo sie sind.
„Wer heute eine KI-Anwendung auf einen US-Dienst stellt, baut auf einem Fundament, das sich in wenigen Monaten verschieben kann. Nach Safe Harbor und Privacy Shield wäre es der dritte Bruch in zehn Jahren“, sagt Sebastian Amtage, Gründer und Geschäftsführer Deutschland von b.telligent. „Und das ist sehr relevant, weil Sprachmodelle gerade genauso wichtig werden, wie das ERP-System oder die Datenbank. Und deshalb ist es gut, wenn man selbst entscheiden kann wo es läuft, mit welcher Version und wann sich etwas ändert.“
Genau gemessen statt grob geschätzt
Wie viel Rechenleistung ein Sprachmodell braucht und wie gut es dann läuft, dazu kursieren viele Zahlen, die sich in der Praxis nicht wiederholen lassen. Die gängigen Ranglisten helfen dabei wenig: Sie bewerten, wie klug ein Modell antwortet, nicht, wie viele Kolleginnen und Kollegen gleichzeitig damit arbeiten können und wie flüssig die Antworten kommen. b.telligent misst deshalb selbst, aktualisiert die Ergebnisse, sobald neue Modelle oder neue Hardware erscheinen, und testet bei Bedarf die Wunschmodelle eines Kunden auf seinen eigenen Servern.
„Die Frage ist selten, ob ein frei verfügbares Modell gut genug ist“, sagt Kai Kalchthaler, Geschäftsführer Deutschland bei b.telligent. „Die Frage ist, was es auf unserer Hardware leistet, für wie viele Menschen gleichzeitig und zu welchen Kosten im Monat. Genau diese Zahlen fehlen den meisten Wirtschaftlichkeitsrechnungen und ohne sie wird jede Anschaffung zur Wette. Wir messen deshalb selbst und legen offen, wie wir messen. Dann kann jeder nachrechnen, ob unsere Empfehlung trägt.“
In drei Schritten zum eigenen Modell
Am Anfang steht eine Bestandsaufnahme: Welche Anwendungsfälle bringen am meisten, wie sensibel sind die Daten dahinter, und welche Technik gibt es schon. Daraus entsteht eine Reihenfolge, die sich abarbeiten lässt. Im zweiten Schritt geht es um die Auswahl des Modells, die passende Hardware und darum, wie das Modell auf die firmeneigenen Dokumente zugreift. Zum Schluss wird die Umgebung aufgebaut, die erste Anwendung angebunden und der Betrieb an das Team des Kunden übergeben.
„Im eigenen Haus" bedeutet dabei nicht zwangsläufig eigene Server im Keller: Auch eine selbst kontrollierte Umgebung bei einem europäischen Anbieter erfüllt diesen Zweck. Den Anfang macht ein unverbindliches Gespräch darüber, welche Anwendungsfälle sich überhaupt lohnen. Ansprechpartner ist Dr. Michael Allgöwer, Management Consultant Data Science & AI bei b.telligent.
Mehr dazu: LLMs lokal hosten: KI nutzen, ohne die Kontrolle über Deine Daten abzugeben
(Die Bildrechte liegen bei dem Verfasser der Mitteilung.)
KI im eigenen Haus: b.telligent hilft Unternehmen, Sprachmodelle selbst zu betreiben