Als im Herbst 2025 die Meldung durchlief, dass Aleph Alpha und Cohere zusammengehen, hab ich die Pressemitteilung zweimal lesen müssen. „Europäische KI-Souveränität“ stand groß im ersten Absatz. Faktisch läuft der Deal, soweit öffentlich bekannt, darauf hinaus, dass ein kanadischer Modellhersteller künftig über ein Heidelberger Unternehmen in den DACH-Markt verkauft, abgesichert mit Kapital von SAP, NVIDIA und KKR. Die eigene Modellentwicklung von Aleph Alpha läuft daneben aus.
Ich will hier keine Tech-Katastrophe beschwören. Mich interessiert eine nüchternere Frage: Was bedeutet das für dein Budget, wenn du 2026 KI-Workflows im Betrieb fährst? Denn die Antwort fällt unbequemer aus, als die Feierstimmung vermuten lässt. Wer heute nach „KI Hosting Deutschland“ sucht, findet erstmal Marketing und selten Zahlen. Das ändern wir hier mal. Und falls du gerade erst anfängst, deine Abläufe zu automatisieren: Unser No-Hype-Playbook für KI-Automatisierung im Mittelstand hilft dir, Hosting als letzte Frage zu behandeln und nicht als erste.
Was der Aleph-Alpha-Cohere-Deal wirklich bedeutet: weniger Wettbewerb auf dem EU-Markt
Kurz der Stand, so wie ich ihn Anfang 2026 überblicke. Aleph Alpha aus Heidelberg galt jahrelang als deutsche Hoffnung auf eigene Large Language Models. Cohere sitzt in Toronto und verkauft Enterprise-Modelle. Der Deal verbindet beide: Aleph Alpha konzentriert sich auf die Plattform PhariaAI, in der künftig vor allem Cohere-Modelle laufen. Die Investorenriege klingt erstmal nach Stabilität.
Nur: Was ist dabei herausgekommen, wenn man die Souveränitäts-Rhetorik weglässt?
Ein europäischer Modellentwickler weniger. Ein Anbieter, der vielleicht irgendwann ein kompaktes Open-Weight-Modell gebaut hätte, das du auf deinem eigenen Server hättest laufen lassen können. Stattdessen gibt es jetzt einen gut finanzierten Vertriebskanal für ein nordamerikanisches Modell, mit EU-Verträgen und deutschen Rechenzentren drumherum. Das kann trotzdem ein sinnvolles Geschäft sein, keine Frage. Aber es ist Unabhängigkeit light, nicht Unabhängigkeit.
Für dich als Mittelständler zählt am Ende die Auswahl. Die Zahl der Anbieter, die DSGVO-konformes Hosting mit eigenen oder europäisch lizenzierten Modellen anbieten, ist kleiner geworden, während die Nachfrage gleichzeitig wächst. Ökonomie für Anfänger: Das treibt Preise.
Ein konkretes Beispiel aus einem Kundenprojekt Ende 2025. Maschinenbauer, 70 Mitarbeiter, sollte seine Wartungsdokumentation durchsuchbar machen. Rund 28.000 Seiten Handbücher, Ersatzteillisten, Prüfbögen. Wir haben PhariaAI gegen Azure OpenAI (EU-Region, in unserem Fall Schweden) getestet. Ergebnisqualität: praktisch gleichauf, beide gut genug für den Anwendungsfall. Das PhariaAI-Angebot für das Paket, das wir brauchten: 1.750 € im Monat. Die geschätzte Azure-Rechnung bei unserem Testvolumen: 480 €.
Der Geschäftsführer hat sich trotzdem für PhariaAI entschieden. „Made in Germany“ war das Argument, und für die Präsentation ans Bankenumfeld klingt das gut. Kann man machen. Man sollte es nur beim Namen nennen: rund das Dreieinhalbfache für ein Bauchgefühl.
Warum „Made in Germany“ KI-Hosting teurer macht, nicht automatisch sicherer
Hier wird’s unangenehm, weil ein Glaube mit Realität kollidiert: Ein Rechenzentrum in Frankfurt macht dich nicht sicherer. Sicherheit entsteht durch Zugriffsverwaltung, Verschlüsselung, Monitoring und Prozesse. Und die sind bei den großen US-Anbietern, so schwer mir das zugeben fällt, oft besser dokumentiert und auditiert als bei kleinen europäischen Playern, die zwischen zwei Finanzierungsrunden händeringend Ops-Leute suchen.
Was „souverän“ real bedeutet: Deine Daten liegen in der EU, der Vertrag folgt deutschem Recht, und theoretisch greifen trotzdem US-Zugriffsgesetze wie der CLOUD Act, sobald eine US-Muttergesellschaft im Spiel ist. Bei Cohere über Aleph Alpha liegt diese Frage irgendwo dazwischen. Ehrlich gesagt kann ich dir nicht seriös versprechen, wie ein US-Gericht das 2027 beurteilt. Vermutlich kann das niemand.
Der Preisaufschlag ist trotzdem real, und er hat einen simplen Mechanismus: weniger Konkurrenz trifft auf einen Markt, in dem DSGVO-Konformität als Muss gilt. Wer dieses Muss bedient, kann Aufschläge verlangen. Du zahlst eine Compliance-Prämie, und Fusionen machen sie nicht kleiner.
Möglicherweise liege ich auch falsch. Vielleicht brechen die Aufschläge ein, sobald Mistral, IONOS und ein paar französische Anbieter ernsthaft um Mittelstandsbudgets kämpfen. Ich hab 2024 prognostiziert, dass EU-Hosting bis Ende 2025 auf Preisniveau der US-Anbieter wäre. War falsch. Die Lücke ist seither größer geworden, nicht kleiner.
Der Qwen-Fall: Was das US-Amtsblatt-Beispiel über Preisdruck und politische Abhängigkeiten verrät
Jetzt der zweite Teil, der das Bild abrundet. Anfang 2026 wurde bekannt, dass ein Tool des US-Federal Register, also des offiziellen Amtsblatts der US-Regierung, öffentliche Stellungnahmen automatisch zusammenfasst, und dass dahinter Qwen steckt. Ein Modell von Alibaba. Im Herzstück der amerikanischen Bundesverwaltung.
Die Empörung war groß, verständlich. Aber mir ging beim Lesen ein Licht auf: Wenn nicht mal die US-Regierung, die lauteste Souveränitäts-Fraktion der westlichen Welt, dem Preisdruck standhält, warum sollte es ein 50-Personen-Betrieb aus Bochum tun?
Die Lehre ist zweiteilig. Erstens: Offene Modellgewichte sind der einzige echte Hebel gegen Preismacht. Wer Gewichte herunterladen und auf gemieteten GPUs laufen lassen kann, ist nicht am API-Preisblatt des Monats gefangen. Zweitens: Politische Abhängigkeit ist ein Spektrum, kein Schalter. US-Modelle haben unter der aktuellen Regierung eigene Risiken (Zugriff, Lizenzbedingungen, plötzliche Preiswechsel), chinesische Modelle andere, europäische wieder andere. Einen neutralen Boden gibt es nicht mehr. Der Hosting-Markt 2026 ist fragmentiert, und Fragmentierung zahlt am Ende fast immer der Kunde.
Ich wollte das nicht nur theorieren und hab für ein Kundenprojekt im Januar nachgerechnet. Ein Summarizer für Support-Tickets, rund 40.000 Tickets im Monat, jeweils auf 200 Wörter verdichtet. Mit einem GPT-4o-Klasse-Modell über die API: etwa 190 € im Monat. Mit Qwen über OpenRouter: 8 €. Ja, acht. Wir haben 300 Stichproben manuell geprüft: 91 Prozent brauchten keine Nacharbeitung, beim 24-fach teureren Modell waren es 93 Prozent.
Der Kunde hat sich am Ende gegen Qwen entschieden. Bauchgefühl, plus eine Datenschutzbeauftragte, die Nein gesagt hätte. Auch das ist legitim. Man sollte nur wissen, was es kostet: grob 2.100 € im Jahr für ein Compliance-Gefühl bei bereits anonymisierten Tickets.
Drei Hosting-Stacks, die wir deutschen Mittelständlern 2026 tatsächlich empfehlen
Nach dem ganzen Jammern die Konstruktivität. Wir beraten genug KMU, um zu wissen, dass die Antwort von deinen Daten, deinem Volumen und deiner Ops-Kapazität abhängt. Diese drei Stacks haben 2025 so ziemlich alle Fälle abgedeckt, die wir gesehen haben.
Stack 1: Große US-API mit EU-Region (der Pragmatiker)
Azure OpenAI, AWS Bedrock oder Google Vertex, jeweils Region Frankfurt oder Paris, AVV abgeschlossen, Data-Residency-Optionen gesetzt. Nicht sexy, aber für schätzungsweise 80 Prozent der Mittelstandsanwendungen die richtige Mischung aus DSGVO-Konformität, Modellqualität und Preis. Bei unseren Kunden liegen die Monatsrechnungen meist zwischen 80 und 700 €. Der Haken: Du hängst am Anbieter, und Preisdiktate kommen, sobald der Markt es erlaubt.
Stack 2: Offene Gewichte auf gemieteten EU-GPUs (der Preisbrecher)
Qwen, Llama oder Mistral mit vLLM auf Servern von Hetzner, IONOS oder OVH. Hier wird’s technisch, und ich will ehrlich bleiben: Ich hab ein langes Wochenende gebraucht, bis vLLM auf einem gemieteten GPU-Server stabil lief, inklusive Treiber-Drama und einem kaputten Tokenizer-Setup. Miete für zwei 4090er: 260 € im Monat. Für unser Testvolumen von etwa 60.000 Tokens am Tag wäre das doppelt so teuer wie die API gewesen, plus sechs bis acht Stunden Ops im Monat.
Unterhalb von grob zwei Millionen Tokens im Monat lohnt sich das finanziell selten. Oberhalb, oder wenn Daten das Haus gar nicht verlassen dürfen, ist es der stärkste Hebel, den du hast.
Stack 3: Bewusste EU-Plattform (der Souveränitäts-Kunde)
Wenn Auftraggeber, Exportkontrolle oder die öffentliche Hand EU-only verlangen: IONOS, T-Systems, Mistral über europäische Partner oder eben PhariaAI. Zahl den Aufschlag bewusst, aber handle und lass dir Exit-Klauseln geben: Datenexport in strukturiertem Format, kein Training auf deinen Daten, transparente Unterauftragsverarbeiterliste. Souveränität kaufst du als Vertragsparagraph, nicht als Logo auf der Website.
Egal welcher Stack: Die Schicht darüber entscheidet, ob ein Modellwechsel in zwei Wochen oder zwei Monaten erledigt ist. Also wie Workflows, Retry-Logik und Fehlerbehandlung gebaut sind. Mehr dazu in unserem Vergleich der Automatisierungsplattformen Zapier, Make und n8n und in unserem Artikel zu Workflow-Reliability im Betrieb.
Die DSGVO-Falle: Warum Fusionen die Auftragsverarbeitung und das Vendor-Lock-in komplizierter machen
Der am meisten unterschätzte Teil am Deal. Wenn zwei Anbieter zusammengehen oder ihr Portfolio neu sortieren, ändert sich die Kette der Auftragsverarbeiter womöglich mittendrin. Dein AVV von 2024 beschreibt einen Dienst, den es in dieser Form nicht mehr gibt. Unterauftragsverarbeiter kommen hinzu oder fallen weg, und du wirst per E-Mail informiert. Wenn überhaupt.
Was das praktisch heißt: Modellwechsel klingen einfach („wir tauschen das Modell“), sind aber selten ein Tausch. Plattform-Features wie RAG-Pipelines, Prompt-Verwaltung und Agenten-Workflows binden dich an die Plattform, nicht ans Modell. Und je mehr Agenten im Spiel sind, desto mehr Verhalten steckt in Prompts und Konfigurationen, die du beim Wechsel neu kalibrieren musst. Wie Agenten-Workflows überhaupt aufgebaut sind, haben wir im Detail hier aufgeschrieben.
Deshalb der Rat, der 2026 wichtiger ist als je zuvor: Bau jeden KI-Workflow so, dass das Modell austauschbar bleibt. Dünner API-Layer, saubere Exportformate, Evaluationen, die du vor und nach einem Wechsel laufen lassen kannst. Das kostet beim Bauen vielleicht 10 Prozent mehr Zeit. Beim ersten erzwungenen Anbieterwechsel holt es ein Vielfaches zurück.
Kurz und ehrlich
Der Aleph-Alpha-Cohere-Deal ist weder Katastrophe noch Erlösung. Er zeigt, dass der europäische KI-Markt konsolidiert, und bei Konsolidierung zahlt am Ende fast immer der Kunde. Deine Aufgabe ist es deshalb nicht, das richtige Lager zu wählen, sondern so zu bauen, dass du das Lager wechseln kannst, wenn es teuer wird.
Wenn du gerade vor so einer Hosting-Entscheidung stehst und eine zweite Meinung willst: meld dich gern. Wer ich bin und warum ich bei diesem Thema etwas gereizt bin, kannst du hier nachlesen.
Bis nächste Woche,
Damian
