Als die US-Regierung jüngst den Zugriff nicht-amerikanischer Kunden auf Anthropics neueste Modelle Fable 5 und Mythos 5 einschränkte, war die Reaktion Europas so prompt wie vorhersehbar: mehr eigene Rechenzentren, europäische KI-Champions, staatlich geförderte Foundation Models. Dabei lautet die eigentliche Frage nicht: Wie verschafft sich Europa schneller Zugang zur nächsten Modellgeneration? Sondern: Wofür brauchen Unternehmen diese Modelle überhaupt?
Was in der Souveränitätsdebatte untergeht: Der überwiegende Teil der Wertschöpfung, um die es Industrieunternehmen tatsächlich geht, lässt sich schon heute unabhängig von Hyperscalern realisieren – mit frei verfügbaren Modellen, modular integriert, ohne neue Abhängigkeiten einzugehen.
Die milliardenschweren Foundation Models der großen US-Anbieter positionieren sich als „Allgemeingelehrte" im verfügbaren Menschheitswissen. Generalistische Alltagsnutzung, offene Gesprächsführung, komplexe Coding-Aufgaben und vage formulierte Wissensarbeit – genau dort entfalten sie ihre Stärke und rechtfertigen sich ihr Preis und ihre Marktmacht.
Für die konkreten Anwendungsfälle in großen Teilen der meist industriell geprägten deutschen Wirtschaft, wie etwa Prozessautomatisierung, unternehmensspezifisches Fachwissen oder die Integration in physische Systeme und bestehende Software – kommt es auf spezielles Domänenwissen an. Für diese Klasse von Aufgaben braucht es keine weitere Optimierung von Wissensbreite und Eloquenz, sondern eine Architektur mit hoher Integrationstiefe, die vorhandene, kleinere Modelle gezielt mit dem relevanten Kontext aus Domänenwissen und Systemdaten versorgt und auf die eigene Fachlichkeit zuschneidet.
Die Fähigkeiten der führenden Modelle haben sich an der industriellen B2B-Anwendung vorbeientwickelt. Sie demonstrieren Leistungsfähigkeit gegenüber Investoren – nicht gegenüber den meisten Business-Problemen.
Für eine wachsende Zahl typischer Unternehmensanwendungen sind Open-Weight-Modelle daher längst zur ernstzunehmenden Alternative zu den großen Frontier-Modellen geworden. Ihr Vorteil liegt nicht nur in der Unabhängigkeit von einzelnen Modellherstellern und damit verbundenen geopolitischen Interessen, sondern vor allem in planbaren, deutlich niedrigeren Nutzungskosten. Bei vergleichbaren Coding-Benchmarks liegt der Kostenunterschied zwischen einzelnen Modellen teils beim Fünfzigfachen.
Kosten pro mittlerem Coding-Agenten-Task: DeepSeek V4 Pro bis zu 98× günstiger als Premium-Modelle1
| Modell | Inputkosten je Task | Outputkosten je Task | Gesamtkosten je Task | Kostenfaktor zu V4 Pro |
|
DeepSeek V4 Flash |
0,084 USD |
0,022 USD |
0,106 USD |
0,3× |
|
DeepSeek V4 Pro |
0,261 USD |
0,070 USD |
0,331 USD |
1,0× |
|
Claude Sonnet 5 |
1,200 USD |
0,800 USD |
2,000 USD |
6,0× |
|
Claude Opus 4.8 |
3,000 USD |
2,000 USD |
5,000 USD |
15,1× |
|
GPT-5.5 |
3,000 USD |
2,400 USD |
5,400 USD |
16,3× |
|
GPT-5.5 Pro |
18,000 USD |
14,400 USD |
32,400 USD |
98,0× |
[1] Annahme je Task: 600.000 Input- und 80.000 Output-Tokens. Berechnung auf Basis öffentlicher API-Listenpreise, ohne Prompt-Caching, Batch-Rabatte, Infrastruktur-, Sandbox-/CI- und Human-Review-Kosten. Tatsächliche Kosten je erfolgreich gelöster Aufgabe hängen zusätzlich von Lösungsquote, Wiederholungen und Workflow-Design ab.
Souveränität ist also eine bewusste Architekturentscheidung, auf die sich bereits heute neue Antworten geben lässt. Anstatt auf zukünftige, europäische Alternativen zu ChatGPT & Co. sowie geänderte staatliche Rahmenbedingungen zu warten, sollten KI-Verantwortliche hierzulande beginnen, Souveränität innerhalb ihrer Organisation aktiv zu gestalten. Vier Aspekte sind dabei entscheidend:
Noch scheint ein solches Umdenken kaum stattzufinden. Die aktuelle Dynamik ähnelt vielmehr der frühen Cloud-Ära: Unternehmen gehen langfristige Verträge mit einzelnen Anbietern ein, in der Erwartung, dass sich diese Abhängigkeit auszahlt – und steckten sich damit selbst in eine Kostenfalle, aus der ein Ausstieg zunehmend unwirtschaftlich wurde.
Damals wie heute zeichnen sich zwei Verhaltensmuster ab, die beide hohe Risiken bergen. Ein Teil der Unternehmen wartet ab – in der Hoffnung auf eine souveräne, qualitativ gleichwertige und ebenso leistungsstarke Alternative – und büßt in der Zwischenzeit kontinuierlich an Wettbewerbsfähigkeit ein. Andere setzen, in Erwartung von Skaleneffekten und Zugang zur jeweils leistungsfähigsten Modellgeneration, auf einzelne Hyperscaler und begeben sich damit in genau die langfristige Abhängigkeit und die Kostenrisiken.
Die Frage für Unternehmen ist damit nicht länger, wann souveräne Infrastruktur kommt, sondern: Welche der eigenen KI-Anwendungsfälle lassen sich bereits heute modular, mit frei verfügbaren Modellen und ohne neue Abhängigkeit umsetzen?
Wie souverän ist Ihre Architektur?
Modelle sind austauschbar, Ihr Fachwissen ist es nicht. Sprechen Sie mit uns darüber, wie Sie Ihre KI-Anwendungsfälle modular und unabhängig von einzelnen Anbietern aufstellen.