Alibaba baut eine eigene KI-Infrastruktur auf
Alibaba Cloud will seine weltweite Rechenzentrumskapazität auf 20 GW skalieren. CEO Eddie Wu kündigte das Vorhaben auf der Apsara-Konferenz an, nannte jedoch weder ein konkretes Zieljahr noch die geplanten Standorte.
Parallel dazu stellte Alibaba den KI-Prozessor Zhenwu V900 vor. Der Chip stammt von der konzerneigenen Halbleitersparte T-Head und soll sowohl das Training als auch den Betrieb großer KI-Modelle ermöglichen.
Der Zhenwu V900 sei derzeit der leistungsstärkste KI-Chip Chinas und erreiche die dreifache Leistung seines Vorgängers Zhenwu M890, erklärte Eddie Wu sinngemäß.
20 GW sind groß, aber der Markt wächst noch schneller
Die geplanten 20 GW zeigen, welche Größenordnung Alibaba für den weiteren Ausbau seiner Cloud- und KI-Dienste ansetzt. Ein direkter Vergleich mit anderen Projekten ist allerdings nur eingeschränkt möglich. Manche Angaben beziehen sich auf einzelne Standorte, andere auf neu gebaute Kapazität oder sämtliche derzeit laufenden Projekte.
| Unternehmen oder Markt | Kapazität | Einordnung |
|---|---|---|
| Alibaba Cloud | 20 GW | Geplante weltweite Gesamtkapazität, ohne genanntes Zieljahr |
| USA | 37,7 GW | Derzeit im Bau befindliche Rechenzentrumskapazität laut Cushman & Wakefield |
| Stargate | 10 GW | Geplante Kapazität bis 2029 |
| Meta | 5 GW | Angekündigte Kapazität eines eigenen Rechenzentrumscampus |
| Amazon | 3,8 GW | Innerhalb von zwölf Monaten bis Ende 2025 hinzugefügte Kapazität |
Die Ausbaupläne stehen damit in einem internationalen Wettbewerb um Strom, Flächen und Rechenleistung. Dass diese Faktoren zunehmend regulatorisch relevant werden, zeigen etwa die neuen Regeln für Wasser- und Stromverbrauch von Rechenzentren in Kalifornien.
Zhenwu V900 für Cluster mit bis zu 500.000 Chips
Alibaba zufolge kann ein einzelner Rechencluster mit bis zu 500.000 Zhenwu-V900-Prozessoren aufgebaut werden. Ein solches System soll für das Training und die Inferenz von Spitzenmodellen geeignet sein. Inferenz bezeichnet dabei den produktiven Betrieb eines bereits trainierten Modells.
| Merkmal | Zhenwu V900 |
|---|---|
| Speicher | 216 GB |
| Inter-Chip-Bandbreite | 1.200 GB/s |
| Unterstützte Datenformate | FP32 bis FP4 |
| Leistung gegenüber Zhenwu M890 | Faktor 3 laut Alibaba |
| Maximale Clustergröße | Bis zu 500.000 Chips laut Alibaba |
Offen bleibt, wann der Zhenwu V900 in größeren Stückzahlen verfügbar sein wird. Alibaba machte auch keine Angaben dazu, wann ein Cluster in der genannten Maximalgröße betriebsbereit sein könnte.
Strategisch ist die Richtung dennoch klar. Alibaba verbindet eigene Chips, eigene Rechenzentren und eigene Basismodelle zu einer durchgängigen Plattform. Damit sinkt die Abhängigkeit von US-Hardware und von möglichen Exportbeschränkungen. Ähnliche Bestrebungen sind auch bei anderen chinesischen Anbietern sichtbar, etwa beim Huawei Ascend 960DT.
Qwen 4 befindet sich bereits im Training
Neben der Infrastruktur kündigte Alibaba den Trainingsstart von Qwen 4 an. Auf der weiteren Roadmap stehen Modelle mit 5 und 10 Billionen Parametern. Ob diese künftigen Versionen wie frühere Qwen-Modelle mit frei verfügbaren Gewichten veröffentlicht werden, ist bislang nicht bestätigt.
Das Qwen-Team untersucht außerdem Recursive Self-Improvement, kurz RSI. Dabei werden KI-Modelle eingesetzt, um an der Entwicklung neuer Modelle mitzuwirken. Alibaba spricht nach eigenen Angaben von bedeutenden Fortschritten, veröffentlichte dazu aber keine näheren technischen Ergebnisse.
Für langfristige und sehr komplexe Aufgaben könne KI Millionen Teilaufgaben auf Millionen Agenten verteilen. Menschen müssten dann vor allem Absicht und Ziel festlegen, erklärte Wu sinngemäß.
Diese Vision setzt nicht nur leistungsfähige Modelle voraus, sondern auch enorme Infrastruktur für parallel arbeitende KI-Agenten und automatisierte Forschungsarbeit. Wie effizient oder wirtschaftlich solche Systeme tatsächlich werden, lässt sich aus den Ankündigungen noch nicht ableiten.
Für DACH-Unternehmen ist Qwen wichtiger als Alibaba Cloud
Für Unternehmen im DACH-Raum dürfte Alibaba Cloud wegen DSGVO-Anforderungen, Compliance-Vorgaben und geopolitischer Risiken selten die erste Wahl sein. Zudem fehlen bislang Angaben dazu, ob ein Teil der neuen Rechenzentren in Europa entstehen soll.
Relevanter ist die Entwicklung der Qwen-Modellfamilie. Qwen spielt im globalen Open-Source- und Open-Weight-Ökosystem eine wichtige Rolle und wird auch für lokale, selbst gehostete KI-Systeme eingesetzt. Solche Modelle können eine Alternative zu dauerhaft abgerechneten API- und SaaS-Angeboten sein, sofern Hardware, Betrieb und interne Kompetenz vorhanden sind.
Die wirtschaftliche Abwägung bleibt dabei projektspezifisch. Open-Weight-Modelle können laufende Anbietergebühren und Abhängigkeiten reduzieren, verlagern aber Aufwand in Infrastruktur, Sicherheit und Wartung. Eine aktuelle Einordnung zeigt, dass Open-Weight-Modelle trotz Leistungsrückstand deutlich günstiger sein können.
Alibabas vertikale Integration stärkt diese Alternative langfristig. Entscheidend für europäische Unternehmen wird jedoch sein, ob Qwen 4 und seine Nachfolger tatsächlich mit zugänglichen Gewichten erscheinen. Bis zu einer entsprechenden Ankündigung bleibt dieser Teil der Strategie offen.

