Alibaba Cloud plant 20 GW und eigenen KI-Chip

Alibaba Cloud will seine weltweite Rechenzentrumskapazität auf 20 GW ausbauen und dafür verstärkt eigene Hardware einsetzen. Der neue Zhenwu V900 soll große KI-Cluster antreiben, während mit Qwen 4 bereits die nächste Modellgeneration trainiert wird.

Alibaba Cloud plant 20 GW und eigenen KI-ChipBild: KI-generiert

Alibaba baut eine eigene KI-Infrastruktur auf

Alibaba Cloud will seine weltweite Rechenzentrumskapazität auf 20 GW skalieren. CEO Eddie Wu kündigte das Vorhaben auf der Apsara-Konferenz an, nannte jedoch weder ein konkretes Zieljahr noch die geplanten Standorte.

Parallel dazu stellte Alibaba den KI-Prozessor Zhenwu V900 vor. Der Chip stammt von der konzerneigenen Halbleitersparte T-Head und soll sowohl das Training als auch den Betrieb großer KI-Modelle ermöglichen.

Der Zhenwu V900 sei derzeit der leistungsstärkste KI-Chip Chinas und erreiche die dreifache Leistung seines Vorgängers Zhenwu M890, erklärte Eddie Wu sinngemäß.

20 GW sind groß, aber der Markt wächst noch schneller

Die geplanten 20 GW zeigen, welche Größenordnung Alibaba für den weiteren Ausbau seiner Cloud- und KI-Dienste ansetzt. Ein direkter Vergleich mit anderen Projekten ist allerdings nur eingeschränkt möglich. Manche Angaben beziehen sich auf einzelne Standorte, andere auf neu gebaute Kapazität oder sämtliche derzeit laufenden Projekte.

Unternehmen oder MarktKapazitätEinordnung
Alibaba Cloud20 GWGeplante weltweite Gesamtkapazität, ohne genanntes Zieljahr
USA37,7 GWDerzeit im Bau befindliche Rechenzentrumskapazität laut Cushman & Wakefield
Stargate10 GWGeplante Kapazität bis 2029
Meta5 GWAngekündigte Kapazität eines eigenen Rechenzentrumscampus
Amazon3,8 GWInnerhalb von zwölf Monaten bis Ende 2025 hinzugefügte Kapazität

Die Ausbaupläne stehen damit in einem internationalen Wettbewerb um Strom, Flächen und Rechenleistung. Dass diese Faktoren zunehmend regulatorisch relevant werden, zeigen etwa die neuen Regeln für Wasser- und Stromverbrauch von Rechenzentren in Kalifornien.

Zhenwu V900 für Cluster mit bis zu 500.000 Chips

Alibaba zufolge kann ein einzelner Rechencluster mit bis zu 500.000 Zhenwu-V900-Prozessoren aufgebaut werden. Ein solches System soll für das Training und die Inferenz von Spitzenmodellen geeignet sein. Inferenz bezeichnet dabei den produktiven Betrieb eines bereits trainierten Modells.

MerkmalZhenwu V900
Speicher216 GB
Inter-Chip-Bandbreite1.200 GB/s
Unterstützte DatenformateFP32 bis FP4
Leistung gegenüber Zhenwu M890Faktor 3 laut Alibaba
Maximale ClustergrößeBis zu 500.000 Chips laut Alibaba

Offen bleibt, wann der Zhenwu V900 in größeren Stückzahlen verfügbar sein wird. Alibaba machte auch keine Angaben dazu, wann ein Cluster in der genannten Maximalgröße betriebsbereit sein könnte.

Strategisch ist die Richtung dennoch klar. Alibaba verbindet eigene Chips, eigene Rechenzentren und eigene Basismodelle zu einer durchgängigen Plattform. Damit sinkt die Abhängigkeit von US-Hardware und von möglichen Exportbeschränkungen. Ähnliche Bestrebungen sind auch bei anderen chinesischen Anbietern sichtbar, etwa beim Huawei Ascend 960DT.

Qwen 4 befindet sich bereits im Training

Neben der Infrastruktur kündigte Alibaba den Trainingsstart von Qwen 4 an. Auf der weiteren Roadmap stehen Modelle mit 5 und 10 Billionen Parametern. Ob diese künftigen Versionen wie frühere Qwen-Modelle mit frei verfügbaren Gewichten veröffentlicht werden, ist bislang nicht bestätigt.

Das Qwen-Team untersucht außerdem Recursive Self-Improvement, kurz RSI. Dabei werden KI-Modelle eingesetzt, um an der Entwicklung neuer Modelle mitzuwirken. Alibaba spricht nach eigenen Angaben von bedeutenden Fortschritten, veröffentlichte dazu aber keine näheren technischen Ergebnisse.

Für langfristige und sehr komplexe Aufgaben könne KI Millionen Teilaufgaben auf Millionen Agenten verteilen. Menschen müssten dann vor allem Absicht und Ziel festlegen, erklärte Wu sinngemäß.

Diese Vision setzt nicht nur leistungsfähige Modelle voraus, sondern auch enorme Infrastruktur für parallel arbeitende KI-Agenten und automatisierte Forschungsarbeit. Wie effizient oder wirtschaftlich solche Systeme tatsächlich werden, lässt sich aus den Ankündigungen noch nicht ableiten.

Für DACH-Unternehmen ist Qwen wichtiger als Alibaba Cloud

Für Unternehmen im DACH-Raum dürfte Alibaba Cloud wegen DSGVO-Anforderungen, Compliance-Vorgaben und geopolitischer Risiken selten die erste Wahl sein. Zudem fehlen bislang Angaben dazu, ob ein Teil der neuen Rechenzentren in Europa entstehen soll.

Relevanter ist die Entwicklung der Qwen-Modellfamilie. Qwen spielt im globalen Open-Source- und Open-Weight-Ökosystem eine wichtige Rolle und wird auch für lokale, selbst gehostete KI-Systeme eingesetzt. Solche Modelle können eine Alternative zu dauerhaft abgerechneten API- und SaaS-Angeboten sein, sofern Hardware, Betrieb und interne Kompetenz vorhanden sind.

Die wirtschaftliche Abwägung bleibt dabei projektspezifisch. Open-Weight-Modelle können laufende Anbietergebühren und Abhängigkeiten reduzieren, verlagern aber Aufwand in Infrastruktur, Sicherheit und Wartung. Eine aktuelle Einordnung zeigt, dass Open-Weight-Modelle trotz Leistungsrückstand deutlich günstiger sein können.

Alibabas vertikale Integration stärkt diese Alternative langfristig. Entscheidend für europäische Unternehmen wird jedoch sein, ob Qwen 4 und seine Nachfolger tatsächlich mit zugänglichen Gewichten erscheinen. Bis zu einer entsprechenden Ankündigung bleibt dieser Teil der Strategie offen.