InquirerPalace to Pia Cayetano on fear for her liberty: Is this paranoia? Don’t panicESPNCavaliers promote Weems to take over GM roleRTP DesportoUEFA e CONCACAF pedem dados à FIFA sobre projeto de privatizar MundiaisESPN Deportes¿Con un Joel Embiid saludable, los 76ers son imparables?Daily MaverickAGE OF ACCOUNTABILITY: Five criminal cases later, Ekurhuleni fires Julius MkhwanaziThe Jerusalem PostSaudi Aramco suspends European crude deliveries after East-West pipeline attack - reportוואלהבן 30 נפל מסוס באום אל פחם: מצבו קשהComplete Sports‘He Has To Go’ –Germany FA Tells InfantinoGlobal NewsOttawa mayoral candidate charged for alleged death threats against Sutcliffe, FordNOSAmerikaanse sancties raken vooral middenstand Iran: 'Geen mens kan dit volhouden'الشرقمعارك شمال كردفان.. الجيش السوداني يوسع انتشاره حول سودريWirtualna PolskaSypią się donosy. Kto w Polsce donosi najczęściej?
The Daily Newsstand · Free, Always
Friday, September 18, 2026

Huawei packt 4096 KI-Beschleuniger in einen riesigen Server

Translate

Huawei stellt seine nächste Generation von KI-Beschleunigern schneller fertig als angenommen. Den fürs Training von KI-Modellen gedachten Ascend 960DT will die chinesische Firma bereits im ersten Quartal 2027 ausliefern. Der für Inferenz angepasste Ascend 960PR folgt voraussichtlich im dritten Quartal 2027.

Der Ascend 960DT ist der erste öffentlich bekannte Huawei-Beschleuniger mit High Bandwidth Memory (HBM). 288 GByte verteilen sich auf acht Speicherstapel. Alle zusammen kommen auf eine Übertragungsrate von 9,6 TByte/s. Fraglich ist, woher der Speicher stammt. HBM3e des chinesischen Herstellers CXMT käme in kleiner Auflage infrage.

Hand hält einen Chip

Huaweis Ascend 960DT mit zwei Compute-Chiplets, acht HBM-Stapeln und zwei Engines für optische Signale.

(Bild: Sohu.com)

Huawei nennt eine maximale Rechenleistung von vier Billiarden Operationen pro Sekunde (4 Petaflops) im simplen Gleitkomma-Zahlenformat FP4. Zu ganzzahligen INT-Operationen macht die Firma keinerlei Angaben.

Der Ascend 960PR verdoppelt die FP4-Rechenleistung zulasten des Speicherausbaus. Huawei nennt 192 GByte mit 2,4 TByte/s Transferrate. Einer ersten Illustration zufolge könnte hier günstigeres LPDDR-RAM anstelle von HBM zum Einsatz kommen. Dieser Wechsel ist für Inferenz branchenüblich.

Foto einer Huawei-Präsentation

Huaweis Ascend-Roadmap, fotografiert auf der Huawei Connect 2026 in Shanghai.

(Bild: „tuolaji2024“ / X)

Weil Huawei leistungsmäßig Branchengrößen wie AMD und Nvidia hinterherhinkt, skaliert das Unternehmen weiter in die Breite. Ein Atlas 960E Superpod nimmt bis zu 4096 Ascend-960-Beschleuniger auf. Er kommt so auf eine maximale Rechenleistung von 16 Exaflops und im Falle der DT-Chips auf über ein Petabyte HBM-Kapazität. Den Weg in die Breite geht Huawei schon seit der Ascend-910c-Generation.

Zum Vergleich: Eine einzelne Rubin-GPU von Nvidia schafft bis zu 50 FP4-Pflops, AMDs Instinct MI455X 40 FP4-Pflops. Auf einen dieser Beschleuniger kommen also mindestens zehn Ascend 960DT.

Details zum technischen Aufbau und der elektrischen Leistungsaufnahme verschweigt Huawei wie üblich. Fertigungsseitig ist die Firma aufgrund von Exporteinschränkungen erheblich eingeschränkt. Der chinesische Auftragsfertiger SMIC kann Chips mit 7-Nanometer-Strukturbreiten herstellen. Nvidia steht dagegen bei 3 nm, AMD sogar schon bei 2 nm.

Für die Skalierung setzt Huawei auf optische Verbindungen zwischen den Beschleunigern und Boards. Dafür befinden sich seitlich auf den Chips Engines, die optische Signale in elektrische umwandeln. Huawei will seine Beschleuniger künftig über einen Superpod hinaus skalieren. Eine Million Ascend-Chips in einem riesigen System sind das Ziel.

Neue Beschleunigergenerationen sollen künftig jährlich erscheinen. 2028 steht der Ascend 970 mit 14 FP4-Pflops und schnellerem Speicher an. Der Ascend 980 für 2029 soll die Leistung verdoppeln und mit 384 GByte Speicher bei 38,4 TByte/s Transferrate erscheinen.

View the original on heise online

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.