Huawei Technologies secara resmi meluncurkan pengiriman komersial dari generasi berikutnya menaikkan 960 prosesor kecerdasan buatan hari ini, mengeluarkan silikon kompute di perusahaan besar di Shenzhen, Shanghai, dan Beijing. Prosesor ini menunjukkan akselerasi AI yang paling canggih yang direkayasa di dalam negeri untuk memasuki produksi, menargetkan model bahasa besar sebelum pelatihan dan perusahaan kongree tinggi yang jatuh.

Menghadapi batasan ekspor internasional yang gigih pada ultraviolet ekstrim yang canggih (EUV) alat litografi, lengan desain semikonduktor Huawei, HiSilicon, merekayasa Ascend 960 menggunakan arsitektur perkembangan multi- die 'chiplet'. Dengan menjahit ubin komputasi padat bersama-sama dengan memori tinggi-bandwidth (HBM) menggunakan penghubung substrat domestik 2.5D, chipnya mencapai 45 persen peningkatan bandwidth interdirectional-chip atas Ascend 910B sebelumnya.

Spesifikasi Arsitektur dan Performa Cluster

Ascend 960 adalah rekayasa untuk skabilitas cluster besar. Dalam arsitektur pusat data Huawei yang dimiliki Cloud Brain III, hingga dengan 8,192 akselerator dapat terhubung menggunakan switch optik rendah-latency, memberikan daya komputasi agresif disesuaikan untuk pelatihan trillion-parameter model generatif.

Huawei Naik 960 Specifications Teknis vs Ascend 910B
Fitur silikon Mendaki 910B (Gen Prior) Mendaki 960 (Penyebaran Baru) Keuntungan Arsitektur
Arsitektur Paket Monolitik 2D planar mati Stacking chiplet multi- die 3D Hasil yang lebih tinggi dan kepadatan kompute
Memori Paket On- 32GB HBM2e 96GB HBM3 -ekuivalen Residensi parameter 3x lebih besar
Bandwidth Terhubung 392 GB / s bidirectional 570 GB / s bidirectional Sinkronisasi tensor 45% lebih tinggi
FP16 Compute Density 320 TFLOPS 640 TFLOPS Dua matriks padat melalui put
Ukuran Cluster 4.096 chip per pod 8,192 chip per pod Paraletisme superkomputasi-skala

Perangkat Lunak Ekosistem dan CANN 8.0

Kemampuan perangkat keras dalam percepatan AI bergantung pada dukungan kompiler dan perangkat lunak ekosistem. Di samping peluncuran silikon, Huawei menerbitkan versi 8.0 dari Arsitektur Komputer untuk Neural Networks (CANN). Tumpukan perangkat lunak yang diperbarui termasuk lapisan terjemahan otomatis untuk PyTorch dan Triton, memungkinkan pengembang perusahaan untuk pelabuhan model model dilatih pada lingkungan CUDA Barat dengan sedikit kode manual refaktoring.

Operator telekomunikasi, lembaga keuangan negara, dan perusahaan mengemudi otonom di seluruh Asia Timur telah mulai bermigrasi ke pusat awan Ascend 960, mengutip kebutuhan otonomi rantai pasokan dalam infrastruktur komputasi tinggi.

Implikasi Pasar

Industri mencatat bahwa sementara hasil rekayasa pada prosesor multi- die yang maju tetap menantang dibandingkan dengan memimpin pendiri global, ketersediaan komersial dari garis bawah Ascend 960 bagaimana solusi rekayasa domestik memperkecil kesenjangan kinerja operasional di perusahaan AI.

Sources