AMD Cabaran Nvidia dengan Sistem Helios AI Rack-Scale
Lisa Su membentangkan sistem Helios AMD dengan senarai pelanggan termasuk OpenAI, Meta, Oracle, Anthropic, dan Microsoft. Ini adalah cabaran langsung kepada penguasaan Nvidia dalam pasaran AI pusat data, dengan implikasi besar untuk infrastruktur AI Asia dan kos pengiraan untuk…
AMD Cabaran Nvidia dengan Sistem Helios AI Rack-Scale
Lisa Su melangkah ke atas pentas yang penuh sesak di San Francisco dan membuat klaim langsung: Helios baru AMD adalah "rak AI berprestasi tertinggi" dalam industri teknologi, dibina untuk melatih dan menjalankan model sempadan paling menuntut di dunia pada skala besar. Itu bukan pernyataan penentuan kedudukan yang halus — ia adalah cabaran langsung terhadap penguasaan Nvidia dalam pasaran AI pusat data. AMD cabaran Nvidia dengan sistem Helios AI rack-scale, dan senarai pelanggan awal mencadangkan ini bukan sekadar siaran akhbar — ia adalah perubahan tulen dalam landskap infrastruktur AI.
Apa Yang Berlaku
Pada persidangan Advancing AI AMD yang penuh sesak pada 23 Julai 2026, Pengerusi dan Ketua Pegawai Eksekutif Dr. Lisa Su secara rasmi membentangkan sistem rack-scale Helios bersama-sama dengan senarai pelanggan yang berbunyi seperti siapa saja dalam AI sempadan: OpenAI, Meta, Oracle, Anthropic, dan Microsoft. Menurut liputan TechCrunch tentang acara tersebut, Ketua Pegawai Eksekutif Microsoft Satya Nadella mengesahkan hanya beberapa hari sebelumnya bahawa Azure akan mengembangkan infrastrukturnya dengan penggunaan Helios. Anthropic pergi lebih jauh, mengumumkan perkongsian strategik dengan AMD untuk menggunakan sehingga dua gigawatt GPU melalui sistem rak baru.
Helios bukan penurunan mengejut. AMD mula mendedahkan sistem pada 2025 dan menunjukkannya di atas pentas di CES 2026 pada Januari. Apa yang baru ialah garis masa penghantaran — pelanggan akan mula menerima unit kemudian tahun ini — dan tuntutan prestasi yang menyokong keyakinan Su. The Register melaporkan bahawa Helios mengalahkan rak Vera Rubin Nvidia dalam beberapa metrik utama, yang signifikan memandangkan Vera Rubin dan Grace Blackwell telah menjadi pilihan rack-scale yang dominan untuk makmal AI besar.
Sistem rack-scale penting kerana ia menggabungkan banyak pemproses ke dalam satu unit berkuasa tinggi yang dioptimalkan untuk beban kerja pusat data — melatih model besar, menjalankan inferens pada skala, dan menangani saluran paip intensif pengiraan yang GPU individu tidak dapat mengekalkan dengan cekap. AMD juga memperkenalkan CPU Venice-X pada acara yang sama, cip pusat data yang dirancang untuk melengkapi ekosistem Helios dan menangani beban kerja pengiraan berprestasi tinggi bersama-sama dengan timbunan GPU.
Bahasa penggunaan skala gigawatt patut dihentikan. Apabila AMD mengatakan Helios akan digunakan pada "skala gigawatt," itu adalah rujukan kepada penggunaan kuasa — ini adalah sistem yang akan menarik kuasa setara dengan bandar kecil. Perjanjian Anthropic sahaja meliputi sehingga dua gigawatt. Ini bukan lelaran perkakasan tambahan. Ia adalah infrastruktur yang akan menentukan cara model AI generasi seterusnya dilatih.
Mengapa Ia Penting untuk Asia
Pembinaan infrastruktur AI Asia semakin cepat. Daripada hyperscaler di Singapura dan Jepun hingga inisiatif AI berdaulat di India, Indonesia, dan negara-negara Teluk, rantau ini berada di tengah-tengah ledakan pembinaan pusat data. Soalan bagi setiap penyedia awan dan makmal AI yang beroperasi di Asia bukan sama ada untuk melabur dalam pengiraan AI rack-scale — ia adalah timbunan mana yang perlu dipertaruhkan.
Sehingga kini, jawapan itu hampir selalu Nvidia. Kelompok GPU H100 dan H200 menjadi infrastruktur lalai untuk beban kerja AI serius di seluruh Asia, dan ekosistem CUDA Nvidia mencipta parit dalam yang menjadikan penukaran menyakitkan. Helios mengubah pengiraan, bukan kerana ia akan segera menggantikan Nvidia di Asia, tetapi kerana ia memberikan hyperscaler dan penyedia awan leverage rundingan tulen dan seni bina alternatif yang boleh dipercayai untuk dinilai.
Bagi penyedia awan Asia yang membina infrastruktur AI mereka sendiri — fikirkan pemain utama di Korea Selatan, Taiwan, Jepun, dan semakin banyak Asia Tenggara — fakta bahawa Microsoft Azure menggunakan Helios adalah isyarat yang kuat. Azure adalah salah satu platform awan yang paling banyak digunakan di seluruh rantau. Jika pengiraan yang disokong Helios menjadi tersedia melalui zon ketersediaan Asia Azure, pembangun dan syarikat di seluruh rantau akan mengaksesnya tanpa perlu mendapatkan perkakasan secara langsung.
Ada juga sudut rantai bekalan khusus untuk Asia. TSMC Taiwan mengeluarkan cip untuk AMD dan Nvidia, dan kerumitan geopolitik di sekitar bekalan semikonduktor canggih telah mendorong kerajaan dan perusahaan Asia untuk mempelbagaikan kebergantungan pengiraan AI mereka. AMD yang lebih kuat dalam pasaran rack-scale bermakna lebih banyak pilihan, lebih banyak persaingan dalam penetapan harga, dan akses yang berpotensi lebih cepat kepada pengiraan terkini untuk organisasi Asia yang secara historis berada lebih rendah dalam baris peruntukan Nvidia semasa tempoh terhad bekalan.
Bagi pengasas yang membina produk AI di Asia Tenggara, implikasi jangka sederhana adalah mudah: kos pengiraan awan untuk beban kerja AI serius harus cenderung menurun apabila persaingan sebenar memasuki pasaran rack-scale. Itu penting sangat bagi permulaan yang sedang membuat pertukaran sukar antara keupayaan model dan kos inferens.
Apa Maksud Ini untuk Pembangun
Persaingan perkakasan pada skala rak akhirnya mengalir ke bawah kepada setiap pembangun yang menyentuh API, menjalankan kerja penyesuaian halus, atau menggunakan model dalam pengeluaran. Pengumuman Helios mempunyai beberapa implikasi konkrit yang patut dipikirkan.
Kos inferens akan berubah. Apabila OpenAI, Anthropic, dan Meta menggunakan Helios pada skala gigawatt, mereka membina kapasiti yang akan melayani lalu lintas API. Lebih banyak kapasiti pengiraan daripada ekosistem perkakasan yang kompetitif bermakna penyedia mempunyai lebih banyak ruang untuk mengurangkan penetapan harga setiap token. Jika anda membina aplikasi di atas API model sempadan — yang kebanyakan pembangun di Asia lakukan — ini adalah berita yang baik secara arah untuk ekonomi unit anda.
Ekosistem ROCm menjadi lebih serius. Timbunan perisian AMD untuk pengiraan GPU, ROCm, secara historis ketinggalan CUDA dalam kematangan alatan dan sokongan komuniti. Tetapi apabila Anthropic dan OpenAI berkomitmen kepada Helios pada skala ini, mereka juga berkomitmen sumber kejuruteraan untuk membuat saluran paip latihan dan inferens mereka berfungsi pada perkakasan AMD. Pelaburan itu cenderung meningkatkan ekosistem yang lebih luas. Pembangun yang ingin menjalankan model sumber terbuka pada GPU AMD — sama ada di tempat atau melalui contoh awan — akan mendapat manfaat daripada kerja kejuruteraan yang makmal ini masukkan ke dalam keserasian AMD.
Sokongan rangka kerja akan mengikuti perkakasan. PyTorch, JAX, dan rantai alatan ML yang lebih luas mengikuti ke mana pengiraan serius pergi. Perhatikan sokongan AMD yang ditingkatkan dalam perpustakaan latihan dan masa jalan inferens selama 12-18 bulan seterusnya apabila penggunaan Helios meningkat. Jika anda membina aplikasi asli AI pada MonstarX atau platform lain yang duduk di atas infrastruktur awan, persaingan perkakasan asas diterjemahkan kepada model asas yang lebih mampu dan cekap kos untuk dibina.
Penggunaan model sumber terbuka menjadi lebih mudah diakses. Salah satu kesan hiliran yang lebih menarik daripada dorongan AMD adalah apa yang dilakukannya untuk pembangun yang ingin menghoskan sendiri model sumber terbuka. Apabila ketersediaan GPU AMD meningkat melalui penyedia awan, menjalankan Llama, Mistral, atau model berat terbuka lain pada contoh AMD menjadi lebih berdaya maju. Bagi pasukan di Asia yang memerlukan pematuhan kediaman data — keperluan biasa di seluruh pasaran seperti India, Jepun, Korea Selatan, dan semakin banyak Asia Tenggara — inferens yang dihoskan sendiri pada contoh awan AMD boleh menjadi jalan praktikal yang tidak tersedia sebelumnya.
Nasihat praktikal untuk pembangun sekarang: perhatikan nota keluaran ROCm AMD, jejaki penyedia awan mana yang mengumumkan contoh yang disokong Helios di rantau Asia, dan mulai menguji beban kerja inferens anda pada perkakasan AMD jika anda mempunyai lebar jalur. Pengadopsi awal infrastruktur pengiraan baru cenderung mendapatkan penetapan harga dan sokongan yang lebih baik.
Pengambilan Kunci
Inilah yang perlu dipegang daripada pengumuman Helios:
- Helios adalah perkakasan sebenar dengan pelanggan sebenar.