AMD Thách Thức Nvidia với Hệ Thống Helios AI Rack-Scale

Lisa Su công bố hệ thống Helios AI rack-scale của AMD với danh sách khách hàng bao gồm OpenAI, Meta, Oracle, Anthropic, và Microsoft. Đây là thách thức trực tiếp đối với sự thống trị của Nvidia trên thị trường AI data center, mang lại cơ hội mới cho các nhà phát triển và doanh…

Share
Editorial illustration: Two industrial server racks standing side-by-side in stark contrast—one casting a sharp shadow over  — MonstarX

AMD Thách Thức Nvidia với Hệ Thống Helios AI Rack-Scale

Lisa Su bước lên sân khấu đầy khán giả ở San Francisco và đưa ra một tuyên bố trực tiếp: Helios mới của AMD là "rack AI có hiệu suất cao nhất" của ngành công nghệ, được xây dựng để huấn luyện và chạy các mô hình biên giới đòi hỏi khắt khe nhất thế giới ở quy mô khổng lồ. Đây không phải là một tuyên bố định vị tinh tế — đó là một thách thức trực tiếp đối với sự thống trị của Nvidia trên thị trường AI data center. AMD thách thức Nvidia với hệ thống Helios AI rack-scale, và danh sách khách hàng ban đầu cho thấy đây không chỉ là một bản tin báo chí — đó là một sự thay đổi thực sự trong bối cảnh cơ sở hạ tầng AI.

Điều Gì Đã Xảy Ra

Tại hội nghị Advancing AI của AMD đầy khán giả vào ngày 23 tháng 7 năm 2026, Chủ tịch và CEO Dr. Lisa Su chính thức công bố hệ thống rack-scale Helios cùng với danh sách khách hàng đọc như danh sách những người nổi tiếng của AI biên giới: OpenAI, Meta, Oracle, Anthropic, và Microsoft. Theo báo cáo của TechCrunch về sự kiện này, CEO Microsoft Satya Nadella xác nhận chỉ vài ngày trước đó rằng Azure sẽ mở rộng cơ sở hạ tầng của mình với các triển khai Helios. Anthropic đi xa hơn, công bố một quan hệ đối tác chiến lược với AMD để triển khai tới hai gigawatt GPU thông qua hệ thống rack mới.

Helios không phải là một bất ngờ. AMD lần đầu tiên công bố hệ thống vào năm 2025 và trình diễn nó trên sân khấu tại CES 2026 vào tháng 1. Điều mới là lịch trình vận chuyển — khách hàng sẽ bắt đầu nhận các đơn vị vào cuối năm nay — và những tuyên bố hiệu suất hỗ trợ sự tự tin của Su. The Register báo cáo rằng Helios vượt qua rack Vera Rubin của Nvidia theo một số chỉ số chính, điều này có ý nghĩa vì Vera Rubin và Grace Blackwell đã là những tùy chọn rack-scale chiếm ưu thế cho các phòng thí nghiệm AI lớn.

Các hệ thống rack-scale quan trọng vì chúng kết hợp nhiều bộ xử lý thành một đơn vị mạnh mẽ được tối ưu hóa cho các khối lượng công việc data center — huấn luyện các mô hình lớn, chạy suy luận ở quy mô lớn, và xử lý các đường ống tính toán yêu cầu cao mà các GPU riêng lẻ đơn giản không thể duy trì hiệu quả. AMD cũng giới thiệu CPU Venice-X tại cùng sự kiện, một chip data center được thiết kế để bổ sung cho hệ sinh thái Helios và xử lý các khối lượng công việc máy tính hiệu suất cao cùng với ngăn xếp GPU.

Ngôn ngữ triển khai quy mô gigawatt đáng để dừng lại. Khi AMD nói Helios sẽ được triển khai ở "quy mô gigawatt", đó là một tham chiếu đến tiêu thụ điện — đây là những hệ thống sẽ tiêu thụ điện tương đương với các thành phố nhỏ. Thỏa thuận Anthropic một mình bao gồm tới hai gigawatt. Đây không phải là lặp lại phần cứng tăng dần. Đó là cơ sở hạ tầng sẽ định hình cách các mô hình AI thế hệ tiếp theo được huấn luyện.

Tại Sao Điều Này Quan Trọng Đối Với Châu Á

Việc xây dựng cơ sở hạ tầng AI của Châu Á đang tăng tốc nhanh chóng. Từ các nhà cung cấp siêu quy mô ở Singapore và Nhật Bản đến các sáng kiến AI có chủ quyền ở Ấn Độ, Indonesia, và các quốc gia Vùng Vịnh, khu vực này đang ở giữa một cuộc bùng nổ xây dựng data center. Câu hỏi cho mọi nhà cung cấp đám mây và phòng thí nghiệm AI hoạt động ở Châu Á không phải là liệu có nên đầu tư vào tính toán AI rack-scale — mà là ngăn xếp nào để đặt cược.

Cho đến bây giờ, câu trả lời gần như luôn là Nvidia. Các cụm GPU H100 và H200 trở thành cơ sở hạ tầng mặc định cho các khối lượng công việc AI nghiêm túc trên khắp Châu Á, và hệ sinh thái CUDA của Nvidia tạo ra một rào cản sâu khiến việc chuyển đổi trở nên khó khăn. Helios thay đổi tính toán, không phải vì nó sẽ ngay lập tức thay thế Nvidia ở Châu Á, mà vì nó cung cấp cho các nhà cung cấp siêu quy mô và nhà cung cấp đám mây sức mạnh đàm phán thực sự và một kiến trúc thay thế đáng tin cậy để đánh giá.

Đối với các nhà cung cấp đám mây Châu Á xây dựng cơ sở hạ tầng AI của riêng họ — hãy nghĩ về những người chơi chính ở Hàn Quốc, Đài Loan, Nhật Bản, và ngày càng tăng ở Đông Nam Á — thực tế là Microsoft Azure đang chấp nhận Helios là một tín hiệu mạnh mẽ. Azure là một trong những nền tảng đám mây được sử dụng rộng rãi nhất trên toàn khu vực. Nếu tính toán được hỗ trợ bởi Helios trở nên khả dụng thông qua các vùng khả dụng Châu Á của Azure, các nhà phát triển và công ty trên toàn khu vực sẽ truy cập nó mà không cần phải mua phần cứng trực tiếp.

Cũng có một góc cạnh chuỗi cung ứng cụ thể đối với Châu Á. TSMC của Đài Loan sản xuất chip cho cả AMD và Nvidia, và sự phức tạp địa chính trị xung quanh nguồn cung cấp bán dẫn tiên tiến đã thúc đẩy các chính phủ và doanh nghiệp Châu Á đa dạng hóa các phụ thuộc tính toán AI của họ. Một AMD mạnh hơn trên thị trường rack-scale có nghĩa là nhiều tùy chọn hơn, cạnh tranh nhiều hơn về giá cả, và có khả năng truy cập nhanh hơn vào tính toán tiên tiến cho các tổ chức Châu Á đã từng ở vị trí thấp hơn trong hàng đợi phân bổ của Nvidia trong các giai đoạn hạn chế nguồn cung cấp.

Đối với những người sáng lập xây dựng các sản phẩm AI ở Đông Nam Á, hàm ý trung hạn rất đơn giản: chi phí tính toán đám mây cho các khối lượng công việc AI nghiêm túc sẽ xu hướng giảm khi cạnh tranh thực sự vào thị trường rack-scale. Điều này quan trọng rất nhiều đối với các công ty khởi nghiệp hiện đang thực hiện những sự đánh đổi khó khăn giữa khả năng mô hình và chi phí suy luận.

Điều Này Có Ý Nghĩa Gì Đối Với Các Nhà Phát Triển

Cạnh tranh phần cứng ở quy mô rack cuối cùng sẽ chảy xuống dòng cho mọi nhà phát triển chạm vào API, chạy công việc tinh chỉnh, hoặc triển khai mô hình trong sản xuất. Thông báo Helios có một vài hàm ý cụ thể đáng để suy nghĩ.

Chi phí suy luận sẽ thay đổi. Khi OpenAI, Anthropic, và Meta triển khai Helios ở quy mô gigawatt, họ đang xây dựng dung lượng sẽ phục vụ lưu lượng API. Dung lượng tính toán nhiều hơn từ một hệ sinh thái phần cứng cạnh tranh có nghĩa là các nhà cung cấp có nhiều chỗ hơn để giảm giá cả mỗi token. Nếu bạn đang xây dựng các ứng dụng trên các API mô hình biên giới — điều mà hầu hết các nhà phát triển ở Châu Á đang làm — đây là tin tức tốt theo hướng cho kinh tế học đơn vị của bạn.

Hệ sinh thái ROCm trở nên nghiêm túc hơn. Ngăn xếp phần mềm của AMD cho máy tính GPU, ROCm, về lịch sử đã tụt hậu CUDA trong độ trưởng thành công cụ và hỗ trợ cộng đồng. Nhưng khi Anthropic và OpenAI cam kết với Helios ở quy mô này, họ cũng cam kết các tài nguyên kỹ thuật để làm cho các đường ống huấn luyện và suy luận của họ hoạt động trên phần cứng AMD. Khoản đầu tư đó có xu hướng cải thiện hệ sinh thái rộng hơn. Các nhà phát triển muốn chạy các mô hình nguồn mở trên GPU AMD — cho dù tại chỗ hay thông qua các phiên bản đám mây — sẽ được hưởng lợi từ công việc kỹ thuật mà các phòng thí nghiệm này đưa vào khả năng tương thích AMD.

Hỗ trợ framework sẽ theo dõi phần cứng. PyTorch, JAX, và chuỗi công cụ ML rộng hơn theo dõi nơi tính toán nghiêm túc diễn ra. Hãy chú ý đến hỗ trợ AMD được cải thiện trong các thư viện huấn luyện và thời gian chạy suy luận trong 12-18 tháng tới khi các triển khai Helios tăng tốc. Nếu bạn đang xây dựng các ứng dụng AI-native trên MonstarX hoặc bất kỳ nền tảng nào khác nằm trên cơ sở hạ tầng đám mây, cạnh tranh phần cứng cơ bản dịch thành các mô hình nền tảng có khả năng và hiệu quả chi phí hơn để xây dựng.

Triển khai mô hình nguồn mở trở nên dễ tiếp cận hơn. Một trong những hiệu ứng hạ lưu thú vị hơn của sự thúc đẩy của AMD là những gì nó làm cho các nhà phát triển muốn tự lưu trữ các mô hình nguồn mở. Khi tính khả dụng GPU AMD tăng thông qua các nhà cung cấp đám mây, chạy Llama, Mistral, hoặc các mô hình trọng lượng mở khác trên các phiên bản AMD trở nên khả thi hơn. Đối với các nhóm ở Châu Á cần tuân thủ cư trú dữ liệu — một yêu cầu phổ biến trên các thị trường như Ấn Độ, Nhật Bản, Hàn Quốc, và ngày càng tăng ở Đông Nam Á — suy luận tự lưu trữ trên các phiên bản đám mây AMD có thể trở thành một con đường thực tế không có sẵn trước đây.

Lời khuyên thực tế cho các nhà phát triển ngay bây giờ: theo dõi các ghi chú phát hành ROCm của AMD, theo dõi những nhà cung cấp đám mây nào công bố các phiên bản được hỗ trợ bởi Helios ở các khu vực Châu Á, và bắt đầu kiểm tra các khối lượng công việc suy luận của bạn trên phần cứng AMD nếu bạn có băng thông. Những người chấp nhận sớm cơ sở hạ tầng tính toán mới có xu hướng nhận được giá cả và hỗ trợ tốt hơn.

Những Điểm Chính Cần Ghi Nhớ

Đây là những gì cần giữ từ thông báo Helios:

  • Helios là phần cứng thực với khách hàng thực.