Blog / AI / Deep Article
Huawei trình làng siêu nút Ascend 960 dùng NPO, chip AI Ascend 960DT đẩy sớm lên Q1 năm sau
Huawei vừa chính thức công bố siêu nút Ascend 960, đánh dấu lần đầu tiên hãng này đưa kiến trúc NPO vào một sản phẩm thương mại. Song song đó, chip AI Ascend 960DT — vốn được kỳ vọng ra mắt muộn hơn — sẽ được đẩy sớm lên quý 1 năm sau (https://www.cls.cn/detail/2485945). Đây không phải một thông cáo sản phẩm thông thường. Nó là tín hiệu cho thấy Huawei đang tăng tốc trong cuộc đua hạ tầng AI, giữa lúc các ông lớn như Nvidia, Google và Microsoft vẫn đang kiểm soát phần lớn chuỗi cung ứng toàn cầu.
Điều đáng nói là cả hai sự kiện — siêu nút Ascend 960 dùng NPO và việc Ascend 960DT rút ngắn lịch trình — đều xuất hiện trong cùng một dòng tin ngắn từ CLS (https://www.cls.cn/detail/2485945), rồi nhanh chóng được cộng đồng công nghệ Trung Quốc mổ xẻ trên Zhihu (https://www.zhihu.com/question/2083874290466821167). Câu hỏi mà giới kỹ thuật đặt ra không phải "Huawei có làm được không", mà là "NPO thực chất là gì, và vì sao nó lại quan trọng đến mức Huawei phải đẩy chip đi kèm lên sớm".
Trước khi bàn đến Ascend 960, cần nói thẳng: NPO là điểm mấu chốt của toàn bộ câu chuyện. Trong hạ tầng AI quy mô lớn, nút thắt cổ chai nằm ở giao tiếp giữa các chip, không phải ở bản thân từng con chip. Một cụm huấn luyện với hàng nghìn GPU có thể mất phần lớn thời gian cho việc đồng bộ trọng số thay vì tính toán thực sự.
Huawei gọi Ascend 960 là "siêu nút" (超节点) — tức một đơn vị tính toán được thiết kế để mở rộng theo chiều ngang mà không đánh đổi băng thông liên kết. Việc đưa NPO vào đây cho thấy Huawei đang nhắm vào đúng chỗ mà Nvidia xây dựng lợi thế bằng NVLink và InfiniBand: kết nối nội bộ cụm. Nếu NPO hoạt động đúng như kỳ vọng, Huawei có thể giảm phụ thuộc vào các giải pháp mạng nhập khẩu — một yếu tố sống còn khi các lệnh trừng phạt của Mỹ vẫn siết chặt nguồn cung linh kiện tiên tiến.
Thực tế là, theo dòng tin từ CLS (https://www.cls.cn/detail/2485945), đây là "siêu nút Ascend 960 đầu tiên sử dụng NPO". Chữ "đầu tiên" đáng để dừng lại. Nó ngụ ý Huawei đã thử nghiệm NPO ở quy mô nhỏ trước đó, và Ascend 960 là bước thương mại hóa chính thức. Vấn đề là: hiệu năng thực tế của NPO so với NVLink thế hệ mới vẫn chưa có dữ liệu công khai. Không ai ngoài Huawei biết băng thông, độ trễ, hay mức tiêu thụ điện của kiến trúc này.
Câu hỏi thật sự là: nếu NPO chỉ ngang bằng chứ không vượt NVLink, liệu Huawei có đủ sức thuyết phục các ông lớn cloud Trung Quốc như Alibaba hay Tencent chuyển dịch hạ tầng sang hay không?
Việc Ascend 960DT được đẩy lên quý 1 năm sau là chi tiết đáng phân tích hơn cả bản thân siêu nút. Theo thông tin từ CLS (https://www.cls.cn/detail/2485945), Huawei đã quyết định rút ngắn lịch trình ra mắt chip AI mới. Trong ngành bán dẫn, đẩy sớm một sản phẩm phức tạp hiếm khi là quyết định dễ dàng. Nó thường đến từ một trong hai lý do: hoặc tiến độ nội bộ tốt hơn dự kiến, hoặc có áp lực cạnh tranh buộc phải ra sớm.
Nhìn vào bối cảnh rộng hơn — được ghi rõ là bối cảnh, không phải facts từ nguồn — thị trường chip AI toàn cầu đang nóng lên từng quý. Nvidia liên tục tung ra các thế hệ mới, Google đẩy mạnh TPU, Microsoft và Meta tự phát triển silicon riêng. Trong bức tranh đó, việc Huawei đẩy Ascend 960DT lên Q1 năm sau là động thái buộc phải làm nếu muốn giữ chân khách hàng nội địa.
Đáng nói là trên Zhihu, câu hỏi về Ascend 960DT thu hút sự quan tâm đáng kể (https://www.zhihu.com/question/2083874290466821167), cho thấy giới kỹ thuật Trung Quốc đang theo dõi sát sao từng bước đi của Huawei. Họ không chỉ hỏi về thông số, mà về khả năng thay thế thực sự các giải pháp phương Tây trong các workload huấn luyện mô hình lớn.
Với các doanh nghiệp Việt Nam đang cân nhắc hạ tầng AI — từ các công ty fintech ở TP.HCM đến các trung tâm dữ liệu tại Hà Nội — câu chuyện Huawei đặt ra một lựa chọn chiến lược. Nếu Ascend 960DT thực sự ra mắt đúng Q1 và có hiệu năng cạnh tranh, nó trở thành phương án thay thế khả thi cho các cụm GPU vốn đắt đỏ và khan hiếm. Nhưng nếu NPO chưa được chứng minh ở quy mô production, việc đặt cược vào hệ sinh thái Huawei là canh bạc lớn.
Vấn đề là: một lập trình viên Việt Nam làm MLOps hôm nay có nên bắt đầu học hệ sinh thái Ascend/CANN hay tiếp tục trung thành với CUDA?
Một sai lầm phổ biến khi bàn về chip AI là chỉ nhìn vào TOPS hay băng thông bộ nhớ. Câu chuyện thật sự nằm ở phần mềm. Nvidia giữ vị thế thống trị không chỉ vì GPU mạnh, mà vì CUDA đã trở thành tiêu chuẩn de facto trong hơn một thập kỷ. Huawei có CANN — nền tảng tính toán của riêng họ — nhưng mức độ trưởng thành và hệ sinh thái thư viện vẫn là câu hỏi mở.
Việc Ascend 960 dùng NPO và Ascend 960DT ra sớm cho thấy Huawei đang giải quyết bài toán phần cứng trước. Nhưng nếu phần mềm không theo kịp, người dùng sẽ gặp đúng vấn đề mà các nhà phát triển từng gặp khi thử chuyển từ CUDA sang ROCm của AMD: chạy được, nhưng đau đớn.
Theo dòng tin trên Zhihu (https://www.zhihu.com/question/2083874290466821167), cộng đồng kỹ thuật Trung Quốc đang đặt câu hỏi về "những thông tin nào đáng chú ý" xung quanh Ascend 960DT. Cách đặt câu hỏi như vậy cho thấy họ chưa có câu trả lời rõ ràng — nghĩa là Huawei vẫn chưa công bố đủ chi tiết kỹ thuật để giới chuyên môn đánh giá độc lập.
Thực tế là, với các doanh nghiệp Việt Nam đang xây dựng pipeline AI, việc chọn hệ sinh thái không chỉ là chuyện giá chip. Nó là chuyện tuyển dụng, đào tạo, và khả năng tìm kiếm kỹ sư có kinh nghiệm. Một startup AI ở Việt Nam hôm nay tuyển kỹ sư CUDA dễ hơn nhiều so với tuyển kỹ sư CANN. Đó là rào cản thực tế mà Huawei phải vượt qua, không chỉ ở Trung Quốc mà ở toàn bộ Đông Nam Á.
Liệu Huawei có đủ kiên nhẫn để xây dựng hệ sinh thái phần mềm trong 5 năm tới, hay họ sẽ chọn cách ép thị trường nội địa chuyển dịch bằng quan hệ chính trị?
Có ba điểm cần theo dõi, và cả ba đều chưa có câu trả lời từ nguồn chính thức.
Thứ nhất, thông số kỹ thuật của NPO. Nếu Huawei công bố băng thông và độ trễ cụ thể, giới phân tích sẽ có cơ sở so sánh với NVLink. Nếu họ giữ kín, đó là dấu hiệu con số chưa đủ đẹp để khoe.
Thứ hai, danh sách khách hàng đầu tiên của siêu nút Ascend 960. Ai mua? Các ông lớn cloud Trung Quốc, các viện nghiên cứu, hay các công ty AI tư nhân? Danh sách này sẽ tiết lộ mức độ tin cậy thực sự của sản phẩm.
Thứ ba, lịch trình chính xác của Ascend 960DT trong Q1. "Đẩy sớm lên Q1" là một khoảng thời gian rộng ba tháng. Nếu Huawei công bố ngày cụ thể trong vài tuần tới, đó là tín hiệu tiến độ nội bộ vững. Nếu họ tiếp tục nói "Q1" mà không cam kết, khả năng trượt lịch trình là có thật.
Với thị trường Việt Nam, đây không phải câu chuyện xa vời. Các trung tâm dữ liệu tại Việt Nam đang trong giai đoạn mở rộng mạnh, và mỗi quyết định về nền tảng chip AI sẽ ảnh hưởng đến chi phí vận hành trong nhiều năm. Nếu Ascend 960DT thực sự cạnh tranh được về giá trên hiệu năng, nó có thể trở thành lựa chọn cho các doanh nghiệp Việt muốn giảm phụ thuộc vào chuỗi cung ứng phương Tây — nhưng chỉ khi phần mềm đủ chín.
Câu hỏi cuối cùng, và có lẽ là câu hỏi khó nhất: liệu Huawei có thể biến NPO từ một tính năng kỹ thuật thành một tiêu chuẩn công nghiệp, hay nó sẽ chỉ là giải pháp cục bộ cho thị trường Trung Quốc?