Cuộc chiến đường lối CPU thời đại Agent: Nvidia đặt cược vào "lõi đơn nhanh hơn", AMD đặt cược vào "đa nhiệm nhiều hơn"
NVIDIA và AMD đang cạnh tranh không chỉ ở việc CPU của ai nhanh hơn mà còn ở việc ai sẽ định nghĩa tiêu chuẩn đánh giá CPU trong thời đại AI.
Gần đây, NVIDIA đã công bố chi tiết kỹ thuật đầy đủ nhất về kiến trúc CPU Vera. Bộ vi xử lý này được trang bị 88 lõi Olympus ARM tự phát triển, băng thông bộ nhớ 1.2TB/s, băng thông liên kết trên chip đạt 3.4TB/s. Trọng điểm của NVIDIA là: Cách thức hoạt động của AI Agent là sự tương tác liên tục giữa CPU và GPU—gọi công cụ, thực thi mã, truy xuất dữ liệu, phối hợp nhiệm vụ—mỗi bước đều phụ thuộc vào việc hoàn thành bước trước đó, vì vậy tốc độ đơn lõi và độ trễ của CPU sẽ trực tiếp quyết định hiệu quả phản hồi của toàn bộ Agent.
Ngày 23 tháng 7, theo tin từ Sàn giao dịch đuổi gió, nhà phân tích Vivek Arya của Bank of America Securities trong báo cáo mới nhất đã chỉ ra, việc ra mắt Vera đã đưa ra một khung đánh giá mới cho ngành: “Hiệu năng đơn luồng tối đa ở quy mô lớn”. Điều này tạo nên sự so sánh trực tiếp với lối đi chiplet đa lõi mà AMD kiên định theo đuổi bấy lâu. Báo cáo này định tính cuộc tranh luận thành: “Liệu AI Agent bị giới hạn bởi thời gian hoàn thành một nhiệm vụ, hay bị giới hạn bởi số lượng tác vụ đồng thời trên một rack máy chủ?” AMD dự kiến sẽ tổ chức Ngày công nghệ AI 2026 vào thứ Năm tuần này, khi đó sẽ có phản hồi chính thức đầu tiên về khung đánh giá này.
Bối cảnh tranh luận là: Thị trường CPU máy chủ đang được tái cấu trúc bởi nhu cầu AI, dự kiến đến năm 2030 quy mô sẽ tăng khoảng 4 lần so với hiện tại, đạt tới 170 tỷ USD. Đây không phải là sự cạnh tranh trên thị trường hiện hữu mà là một thị trường mới đang hình thành, ai xây dựng được tiêu chuẩn đánh giá hiệu suất được ngành công nhận trước, người đó sẽ nắm quyền định giá và dẫn dắt câu chuyện của ngành.
Logic của NVIDIA: Quan trọng là tốc độ chạy Agent, chứ không phải là chạy cùng lúc được bao nhiêu cái
NVIDIA mô tả quy trình làm việc của Agent rất cụ thể: Khi một Agent thực hiện nhiệm vụ, sẽ xảy ra rất nhiều tương tác tuần tự giữa CPU và GPU, mỗi lượt gọi phải đợi xong bước trước mới tiếp tục. Điều này có nghĩa là, bất kỳ độ trễ nào ở một giai đoạn đều sẽ nhân lên, từ đó làm giảm hiệu quả đầu ra của toàn “nhà máy AI”.
Theo logic này, hiệu năng đơn lõi không chỉ là một con số trên bảng thông số, mà còn là biến số then chốt ảnh hưởng trực tiếp tới hiệu quả sử dụng GPU—CPU càng nhanh thì thời gian GPU chờ càng ngắn, hiệu suất sử dụng tài nguyên toàn hệ thống càng cao. Nói cách khác, đơn lõi càng nhanh thì toàn bộ chuỗi phản ứng càng nhanh.
Vera còn có một lựa chọn thiết kế đáng chú ý: NVIDIA chọn cấu trúc die đơn (monolithic die) thay vì kiến trúc chiplet tách rời, lý do vì die đơn mang lại “sự nhất quán mở rộng” tốt hơn. Điều này trái ngược với hướng chiplet mà AMD đặt cược lâu dài, đồng nghĩa hai công ty đã có sự khác biệt sâu sắc về triết lý kiến trúc nền tảng.
Ngoài ra, Vera không phải sản phẩm đơn lẻ mà là một phần hợp tác thiết kế hệ sinh thái đồng bộ AI của NVIDIA, kết hợp cùng Rubin GPU, Groq LPX, switch Spectrum, lưu trữ/mạng BlueField. Việc tích hợp cấp hệ thống này mới là “hào lũy” thực sự của NVIDIA ngoài các phép so sánh phần cứng đơn lẻ.

Phản biện của AMD: Môi trường sản xuất AI thực sự cần tới năng lực chịu tải song song
Lập trường của AMD dựa trên một định nghĩa khác về “môi trường sản xuất thực tế”.
Theo AMD, hệ thống AI ở cấp sản xuất không phải là một Agent tuần tự thực hiện nhiệm vụ, mà giống một nền tảng phần mềm phân tán gồm database, API, lưu trữ vector, engine điều phối, cache và middleware. Trong ngữ cảnh này, nút thắt cổ chai không phải là tốc độ hoàn thành từng nhiệm vụ mà là số lượng workflow hệ thống có thể đảm nhận đồng thời trong giới hạn năng lượng cố định.
AMD đưa ra những con số cụ thể: Trong mô phỏng triển khai rack máy chủ 100kW, hiệu suất throughput cấp rack của EPYC 9965 (Turin) khoảng gấp 2,4 lần chuẩn Vera của NVIDIA; thế hệ EPYC 6 (Venice) dự kiến đạt gấp 3,3 lần.
AMD lập luận: Mật độ throughput càng cao nghĩa là cùng một lượng điện có thể phục vụ nhiều người dùng hơn, xử lý nhiều yêu cầu hơn—đây mới là hàm chi phí thực cho việc triển khai AI trên cloud.
AMD x86 hay NVIDIA ARM: Đấu trường ngầm là hệ sinh thái phần mềm
Cuộc chiến kiến trúc CPU tiếp tục mở rộng sang tầng instruction set.
NVIDIA chọn kiến trúc ARM, thực chất là cho rằng: Nếu vi kiến trúc đủ tốt thì sự tương thích instruction set xếp sau. Tuy nhiên, AMD và Intel khả năng cao sẽ tiếp tục nhấn mạnh một điểm—AI đang chuyển từ inference của mô hình sang tích hợp vào workflow phần mềm doanh nghiệp, và các tầng database, middleware, nền tảng bảo mật, ứng dụng doanh nghiệp đã được tối ưu, kiểm chứng và tương thích với hệ sinh thái x86 suốt hàng chục năm.
Đây không còn là tranh luận kỹ thuật đơn thuần. Khi workload AI ngày càng “len lỏi” vào hệ IT hiện hữu của doanh nghiệp, sự kế thừa của hệ sinh thái phần mềm đôi khi còn khó thay đổi hơn cả hiệu suất đỉnh của phần cứng. Liệu NVIDIA có thể dùng Vera thâm nhập những ngữ cảnh này hay không, phụ thuộc chủ yếu vào tốc độ trưởng thành của hệ sinh thái phần mềm ARM.
Cuộc chiến tiêu chuẩn: Ai sẽ đề ra KPI CPU tiếp theo?
Hai hệ quy chiếu, hai bộ KPI—bản chất là cuộc tranh giành quyền dẫn dắt cách nhìn nhận của cả ngành.
Khung của NVIDIA xoay quanh độ trễ, tiến độ đơn luồng, hiệu suất sử dụng GPU. Khung của AMD tập trung vào concurrency, throughput, mật độ phục vụ.
Điểm mấu chốt: Cuối cùng thị trường sẽ dùng chỉ số nào để mua CPU server?
Nhận định của Bank of America là, sự kiện của AMD thứ Năm này không nhằm đưa ra điểm benchmark vượt trội mà là thuyết phục giới ngành chấp nhận hệ tiêu chuẩn của mình. Hệ khung của bên nào được các khách hàng trung tâm dữ liệu áp dụng thì bên đó sẽ có quyền định giá trong thị trường 170 tỷ USD này.
NVIDIA được Bank of America duy trì xếp hạng mua vào với giá mục tiêu 350 USD (giá hiện tại là 207,29 USD).
Tuyên bố miễn trừ trách nhiệm: Mọi thông tin trong bài viết đều thể hiện quan điểm của tác giả và không liên quan đến nền tảng. Bài viết này không nhằm mục đích tham khảo để đưa ra quyết định đầu tư.
Bạn cũng có thể thích
Vị trí tuyển dụng JOLTS của Mỹ vào tháng 8 giảm xuống mức thấp nhất trong 5 tháng, thấp hơn dự kiến trong 3 tháng liên tiếp
Số lượng vị trí việc làm còn trống tại Mỹ trong tháng 8 giảm xuống còn 7,079 triệu, thấp hơn dự báo của các nhà kinh tế là 7,228 triệu. Số vị trí trống trong ngành bất động sản và cho thuê chỉ đạt 50.000, giảm gần một nửa so với tháng trước. Tỷ lệ thôi việc duy trì ở mức 1,9%, bằng mức thấp nhất kể từ năm 2020. Tỷ lệ giữa số lượng vị trí việc làm trống và số người thất nghiệp giảm xuống còn 1,0 lần. Các nhà phân tích chỉ ra rằng số lượng tuyển dụng ròng ẩn trong JOLTS đã thấp hơn báo cáo phi nông nghiệp trong ba tháng liên tiếp, cho thấy dữ liệu phi nông nghiệp được công bố vào thứ Sáu tuần này có nguy cơ giảm mạnh.
Triển vọng vàng: Rủi ro giá vàng giao ngay bật tăng mạnh sau khi bị giảm sâu

Nhà đầu cơ lớn Burry lại nhắm đến Nvidia (NVDA.US): Chỉ trích Huang Renxun giống Palantir CEO Karp, đợt mua lại cổ phiếu trị giá 150 tỷ USD gây nghi ngờ
Michael Burry, một nhà hoài nghi nổi tiếng về cơn sốt hạ tầng AI rộng lớn và Nvidia (NVDA.US), lại tiếp tục chỉ trích nhà sản xuất chip này, so sánh CEO Jensen Huang với CEO của Palantir, Alex Karp.
