Công bố hiệu suất chip AI tự phát triển của OpenAI và so sánh trực tiếp với GPU của Nvidia
Google, Amazon, Meta, MS cũng phát triển chip riêng, mở rộng thị trường bán dẫn tùy chỉnh
Trong bối cảnh thị trường trí tuệ nhân tạo (AI) vẫn đang bị Nvidia chiếm ưu thế, các công ty công nghệ lớn đang mua sắm GPU của Nvidia với số lượng lớn trong khi cũng đẩy nhanh việc phát triển chip AI riêng. Việc này được hiểu là nhằm tăng cường hiệu quả chi phí và tiết kiệm năng lượng bằng cách sở hữu chip phù hợp với đặc điểm tính toán của mình.
Theo thông tin từ ngành công nghiệp vào ngày 27, OpenAI đã công bố kết quả đo hiệu suất đầu tiên của chip AI tự phát triển mang tên 'HalaPeño' vào ngày 25 tháng 8 (theo giờ địa phương). OpenAI cho biết HalaPeño đã vượt trội hơn cả về hiệu suất xử lý trên mỗi watt và thời gian phản hồi so với các mẫu chip Nvidia GB200 và GB300. Trong các thử nghiệm với mô hình đã công bố, hiệu suất xử lý trên mỗi watt của HalaPeño cao hơn từ 1,5 đến 1,9 lần và thời gian phản hồi thấp hơn từ 1,7 đến 3,6 lần so với hệ thống so sánh. Tuy nhiên, do đây là kết quả tự đánh giá, nên khả năng cạnh tranh thực sự cần được xác minh trong môi trường thương mại trong tương lai.
OpenAI dự kiến sẽ triển khai HalaPeño vào cơ sở hạ tầng tính toán của mình từ cuối năm nay. Đồng thời, họ cũng cho biết sẽ tiếp tục sử dụng các gia tốc viên bên ngoài, bao gồm cả Nvidia, cho việc học tập và suy luận. Chip tự phát triển sẽ không thay thế GPU của Nvidia mà sẽ được sử dụng song song với nhiều gia tốc viên khác tùy theo mục đích.
Việc phát triển chip riêng không chỉ là động thái của OpenAI. Google đã phát triển gia tốc viên AI riêng TPU để sử dụng trong trung tâm dữ liệu. Amazon phát triển Trainium và Inferentia, đồng thời cung cấp GPU của Nvidia trong dịch vụ đám mây. Meta đang mở rộng chip AI riêng MTIA và cũng thu mua chip từ Nvidia và AMD. Microsoft cũng áp dụng chiến lược kết hợp giữa gia tốc viên AI riêng Maia và GPU bên ngoài.
Một trong những lý do lớn nhất khiến các công ty công nghệ lớn phát triển chip riêng là chi phí suy luận AI. Khi số lượng người dùng dịch vụ AI tăng lên, khối lượng tính toán cần thiết cho cả học tập và suy luận cũng gia tăng nhanh chóng. GPU đa năng có thể xử lý nhiều loại tính toán khác nhau, nhưng không cung cấp hiệu suất và hiệu quả năng lượng đồng nhất cho tất cả các tác vụ. Việc thiết kế chip phù hợp với dịch vụ của mình có thể giúp xử lý các phép toán lặp lại với ít năng lượng hơn.
Đặc biệt, suy luận được coi là lĩnh vực mà hiệu quả của chip tự phát triển có thể được thể hiện rõ ràng. Trong khi học tập yêu cầu tính linh hoạt để xử lý nhiều mô hình và phép toán khác nhau, suy luận lại là công việc thực hiện lặp đi lặp lại các mô hình đã học, do đó có thể tối ưu hóa cho các mô hình và dịch vụ cụ thể. Việc OpenAI phát triển HalaPeño như một chip dành cho suy luận cũng được lý giải trong bối cảnh này.
Việc mở rộng chip tự phát triển không nhất thiết dẫn đến sự giảm nhu cầu về GPU của Nvidia. Trên thực tế, nhu cầu về tính toán AI đang tăng nhanh chóng, dẫn đến việc các công ty công nghệ lớn đang tạo ra cấu trúc kết hợp giữa GPU bên ngoài và chip tự phát triển. Nvidia cũng tiếp tục hợp tác với OpenAI, công ty đang phát triển chip riêng. Trong báo cáo kết quả vào ngày 26, Nvidia cho biết doanh thu từ trung tâm dữ liệu đã tăng 117% so với cùng kỳ năm trước, đạt 89 tỷ USD.
Tuy nhiên, sự gia tăng của chip tự phát triển có thể làm thay đổi cách thức cạnh tranh trong thị trường bán dẫn AI. Trước đây, các công ty gia tốc viên như Nvidia và AMD dẫn dắt thiết kế chip, trong khi các công ty công nghệ lớn chủ yếu mua chip. Trong tương lai, có thể sẽ có nhiều trường hợp các công ty công nghệ lớn tự thiết kế cấu trúc và hiệu suất chip và hợp tác với các công ty bán dẫn để sản xuất.
Trong quá trình này, cấu trúc khách hàng của ngành công nghiệp bán dẫn cũng có thể thay đổi. Chip AI tự phát triển cũng cần các bán dẫn hiệu suất cao như bộ nhớ băng thông cao (HBM) và đóng gói tiên tiến. Thực tế, HalaPeño của OpenAI được cho là sử dụng HBM4. Khi ngày càng nhiều công ty phát triển chip AI tự phát triển, kỳ vọng rằng chip tự phát triển của các công ty công nghệ lớn sẽ trở thành nguồn cầu mới cho bộ nhớ hiệu suất cao cũng sẽ gia tăng.
* Bài viết này được dịch tự động bằng AI.
© Bản quyền thuộc về Thời báo Kinh tế AJU & www.ajunews.com: Việc sử dụng các nội dung đăng tải trên vietnam. kyungjeilbo.com phải có sự đồng ý bằng văn bản của Aju News Corporation.



