Story

Các nỗ lực đảm bảo an toàn AI sẽ thúc đẩy nhu cầu tính toán cao hơn, theo nhận định của các nhà lãnh đạo ngành.

ENTHMSVIIDZHZH-TWJAKOHI
Sep 19, 20263 min read
Các nỗ lực đảm bảo an toàn AI sẽ thúc đẩy nhu cầu tính toán cao hơn, theo nhận định của các nhà lãnh đạo ngành.

Summary

Các nhà phát triển AI hàng đầu cho biết việc nâng cao độ an toàn và tính nhất quán của mô hình là một quá trình đòi hỏi nhiều tài nguyên tính toán, báo hiệu nhu cầu về phần cứng và cơ sở hạ tầng trung tâm dữ liệu đang tăng lên chứ không phải giảm đi.

Text size
Background

Nỗ lực cải thiện tính an toàn và sự đồng bộ của các hệ thống trí tuệ nhân tạo tiên tiến sẽ đòi hỏi sự gia tăng đáng kể về sức mạnh tính toán, một sự phát triển được dự đoán sẽ thúc đẩy nhu cầu về phần cứng AI hơn nữa. Thông tin quan trọng này từ các nhà phát triển mô hình tiên tiến hàng đầu tại Hội nghị Thượng đỉnh Cơ sở hạ tầng AI mâu thuẫn với một số lo ngại của nhà đầu tư rằng các quy định an toàn nghiêm ngặt hơn có thể kìm hãm chi tiêu cho cơ sở hạ tầng, theo một báo cáo nghiên cứu từ Citi.

Chi phí ngày càng tăng của an toàn AI

Các cuộc thảo luận tại hội nghị Santa Clara đã nhấn mạnh rằng nút thắt cổ chai chính đối với ngành công nghiệp AI không còn chỉ là kiến trúc mô hình mà là khả năng đảm bảo năng lực tính toán, điện năng và cơ sở hạ tầng khổng lồ. Theo báo cáo của Citi, các nhà phát triển tiết lộ rằng các quy trình liên quan đến an toàn đòi hỏi rất nhiều sức mạnh tính toán.

Nhu cầu này đã và đang ảnh hưởng đến thiết kế cơ sở hạ tầng, với các trung tâm dữ liệu thế hệ tiếp theo được lên kế hoạch để đáp ứng nhiều hơn 30% đến 40% GPU. Ngành công nghiệp cũng đang tập trung vào việc tăng hiệu quả thông qua các nền tảng điều phối phần mềm và nâng cấp phần cứng như nền tảng Vera Rubin sắp ra mắt của Nvidia để tối đa hóa thông lượng cấp hệ thống.

Nvidia: 'Trí tuệ nhân tạo tự động' đòi hỏi cao gấp 100 lần

Ian Buck, Phó Chủ tịch phụ trách Siêu quy mô và HPC của Nvidia Corp., giải thích rằng sự chuyển đổi từ chatbot đàm thoại sang "trí tuệ nhân tạo tự động" (agent AI) đang gây ra sự gia tăng mạnh mẽ về yêu cầu phần cứng. Phát biểu tại hội nghị thượng đỉnh, Buck lưu ý rằng khối lượng công việc của agent đòi hỏi cao hơn khoảng 100 lần so với các ứng dụng trò chuyện phổ biến vào năm 2023.

Sample IUX Markets – In-articleAd

Sự gia tăng theo cấp số nhân này được thúc đẩy bởi một số yếu tố:

  • Độ dài chuỗi đầu vào dài hơn đáng kể
  • Kích thước bộ nhớ cache Key-Value (KV) lớn hơn
  • Tương tác đa lượt phức tạp hơn
  • Việc tạo ra nhiều tác nhân con để hoàn thành nhiệm vụ

Các ông lớn về cơ sở hạ tầng vạch ra lộ trình mở rộng

Các công ty công nghệ lớn đã vạch ra chiến lược của họ để đáp ứng nhu cầu ngày càng tăng này. Giám đốc điều hành của Intel Corp., Lip-Bu Tan, đã trình bày chi tiết về sự chuyển hướng của công ty hướng tới trở thành nhà cung cấp cơ sở hạ tầng AI toàn diện, nhấn mạnh rằng CPU vẫn rất quan trọng đối với học tăng cường và quy trình làm việc agent. Ông Tan cũng xác nhận rằng tiến trình sản xuất 18A của Intel đang được sản xuất hàng loạt, trong khi tiến trình 14A tiên tiến hơn sắp ra mắt.

Trong khi đó, Meta Platforms Inc. đang lên kế hoạch mở rộng quy mô lớn cơ sở hạ tầng AI của mình, chuyển từ cụm "Prometheus" hiện tại với công suất hơn 1 gigawatt sang cụm "Hyperion" với công suất 5 gigawatt. Santosh Janardhan, Trưởng bộ phận Cơ sở hạ tầng của Meta, xác định mạng đa vùng, không mất dữ liệu là trở ngại vận hành lớn nhất trong quá trình mở rộng này.

Back to latest news

LATEST