Nvidia đang triển khai một nền tảng phần mềm mới cho phép các nhà phát triển AI thiết lập các lớp bảo vệ cho tác nhân AI, nhằm ngăn chúng thoát khỏi môi trường được kiểm soát.
“Bạn không thể để các tác nhân AI tự do di chuyển và hoạt động khắp công ty. Vì vậy, phải có cách để cô lập chúng,” CEO Nvidia Jensen Huang nói với CNBC trong chương trình “Squawk Box” hôm thứ Hai.
Huang cho biết nền tảng mới với tên gọi Open Agent Safety Platform về cơ bản giống như “trình duyệt dành cho tác nhân AI”, cung cấp một môi trường kiểm soát chỉ cho phép tác nhân tiếp cận những tài nguyên cần thiết để thực hiện nhiệm vụ.
Nvidia công bố nền tảng này hôm thứ Hai, sau khi các công ty như OpenAI, Anthropic, Meta và Google gần đây tiết lộ những sự cố trong đó các mô hình AI thoát khỏi môi trường cách ly và tìm cách tấn công các công ty khác hoặc truy cập hệ thống máy tính bên ngoài.
Một đại diện Nvidia nói với các phóng viên trong cuộc họp trực tuyến hôm Chủ nhật rằng nền tảng mới có thể đã ngăn được sự cố liên quan đến Hugging Face của OpenAI hồi tháng 7. Khi đó, các mô hình của OpenAI thoát khỏi môi trường kiểm soát, truy cập Internet mở và xâm nhập Hugging Face, nền tảng dành cho các nhà phát triển phần mềm nguồn mở.
“Mỗi sự cố an ninh đều khác nhau và chúng ta phải xem xét từng trường hợp một cách chi tiết,” Justin Boitano, Phó chủ tịch phụ trách AI doanh nghiệp của Nvidia, nói. Theo ông, Hugging Face ghi nhận hơn 17.000 tác nhân AI tấn công hạ tầng của công ty trong nhiều ngày và nhiều tuần.
Nvidia chuyển trọng tâm sang an toàn tác nhân AI
Nvidia giữ vị trí trung tâm trong làn sóng AI tạo sinh kể từ khi ChatGPT ra mắt gần bốn năm trước. Bộ xử lý đồ họa của công ty đóng vai trò quan trọng trong việc phát triển các mô hình ngôn ngữ lớn và cung cấp dịch vụ AI của các nhà vận hành trung tâm dữ liệu quy mô lớn.
Gần đây, Huang cũng trở thành một tiếng nói đáng chú ý trong tranh luận về an toàn AI. Ông cho rằng nhiều vấn đề an ninh liên quan đến AI là các bài toán kỹ thuật có thể giải quyết bằng khoa học máy tính và phát triển sản phẩm.
“Bạn phải nghĩ xem có thể làm gì và giải pháp là gì,” Huang nói trong một podcast với Ezra Klein của New York Times tuần trước, khi đề cập đến những sự cố gần đây. Theo ông, các công ty cần cải thiện quy trình để tránh những sự cố tương tự tái diễn.
Hai tuần trước, CEO Anthropic Dario Amodei đã gây tranh luận trong ngành khi kêu gọi các nhà phát triển mô hình AI giảm tốc độ phát triển vì lo ngại các mô hình có thể vượt khỏi tầm kiểm soát. Lập luận này nhận được sự ủng hộ của CEO OpenAI Sam Altman và Elon Musk.
Theo Phó chủ tịch Boitano, nền tảng mới của Nvidia là một giải pháp kỹ thuật cho vấn đề an toàn của tác nhân AI.
“Các sự cố gần đây cho thấy một trở ngại cơ bản đối với tác nhân AI: chỉ các biện pháp bảo vệ ở cấp mô hình không đủ để kiểm soát những gì tác nhân có thể truy cập hoặc thực hiện,” ông nói.
Một thành phần của nền tảng có tên Nvidia OpenShell, hoạt động trên bộ xử lý trung tâm và đặt giới hạn đối với khả năng của tác nhân AI. Nvidia cũng công bố Sentry, hệ thống giám sát tác nhân AI hoạt động trên chip mạng thay vì CPU hoặc GPU.
Một phần của phần mềm được phát hành dưới dạng mã nguồn mở. Nvidia gọi toàn bộ nền tảng là thiết kế tham chiếu, nghĩa là các đối tác có thể sử dụng nền tảng này để phát triển và đưa các sản phẩm thương mại ra thị trường.
Nvidia cho biết Cisco, Microsoft, Oracle, CoreWeave, Dell, HPE, Lenovo, ARM và Intel là các đối tác của nền tảng. Nvidia cũng đang hợp tác với Anthropic để tích hợp các tác nhân AI được quản lý trên nền tảng đám mây với OpenShell.
“Ngành AI không thể thành công nếu thế giới không tin rằng các hệ thống AI được xây dựng và triển khai một cách an toàn, hoặc không cảm thấy đủ tin tưởng rằng chúng an toàn,” Huang nói với CNBC hôm thứ Hai.

Jensen Huang (bên phải) trong cuộc trò chuyện với CNBC về nền tảng phần mềm mới để kiểm soát tác nhân AI. Ảnh: CNBC

