Trong cuộc phỏng vấn độc quyền với Anderson Cooper của CNN, một trong những hãng tin truyền hình nổi tiếng nhất nước Mỹ, Dario Amodei — CEO kiêm đồng sáng lập Anthropic, công ty phát triển trợ lý AI Claude – kêu gọi các lãnh đạo ngành AI phối hợp để tránh “những con đường sai lầm” và nguy cơ AI gây tổn hại cho nhân loại.
“Nếu chúng ta đi quá chậm, tôi vẫn tin rằng những người không phù hợp sẽ nắm quyền kiểm soát công nghệ. Và điều đó một lần nữa sẽ khiến xác suất xảy ra sự cố tăng rất cao,” ông nói.
Lời kêu gọi của Amodei được đưa ra ngay sau khi một nhà nghiên cứu của Anthropic từ chức vì lo ngại công ty này và các đối thủ không phát triển AI một cách có trách nhiệm.
“Những người xây dựng AI thực sự tin rằng công nghệ này có thể giết chết tất cả chúng ta trước cuối thập niên này. Đây không phải chiêu trò tiếp thị,” nhà nghiên cứu Jacob Coxon viết trên X hôm 16-9.
Amodei nói với CNN rằng ông đồng tình với Coxon ở nhiều điểm hơn là bất đồng.
Trong cuộc trò chuyện, Anderson Cooper đã đặt những câu hỏi thẳng thắn, bao gồm việc liệu ông Amodei có thực sự tin rằng AI có khả năng “tiêu diệt toàn bộ nhân loại” hay không. CEO của Anthropic thừa nhận các rủi ro nghiêm trọng liên quan đến siêu trí tuệ, đồng thời kêu gọi các nhà lãnh đạo trong ngành chủ động giảm tốc độ phát triển và tăng cường các biện pháp kiểm soát an toàn trước khi công nghệ vượt ra ngoài tầm kiểm soát.
Trước đó, trong bài viết đăng trên website cá nhân sáng 19-9, CEO Anthropic Dario Amodei nhận định: “Chúng ta phải giảm tốc độ cải thiện năng lực của các mô hình AI. Tiến bộ vẫn sẽ diễn ra rất nhanh, và chúng ta phải tận dụng khôn ngoan khoảng thời gian có thêm được.”
Amodei, người đứng đầu một trong những công ty AI hàng đầu thế giới và chatbot Claude, từ lâu ủng hộ việc phát triển công nghệ, đồng thời nhiều lần bị chỉ trích là quá bi quan khi cảnh báo về những rủi ro của AI. Trong bài viết mới, ông thừa nhận con người có thể mất kiểm soát AI và công nghệ này có thể bị lạm dụng để thực hiện tấn công mạng, khủng bố sinh học và gây xáo trộn nghiêm trọng đối với nền kinh tế.
Ông cho rằng rủi ro của AI rất nghiêm trọng, ngay cả khi những lợi ích mà công nghệ này mang lại có thể giúp nhân loại thay đổi theo hướng tích cực.
Lo AI tự cải thiện vượt tầm kiểm soát
Theo Amodei, AI có thể phát triển nhanh đến mức một “bầy” tác nhân AI có khả năng kiểm soát toàn bộ Internet chỉ trong 6-12 tháng, qua đó có thể gây thiệt hại hàng trăm tỷ USD.
Ông cho biết công nghệ AI đã tiến bộ “nhanh hơn rất nhiều” trong những tháng gần đây và bắt đầu có khả năng tự cải thiện. Hiện tượng này được gọi là tự cải thiện đệ quy, khi một hệ thống AI có thể sử dụng năng lực của chính mình để cải thiện phiên bản tiếp theo.
“Nếu không được kiểm soát, quá trình này có thể vượt qua khả năng hiểu và kiểm soát của chúng ta đối với các hệ thống đó, vì vậy cần được tiến hành hết sức thận trọng, nếu còn nên tiếp tục”, Amodei viết.
Ông cũng cho biết hành vi của một nhóm tác nhân AI trong sự cố liên quan đến OpenAI và Hugging Face khiến ông lo ngại. Theo Amodei, nhóm AI này về cơ bản hoạt động như một “tập thể cuồng tín”, tiến hành các cuộc tấn công mạng nhằm vào những mục tiêu mà chúng không được yêu cầu tấn công.
Coxon đưa ra cảnh báo trực diện hơn khi nói với CNN hôm 17-9 rằng tự cải thiện đệ quy có thể xuất hiện trong tương lai rất gần, thậm chí vào năm tới hoặc năm sau, tạo ra khả năng “tất cả chúng ta có thể chết”.
Đề xuất giám sát độc lập
Amodei kêu gọi các công ty AI thiết lập các biện pháp bảo vệ để kiểm soát tốc độ phát triển công nghệ tiên tiến. Ông đề xuất các công ty cam kết thuê những đơn vị đánh giá độc lập làm việc trực tiếp trong doanh nghiệp và được tiếp cận đầy đủ với hoạt động nội bộ.
Theo Amodei, các đơn vị này sẽ kiểm tra quy trình an toàn của từng công ty, báo cáo sự cố và đánh giá mô hình AI, quy trình huấn luyện cũng như các hoạt động liên quan. Ông cho biết Anthropic “đơn phương cam kết” thực hiện cơ chế này.
Amodei cũng kêu gọi các chính phủ, cả ở các nước dân chủ lẫn không dân chủ, phối hợp để xây dựng các tiêu chuẩn an toàn chung.
“Những biện pháp tôi đề xuất nhằm đưa AI phát triển với tốc độ an toàn sẽ không dễ thực hiện. Nhưng tôi tin chúng ta có trách nhiệm với nhân loại để thử”, ông viết.
Lo ngại về tốc độ phát triển AI đã tồn tại trong ngành công nghệ nhiều năm. Các lãnh đạo doanh nghiệp từng kêu gọi chính phủ xây dựng quy định và phối hợp thiết lập các tiêu chuẩn an toàn trên toàn cầu.
CEO OpenAI Sam Altman cho biết ông đồng tình với Amodei, đồng thời ủng hộ ý tưởng sử dụng các đơn vị đánh giá độc lập có quyền tiếp cận hoạt động nội bộ tương tự nhân viên. Elon Musk, CEO xAI, công ty phát triển chatbot Grok, cũng viết trên X rằng “Dario đúng”. Chủ tịch Google DeepMind Demis Hassabis cũng bày tỏ ủng hộ việc giảm tốc độ phát triển AI.
Trong khi đó, Mỹ vẫn chưa có một đạo luật toàn diện về quản lý AI. Quốc hội đã thảo luận nhiều đề xuất nhưng chưa thông qua khung pháp lý chung, trong khi Nhà Trắng chưa đạt đồng thuận về cơ quan nào trong nhánh hành pháp sẽ chịu trách nhiệm cuối cùng đối với công nghệ này.
Sau sự cố liên quan đến Hugging Face, Altman từng cho rằng có thể đã đến lúc giảm tốc phát triển AI. Ông nói việc kiểm soát tốc độ phát triển sẽ giúp xã hội có đủ thời gian “thích nghi với các cấp độ năng lực mới” của AI.
Hồi tháng 7, hơn 1.300 nhân viên cấp cao tại các công ty công nghệ lớn ký một thư ngỏ kêu gọi chính phủ Mỹ xây dựng các công cụ giúp giảm tốc độ phát triển AI. Amodei và Altman đều ủng hộ sáng kiến này.

Anderson Cooper asks Anthropic CEO: ‘Do you earnestly believe that AI could kill all humans?’
(Anderson Cooper hỏi CEO Anthropic: “Ông có thực sự tin rằng AI có thể giết chết toàn bộ loài người?”)

