Jacob Coxon, nhà nghiên cứu từng làm việc tại Anthropic và OpenAI, đã nghỉ việc tại Anthropic ngày 8-9 và cáo buộc hai công ty đang phát triển AI một cách thiếu trách nhiệm, làm dấy lên tranh luận về tốc độ tiến bộ của công nghệ này.
Trong một bài đăng trên X được xem hơn 70 triệu lần, Coxon cho biết ông nghỉ việc vì lo ngại Anthropic và OpenAI đang “đánh cược với mạng sống của chúng ta”. Theo ông, những người phát triển AI thực sự tin rằng công nghệ này có thể “giết chết tất cả chúng ta” trước cuối thập niên này.
“Đừng đánh giá thấp sức mạnh của công nghệ này,” Coxon viết, cảnh báo các hệ thống AI trong tương lai có thể vượt con người, tự tấn công hệ thống máy tính, thay đổi nhanh chóng nhiều lĩnh vực và giành được quyền lực cùng nguồn lực.
Những cảnh báo này phản ánh cuộc tranh luận kéo dài tại Thung lũng Silicon về khả năng kiểm soát AI. Trong bối cảnh Anthropic và OpenAI liên tục phát triển các mô hình ngày càng mạnh, một số nhà nghiên cứu kêu gọi các công ty phối hợp giảm tốc độ phát triển.
Jakub Pachocki, nhà khoa học trưởng của OpenAI, cũng cảnh báo rằng chưa công ty AI nào giải quyết đủ tốt vấn đề căn chỉnh AI (AI alignment – tức là điều chỉnh mục tiêu, hành vi và quyết định của hệ thống AI phù hợp với ý định, giá trị và lợi ích của con người) và giám sát để có thể tiếp tục mở rộng công nghệ ở tốc độ tối đa một cách có trách nhiệm. Ông kêu gọi các công ty chủ động giảm tốc độ phát triển cho đến khi đạt được các tiêu chuẩn an toàn chung, đồng thời thúc đẩy hợp tác quốc tế.
Evan Hubinger, lãnh đạo nhóm nghiên cứu alignment tại Anthropic, đồng tình với Coxon và cho biết cá nhân ông đánh giá xác suất AI có thể khiến nhân loại diệt vong trong thập niên tới là trên 10%. Hubinger nói Anthropic đang cố gắng giải quyết vấn đề, nhưng hiện chưa có kế hoạch rõ ràng để bảo đảm an toàn cho các hệ thống siêu trí tuệ.
Một mối lo ngại khác là AI tự cải thiện đệ quy, trong đó một hệ thống AI có thể tự thiết kế và phát triển phiên bản kế nhiệm mà không cần con người can thiệp. Công nghệ này hiện chưa đạt được khả năng đó, nhưng các công ty AI cảnh báo nó có thể khiến con người khó kiểm soát hệ thống hơn.
Lo ngại AI gây tuyệt chủng cho nhân loại hoặc tạo ra các thảm họa quy mô lớn không phải vấn đề mới. Năm 2023, nhiều nhà nghiên cứu và lãnh đạo AI, trong đó có CEO OpenAI Sam Altman và CEO Anthropic Dario Amodei, đã ký tuyên bố kêu gọi xem việc giảm nguy cơ tuyệt chủng do AI là ưu tiên toàn cầu, ngang với các rủi ro như đại dịch và chiến tranh hạt nhân.
Tháng 7, Hubinger nằm trong khoảng 1.400 nhà nghiên cứu AI ký thư ngỏ “Pacing the Frontier”, kêu gọi chính phủ Mỹ xây dựng các công cụ cần thiết để chủ động kiểm soát tốc độ phát triển các hệ thống AI tiên tiến.
Tại Mỹ, các nghị sĩ cũng bắt đầu đưa ra những đề xuất nhằm kiểm soát tốc độ phát triển AI. Cũng trong tháng 7, hai nghị sĩ Jay Obernolte và Lori Trahan giới thiệu dự luật FRONTIER Act, nhằm xây dựng khuôn khổ quản lý việc triển khai các mô hình AI tiên tiến. Đầu tháng 9, Thượng nghị sĩ Bernie Sanders và Hạ nghị sĩ Greg Casar đề xuất dự luật Ban Artificial Superintelligence Act, kêu gọi tạm dừng phát triển AI tiên tiến cho đến khi chính phủ liên bang thiết lập các quy định an toàn.
Trong khi đó, phản ứng xã hội đối với AI cũng gia tăng, đặc biệt liên quan đến các trung tâm dữ liệu AI – những cơ sở quy mô lớn chứa phần cứng phục vụ huấn luyện và vận hành mô hình. Bộ trưởng Tài chính Mỹ Scott Bessent gần đây cho rằng các công ty AI đã “giải thích rất tệ” về công nghệ này với công chúng Mỹ và cần thuyết phục người dân rằng lợi ích từ AI sẽ không chỉ tập trung vào một nhóm nhỏ.

Ảnh minh họa các mô hình AI tiên tiến của Anthropic. Nhà nghiên cứu người Anh Jacob Coxon rời công ty sau khi cảnh báo về nguy cơ AI sẽ xóa sổ nhân loại. Ảnh: AFP

