OpenAI, công ty phát triển ChatGPT, cho biết đã sa thải ba nhà nghiên cứu vì bị cáo buộc xử lý sai “thông tin nhạy cảm” và vi phạm các quy định của công ty, trong đó có công việc liên quan đến một tổ chức bên ngoài chuyên đánh giá các mô hình trí tuệ nhân tạo.
Phòng nghiên cứu AI có trụ sở tại San Francisco không xác nhận danh tính những người bị sa thải, nhưng theo Wall Street Journal và Bloomberg, ít nhất hai người trong số này làm việc về an toàn và căn chỉnh AI theo mục tiêu của con người (alignment).
“Chúng tôi đã chấm dứt hợp tác với ba cá nhân,” OpenAI nói với AFP. “Cuộc điều tra của chúng tôi xác nhận những người này đã xử lý sai thông tin nhạy cảm bên ngoài các quy trình được công ty thiết lập, vi phạm chính sách và làm tổn hại đến niềm tin vốn rất quan trọng đối với công việc của chúng tôi.”
Việc sa thải diễn ra trong bối cảnh tranh luận căng thẳng về an toàn AI và nguy cơ công nghệ này có thể đe dọa sự tồn vong của nhân loại.
Tháng trước, nhà nghiên cứu 27 tuổi Jacob Coxon từ chức khỏi Anthropic và cảnh báo rằng các phòng nghiên cứu AI hàng đầu, trong đó có OpenAI – nơi anh từng làm việc – đang “đánh cược với mạng sống của chúng ta” khi chạy đua phát triển những mô hình ngày càng mạnh.
Theo Wall Street Journal, ba nhà nghiên cứu bị OpenAI sa thải là Jasmine Wang, Tomek Korbak và Mikita Balesni. Cả ba chưa lập tức phản hồi yêu cầu bình luận của AFP. Trong những tuần gần đây, cả ba thường xuyên đăng bài trên X về các vấn đề liên quan đến an toàn AI.
“Tôi đang làm việc tại OpenAI và tôi nghĩ khả năng AI khiến toàn bộ nhân loại bị diệt vong là hơn 10%,” Balesni viết ngày 10-9, lặp lại những cảnh báo tương tự của một số nhân viên AI khác.
Trong lúc xuất hiện nhiều đồn đoán về lý do các nhân viên OpenAI và Anthropic công khai khá thoải mái quan điểm cá nhân, Korbak cũng tham gia cuộc tranh luận.
“Tôi khá không hài lòng với nhiều việc OpenAI đang làm. Và tôi rất vui vì mình được phép nói rằng ‘tôi khá không hài lòng với nhiều việc OpenAI đang làm’,” Korbak viết ngày 11-9.
Sau khi Coxon từ chức, Wang viết rằng “khó có thể phóng đại mức độ nguy hiểm của việc đẩy nhanh tiến trình hướng tới RSI”, tức AI tự cải thiện (recursive self-improvement), kỹ thuật trong đó phần mềm được thiết kế để liên tục tự học và cải thiện.
Lo ngại về an toàn AI gia tăng
Tuần này, các công ty công nghệ hàng đầu Mỹ đã ký một cam kết tự nguyện về an toàn AI sau cuộc gặp với Tổng thống Donald Trump tại Nhà Trắng.
Trump gọi đây là một cam kết “mang tính ràng buộc về đạo đức” nhằm xây dựng các biện pháp bảo vệ phù hợp cho công nghệ đang phát triển nhanh chóng. Các lãnh đạo của Nvidia, Google, Meta, xAI, OpenAI và Anthropic đã ký thỏa thuận.
Những lo ngại về mức độ an toàn của các mô hình AI tiên tiến đã gia tăng trong những tháng gần đây. OpenAI đã hủy kế hoạch phát hành mô hình mới Astra 6.1 sau khi đánh giá mô hình không đủ tin cậy và thường xuyên phớt lờ chỉ dẫn. Thay vào đó, công ty ra mắt GPT-6.1 Sol, phiên bản cập nhật của một mô hình khác, tại hội nghị nhà phát triển (DevDay) thường niên ở San Francisco hôm 29-9. OpenAI cho biết Sol có giá chỉ bằng một phần năm Astra.
Tháng 7, các tác nhân AI do OpenAI phát triển đã tấn công Hugging Face, nền tảng lưu trữ và phát triển mô hình, ứng dụng AI, trong một sự cố khi phần mềm tự động thoát khỏi môi trường thử nghiệm được giới hạn. Sau đó, một số sự cố an ninh khác liên quan đến các mô hình do OpenAI, Anthropic và Google phát triển cũng được báo cáo.
Hôm 1-10, công ty an ninh mạng Asymmetric Security cho biết trong một báo cáo rằng các tác nhân AI do OpenAI phát triển đã cố che giấu dấu vết hoạt động sau khi truy cập trái phép các website của chính phủ.
Theo Washington Post hôm 30-9, Ủy ban Thương mại Liên bang Mỹ (FTC) đã mở cuộc điều tra trên diện rộng về các hoạt động bảo đảm an toàn AI của Anthropic và OpenAI. Tuy nhiên, phạm vi cuộc điều tra chưa rõ.

Việc OpenAI sa thải ba nhân viên diễn ra trong bối cảnh tranh luận căng thẳng về an toàn AI và nguy cơ công nghệ này có thể đe dọa sự tồn vong của nhân loại. Ảnh: AFP

