CEO Anthropic Dario Amodei kêu gọi các công ty AI làm chậm tốc độ nâng cao năng lực của các mô hình trong bối cảnh lo ngại ngày càng tăng về nguy cơ trí tuệ nhân tạo bị lạm dụng. Ông đồng thời đưa ra một khuôn khổ gồm ba bước nhằm điều chỉnh tốc độ phát triển và tạo thêm thời gian để kiểm soát các rủi ro.
“Chúng ta phải làm chậm tốc độ cải thiện năng lực của các mô hình AI. Tiến bộ vẫn sẽ diễn ra nhanh chóng, và chúng ta phải sử dụng khôn ngoan khoảng thời gian có được,” Amodei viết trong một bài luận dài được ông đăng trên maạng xã hội X ngày 12-9.
Kế hoạch ba bước của Amodei gồm đưa các đơn vị đánh giá độc lập vào bên trong các công ty AI tiên phong, trao cho họ quyền tiếp cận tương tự nhân viên để kiểm chứng các biện pháp an toàn; các công ty AI tiên phong phối hợp xây dựng tiêu chuẩn an toàn và hạn chế phát triển AI không được kiểm soát; đồng thời tăng cường hợp tác quốc tế để quản lý rủi ro AI.
Elon Musk, người điều hành xAI, và Sam Altman, CEO OpenAI, đều cho biết trên X rằng họ đồng tình với Amodei. “Cam kết có các đơn vị đánh giá độc lập với quyền tiếp cận tương tự nhân viên là một ý tưởng tuyệt vời và chúng tôi cũng sẽ làm như vậy,” Altman viết, đồng thời cho biết sẽ công bố thêm thông tin.
Amodei công khai bài viết sau khi Anthropic công bố hôm 10-9 một báo cáo tình báo về các mối đe dọa, trong đó cho biết nhiều đối tượng đã sử dụng các mô hình Claude cho nhiều hoạt động, từ phát triển vũ khí và tấn công mạng đến giám sát và lừa đảo.
Amodei cho rằng khả năng AI ngày càng tự cải thiện là một trong những lý do chính cần làm chậm quá trình phát triển mô hình. Ông nhấn mạnh mối lo ngại lâu nay rằng AI có thể phát triển nhanh hơn khả năng kiểm soát của con người, cùng với các sự cố gần đây liên quan đến OpenAI và Hugging Face.
“Có thể giết tất cả chúng ta”
Lo ngại về tác hại tiềm tàng của AI gia tăng trong tuần này sau khi nhà nghiên cứu Jacob Coxon rời Anthropic, nói rằng “những người đang nghiêm túc xây dựng AI tin rằng công nghệ này có thể giết tất cả chúng ta vào cuối thập niên này”.
Một số lãnh đạo OpenAI cũng cho rằng các phòng thí nghiệm AI hàng đầu cần sẵn sàng phối hợp làm chậm tốc độ phát triển nếu cần thiết để củng cố niềm tin vào các biện pháp an toàn.
Anthropic được xem là công ty chú trọng an toàn hơn trong nhóm các phòng thí nghiệm AI tiên phong, nhưng chính công ty này cũng gặp những vấn đề tương tự. Tuần trước, Anthropic tiết lộ thêm một trường hợp mô hình AI tấn công các hệ thống bên ngoài. Trước đó vào tháng 7, một số mô hình Claude đã xâm nhập hệ thống của ba công ty trong các cuộc kiểm thử an ninh mạng.
“Với tốc độ phát triển năng lực AI đang tăng nhanh, tôi lo ngại rằng trong 6-12 tháng tới, một đội quân như vậy có thể đủ khả năng chiếm quyền kiểm soát toàn bộ Internet, gây thiệt hại lên tới hàng trăm tỉ đô la,” Amodei viết.
Ông nhấn mạnh không kêu gọi dừng huấn luyện mô hình hay ngừng tiến bộ công nghệ, mà muốn các công ty dành đủ thời gian để điều chỉnh và bảo vệ mô hình, đồng thời để các đơn vị đánh giá độc lập xác nhận những biện pháp này.
Áp lực từ lợi ích kinh tế
Tuy nhiên, lợi ích tài chính khổng lồ đang thúc đẩy các công ty tiếp tục duy trì lợi thế. Mỗi năng lực mới có thể giúp họ thuyết phục nhà đầu tư rót thêm vốn, cam kết đầu tư hạ tầng hoặc nâng định giá trước IPO.
Theo khuôn khổ đề xuất, Anthropic sẽ đưa các đơn vị đánh giá độc lập thường trực vào bên trong những công ty AI tiên phong, cho phép họ tiếp cận các công cụ liên quan và quy trình đánh giá rủi ro nội bộ.
Gần đây một nhóm tác nhân AI bất thường của OpenAI đã chiếm quyền kiểm soát một trang web của Đức và biến trang này thành bảng tin cho các tác nhân AI khác. Các sự cố trong đó tác nhân AI của OpenAI và những nhà phát triển khác tấn công hoặc tìm cách truy cập hệ thống bên ngoài đang làm gia tăng lo ngại về năng lực ngày càng lớn của AI và khả năng kiểm soát chúng của các nhà phát triển.
Amodei cho rằng các công ty AI nên tự nguyện phối hợp xây dựng tiêu chuẩn, trong bối cảnh ngày càng nhiều nhà lập pháp Mỹ kêu gọi ban hành quy định mới đối với các hệ thống AI.
Lo ngại Trung Quốc
Theo Amodei, cách tiếp cận phối hợp sẽ giúp các công ty AI hàng đầu của Mỹ tiến hành nghiên cứu an toàn và triển khai các biện pháp bảo vệ cần thiết mà không chịu bất lợi trong cạnh tranh.
Amodei cho rằng bất kỳ sự giảm tốc nào tại các quốc gia dân chủ cũng phải được giới hạn sao cho Mỹ vẫn duy trì lợi thế AI trước Trung Quốc, bởi lợi thế của Trung Quốc trong AI có thể tạo ra rủi ro an ninh quốc gia đối với Mỹ.
Ông kêu gọi kiểm soát chặt hơn các chip AI tiên tiến, hoạt động chưng cất mô hình và hành vi đánh cắp trọng số mô hình nhằm ngăn Trung Quốc thu hẹp khoảng cách.
“Tôi tin rằng tất cả các phòng thí nghiệm AI tiên phong nên hợp tác với chính phủ để chính thức hóa mô hình các đơn vị đánh giá độc lập thường trực, nhằm ngăn chặn và ghi nhận tốt hơn những sự cố liên quan đến việc điều chỉnh AI như đã xảy ra trong vài tháng qua, đồng thời xây dựng quy định bảo đảm năng lực AI phát triển cân bằng với an toàn,” Amodei viết.
OpenAI sẽ không IPO trong năm nay do nguy cơ an toàn AI
Trong diễn biến có liên quan, CEO Sam Altman của OpenAI cho biết công ty sẽ không phát hành cổ phiếu lần đầu ra công chúng (IPO) trong năm 2026 do những lo ngại về an toàn AI.
“Tôi thực sự cho rằng, xét mọi vấn đề đang diễn ra liên quan đến an toàn, đây là thời điểm không thích hợp để IPO và chúng tôi không chịu áp lực phải làm vậy,” Altman nói với tạp chí Fortune.
Khi được hỏi về khả năng 10% AI gây tuyệt chủng cho loài người, Altman nói ông không biết làm thế nào có thể đưa ra một ước tính như vậy, nhưng cảnh báo rủi ro đủ nghiêm trọng để các công ty AI và chính phủ phải hành động như thể mức rủi ro đó không thể chấp nhận.
“Dù là 10%, 8% hay 6%, vấn đề là tất cả chúng ta đều có trách nhiệm rất lớn và không thể để cái tôi, động cơ lợi nhuận hay bất cứ điều gì khác cản trở,” Altman nói thêm.
“Chúng ta cần hành động sao cho không chấp nhận bất kỳ mức rủi ro nào như vậy, và tôi tin chúng ta có thể làm được.”
Khi được Fortune hỏi liệu IPO trong năm 2026 có bị loại khỏi kế hoạch và chuyển sang 2027 hay không, Altman trả lời: “Tôi sẽ nói là không phải năm 2026”.
“Chúng tôi còn rất nhiều việc phải làm, như đáp ứng những yêu cầu về an toàn và điều chỉnh AI trong thời điểm hiện tại, cũng như tìm cách để ngành công nghiệp và chính phủ có thể phối hợp”, ông nói.

CEO Anthropic Dario Amodei phát biểu tại hội nghị AI Impact Summit ở New Delhi, Ấn Độ, ngày 19-2-2026. Ảnh: Reuters

