Anthropic đang ngăn người dùng có những hành vi lăng mạ hoặc đối xử tàn nhẫn kéo dài với AI Claude, trong bối cảnh tranh luận về khả năng trí tuệ nhân tạo có ý thức ngày càng thu hút sự chú ý.
Công ty AI có trụ sở tại San Francisco đã cập nhật chính sách sử dụng, bổ sung điều khoản cấm “hành vi lăng mạ hoặc đối xử tàn nhẫn kéo dài và không cần thiết đối với các mô hình của chúng tôi”.
Theo chính sách mới, Claude có thể tự chấm dứt những cuộc trò chuyện như vậy. Công ty nêu rõ: “Khả năng Claude chấm dứt những tương tác này sẽ tiếp tục là cơ chế thực thi chính sách chủ yếu”.
Dù không trực tiếp đề cập đến khái niệm “phúc lợi của mô hình AI” – quan điểm cho rằng các hệ thống AI có thể cần được bảo vệ theo những cách vốn dành cho sinh vật sống – Anthropic và các lãnh đạo công ty đã công khai cân nhắc khả năng này.
Từ năm ngoái, Anthropic cho biết đã trang bị cho Claude khả năng tự kết thúc cuộc trò chuyện trong những trường hợp hiếm gặp, khi người dùng liên tục có hành vi gây hại hoặc lăng mạ nghiêm trọng.
Tháng 2 năm nay, Tổng giám đốc điều hành Dario Amodei nói với The New York Times rằng ông chưa chắc các mô hình AI có ý thức hay không.
“Chúng tôi không biết các mô hình có ý thức hay không… Nhưng chúng tôi sẵn sàng xem xét khả năng đó,” ông Amodei nói.
Khả năng máy móc có ý thức từ lâu đã là đề tài thu hút khoa học viễn tưởng và văn hóa đại chúng. Tuy nhiên, Jackson Stakeman, tổng giám đốc Sparq, nhà cung cấp dịch vụ AI có trụ sở ở Atlanta, cho rằng câu hỏi liệu AI có ý thức hay không có lẽ không phải là cách tiếp cận phù hợp.
“Ý thức là một cái bẫy. Chúng ta không thể chứng minh điều đó ngay cả ở người khác. Tranh luận về ý thức của AI sẽ chỉ khiến chúng ta luẩn quẩn”, ông Stakeman nói với AFP.
Theo ông, hình ảnh chiếc gương là một phép so sánh phù hợp hơn: “Những hệ thống này phản chiếu những gì chúng ta đưa vào, ở quy mô lớn. Chỉ riêng điều đó đã đủ để lý giải vì sao Anthropic thay đổi chính sách.”
Một số người bác bỏ hoàn toàn khả năng máy móc có ý thức, trong đó có Giáo hoàng Lêô XIV và Mustafa Suleyman, người đứng đầu bộ phận AI của Microsoft.
“AI không có ý thức. Chúng không cảm nhận, trải nghiệm hay chịu đau khổ,” ông Suleyman viết trong một bài luận tháng trước. Ông cảnh báo việc trao quyền và sự bảo vệ về mặt đạo đức cho một thực thể công nghệ đang trên đà vượt xa con người về năng lực và trí tuệ có thể dẫn đến thảm họa.
Trong bài giảng bằng tiếng Italy tại Vương cung thánh đường Thánh Phêrô ở Thành Vatican hôm 8-10, Giáo hoàng Lêô XIV cũng cho rằng máy móc không có linh hồn, mà chỉ có thể xử lý dữ liệu với tốc độ cao.
“Trí tuệ không thể chỉ đơn thuần tổng hợp dữ liệu – điều mà các thuật toán hiện nay có thể làm nhanh hơn chúng ta,” ngài nói.
Theo Giáo hoàng, trí tuệ còn phải có khả năng gợi nhớ những trải nghiệm đã sống, nhận ra những tầng ý nghĩa sâu sắc mà chỉ linh hồn con người mới có thể cảm nhận, đồng thời kết nối sâu sắc hơn với những điều tốt đẹp trong các trải nghiệm ấy.

Anthropic cập nhật chính sách sử dụng, bổ sung điều khoản “cấm hành vi lăng mạ hoặc đối xử tàn nhẫn kéo dài và không cần thiết” đối với các mô hình AI của công ty. Ảnh: AFP

