AI đang chuyển từ công cụ trả lời sang tác nhân có khả năng hành động thay con người. Từ gửi email, đặt chuyến đi, mua hàng đến gọi điện cho doanh nghiệp, các tác nhân AI bắt đầu đảm nhận những công việc trước đây đòi hỏi người dùng phải trực tiếp thao tác. Meta, Google và OpenAI đều đang phát triển công nghệ theo hướng này, trong khi các thiết bị mới như Meta Charm mở rộng cách con người tương tác với AI.
Điện thoại từng thay đổi cách con người giao tiếp bằng cách đưa cuộc gọi, tin nhắn, email và mạng xã hội vào một thiết bị. Làn sóng trí tuệ nhân tạo mới đang mở ra một thay đổi khác: con người có thể không còn phải trực tiếp thực hiện mọi bước để giao tiếp và sử dụng các dịch vụ trên Internet.
Sự xuất hiện của Meta Charm, thiết bị cầm tay nhỏ gọn được Meta giới thiệu trong tuần qua, cho thấy xu hướng này đang tiến gần hơn đến người dùng đại chúng. Charm được thiết kế để đưa tác nhân AI Muse ra khỏi màn hình điện thoại, trở thành thiết bị luôn sẵn sàng nhận yêu cầu. Meta cho biết sản phẩm sẽ được giao từ tháng 12.
Điểm đáng chú ý không nằm ở kích thước của Charm mà ở vai trò Meta muốn giao cho Muse. Thay vì chỉ trả lời câu hỏi, tác nhân này được thiết kế để thực hiện công việc thay người dùng, từ gửi email, đặt chuyến đi, điền biểu mẫu trực tuyến đến mua hàng. Muse có thể tiếp tục làm việc sau khi người dùng đóng ứng dụng và chỉ yêu cầu xác nhận khi cần thực hiện hành động nhạy cảm.
Nếu mô hình này trở nên phổ biến, thay đổi lớn tiếp theo của Internet có thể không nằm ở một thiết bị mới mà ở cách con người giao tiếp và thực hiện công việc trong thế giới số.
Từ sử dụng ứng dụng sang giao việc cho AI
Trong nhiều năm, các ứng dụng được xây dựng dựa trên giả định rằng con người sẽ trực tiếp điều khiển chúng. Muốn đặt vé, người dùng mở ứng dụng, tìm chuyến bay, nhập thông tin và thanh toán. Muốn liên hệ với một cửa hàng, họ phải tìm số điện thoại rồi gọi và trao đổi với nhân viên.
Các tác nhân AI đang bắt đầu thực hiện những bước đó thay người dùng.
Meta mô tả Muse như một trợ lý cá nhân có khả năng tự lập kế hoạch và thực hiện công việc. Tác nhân có trình duyệt riêng, có thể mở website, điền biểu mẫu và phối hợp nhiều bước để hoàn thành một nhiệm vụ. Meta cũng xây dựng một máy tính ảo riêng cho mỗi phiên làm việc nhằm tách tác nhân và dữ liệu của người dùng khỏi các hệ thống khác.
Đây không phải hướng đi riêng của Meta. ChatGPT agent của OpenAI có thể đọc website, nhấp nút, nhập thông tin và thực hiện nhiều bước liên tiếp, đồng thời dừng lại khi cần người dùng đăng nhập hoặc xác nhận.
Apple cũng đang đưa Siri theo hướng tương tự. Siri mới có thể sử dụng thông tin cá nhân từ tin nhắn, email và hình ảnh, hiểu nội dung đang hiển thị trên màn hình và thực hiện tác vụ qua nhiều ứng dụng.
Điểm thay đổi quan trọng là người dùng không còn nhất thiết phải biết ứng dụng nào dùng để làm một việc cụ thể. Họ chỉ cần mô tả kết quả mong muốn, còn AI quyết định cách thực hiện và sử dụng những dịch vụ cần thiết.
AI bắt đầu gọi điện thay con người
Cuộc gọi điện thoại là một trong những lĩnh vực cho thấy rõ nhất sự chuyển đổi này.
Google đã cho phép người dùng tại Mỹ yêu cầu hệ thống gọi các doanh nghiệp địa phương để kiểm tra hàng hóa, giá bán hoặc tình trạng còn hàng. Google cũng đang thử nghiệm tính năng “Call for Me”, cho phép Gemini thực hiện các cuộc gọi rộng hơn tới doanh nghiệp thay người dùng.
Meta đang phát triển khả năng tương tự cho Muse. Người dùng có thể yêu cầu tác nhân gọi doanh nghiệp, hỏi thông tin hoặc thực hiện một số công việc.
Nếu công nghệ tiếp tục phát triển, những cuộc gọi vốn tiêu tốn nhiều thời gian của con người — đặt lịch, hỏi giá, kiểm tra hàng hóa, thu thập báo giá hay tìm hiểu chính sách đổi trả — có thể ngày càng được giao cho AI.
Một người có thể yêu cầu tác nhân tìm dịch vụ phù hợp, hỏi giá, thương lượng thời gian rồi chỉ tham gia khi cần đưa ra quyết định cuối cùng.
Google hiện yêu cầu Gemini thông báo ngay đầu cuộc gọi rằng đây là trợ lý AI đang gọi thay mặt người dùng và cuộc gọi được ghi âm. Điều này cho thấy khi AI bắt đầu đại diện cho con người trong giao tiếp thực tế, minh bạch và quyền riêng tư sẽ trở thành một phần của bài toán công nghệ.
Email và tin nhắn chuyển từ truyền đạt sang ủy quyền
Sự thay đổi trong email và tin nhắn có thể diễn ra âm thầm hơn. Hiện nay, người dùng viết email, gửi yêu cầu rồi chờ người khác trả lời. Khi AI có khả năng hành động, nội dung giao tiếp có thể chuyển dần từ truyền đạt thông tin sang ủy quyền công việc.
Một yêu cầu gửi cho AI có thể bao gồm mục tiêu, ngân sách, thời hạn và các điều kiện mà người dùng đặt ra. AI xử lý phần lớn quá trình và chỉ quay lại khi cần quyết định.
Muse của Meta đã được thiết kế theo hướng này. Tác nhân có thể gửi email, đặt chuyến đi, thực hiện giao dịch và làm việc với các dịch vụ trực tuyến. Với những hành động nhạy cảm, hệ thống yêu cầu người dùng xác nhận.
Nếu các tác nhân ngày càng đáng tin cậy, người dùng có thể không cần viết từng email hoặc trả lời từng yêu cầu. Một phần giao tiếp sẽ diễn ra ở hậu trường, trong khi con người chỉ nhận kết quả hoặc những trường hợp cần can thiệp. Khi đó, hộp thư điện tử và ứng dụng nhắn tin có thể không chỉ là nơi con người trao đổi văn bản mà còn trở thành nơi các tác nhân làm việc thay mặt họ.
Internet có thể trở thành nơi các tác nhân giao tiếp
Bước tiếp theo là cho phép các tác nhân AI giao tiếp trực tiếp với nhau.
Google đã từ năm ngoái công bố giao thức Agent2Agent (A2A), được thiết kế để các tác nhân do những nhà cung cấp khác nhau xây dựng có thể phối hợp. Google cho rằng khả năng này cần thiết khi doanh nghiệp sử dụng ngày càng nhiều tác nhân để xử lý các công việc như mua sắm, chăm sóc khách hàng và quản lý chuỗi cung ứng.
Một kịch bản có thể là người dùng yêu cầu tác nhân cá nhân tìm chuyến công tác. Tác nhân liên hệ với hệ thống đặt vé, khách sạn và phương tiện di chuyển để thu thập lựa chọn. Các dịch vụ này cũng có thể sử dụng tác nhân AI để phản hồi, kiểm tra chỗ, tính giá hoặc đưa ra điều kiện.
Con người vẫn đưa ra quyết định cuối cùng, nhưng nhiều cuộc trao đổi cần thiết để đi đến quyết định có thể diễn ra giữa các hệ thống.
Nếu xu hướng này phát triển, Internet sẽ không chỉ là nơi con người tìm kiếm thông tin và trực tiếp sử dụng dịch vụ. Nó có thể trở thành môi trường trong đó các tác nhân liên tục tìm kiếm, trao đổi, xác nhận và thực hiện giao dịch thay mặt con người.
Điều này cũng khiến cuộc cạnh tranh AI không chỉ xoay quanh việc mô hình nào trả lời câu hỏi tốt hơn. Các công ty còn muốn trở thành lớp giao diện mà người dùng giao việc thường xuyên nhất.
Smartphone có thể mất vai trò trung tâm
Charm cho thấy Meta đang thử nghiệm nhiều dạng thiết bị để đưa AI đến gần người dùng hơn.
Thiết bị có màn hình khoảng 2 inch, kết nối 5G và cho phép truy cập Muse mà không cần lấy điện thoại ra. Meta đồng thời giới thiệu các sản phẩm kính mới, trong đó có kính Ray-Ban Meta Audio không có camera.
Đây là một phần trong cuộc tìm kiếm các thiết bị có thể thay đổi cách người dùng tiếp cận AI. Kính có lợi thế vì nằm trong tầm nhìn và có thể nghe giọng nói. Tai nghe cho phép tương tác mà không cần nhìn màn hình. Một thiết bị nhỏ như Charm có thể nằm trong túi hoặc gắn vào móc khóa.
Điều này không nhất thiết có nghĩa smartphone sẽ biến mất. Thay vào đó, người dùng có thể sử dụng nhiều thiết bị khác nhau để tiếp cận cùng một tác nhân AI, tùy hoàn cảnh.
Trong mô hình đó, phần cứng trở thành phương tiện tiếp cận, còn tác nhân AI mới là lớp giao diện chính.
Khi AI trở thành “đại diện” của con người
Một thay đổi sâu hơn có thể liên quan đến chính khái niệm địa chỉ liên lạc.
Ngày nay, một người có số điện thoại, địa chỉ email và tài khoản trên các mạng xã hội. Những địa chỉ này cho phép người khác tìm và liên hệ trực tiếp với họ.
Khi mỗi người có một tác nhân AI đại diện, một lớp địa chỉ mới có thể xuất hiện. Người khác hoặc doanh nghiệp có thể gửi yêu cầu tới tác nhân thay vì tìm cách liên hệ trực tiếp với chủ nhân. Tác nhân có thể biết lịch trình, những điều kiện có thể chấp nhận và việc gì cần chuyển cho người dùng quyết định.
Một người có thể không cần liên tục trả lời những câu hỏi như “thời gian nào phù hợp?”, “còn hàng không?”, “giá bao nhiêu?” hay “có thể đổi lịch không?”. Tác nhân có thể xử lý dựa trên quyền hạn được cấp.
Nhưng để mô hình này hoạt động, các tác nhân phải có cách xác thực danh tính, quyền hạn và mức độ tin cậy của nhau. Nếu một AI được phép mua hàng, đặt dịch vụ hoặc thực hiện giao dịch thay người dùng, hệ thống phải xác định được tác nhân đó có thực sự được ủy quyền hay không.
Đây có thể trở thành một lớp hạ tầng mới bên cạnh các hệ thống nhận dạng và thanh toán hiện nay.
Con người vẫn phải đứng sau AI
Một nghịch lý đang xuất hiện ngay trong giai đoạn đầu của làn sóng tác nhân AI: máy được thiết kế để làm việc thay con người, nhưng để hoạt động đáng tin cậy trong thế giới thực, con người vẫn có thể phải đứng phía sau.
Thử nghiệm của Meta với “trợ lý con người” cho Muse là một ví dụ. Việc nhân viên xử lý những cuộc gọi AI gặp khó khăn cho thấy tự động hóa chưa đồng nghĩa với loại bỏ hoàn toàn con người khỏi quy trình.
Khi AI được trao nhiều quyền hơn, những câu hỏi về trách nhiệm cũng trở nên quan trọng hơn: Nếu tác nhân đặt nhầm chuyến bay, gửi nhầm email hoặc mua nhầm sản phẩm, ai chịu trách nhiệm? Nếu hai tác nhân AI thương lượng với nhau, con người sẽ can thiệp ở đâu? Nếu một tác nhân bị lừa bởi website hoặc hệ thống khác, hậu quả thuộc về ai?
Trong nhiều thập niên, Internet được xây dựng chủ yếu để con người tìm kiếm, đọc, nhắn tin, gọi điện và trực tiếp thực hiện giao dịch. Thế hệ tác nhân AI mới đang hướng tới một Internet trong đó một phần những công việc đó được giao cho các hệ thống có khả năng tự tìm thông tin, giao tiếp và hành động.
Nếu xu hướng này trở thành phổ biến, câu hỏi khi sử dụng AI sẽ dần chuyển từ “AI có thể làm gì?” sang “Tôi cho phép AI làm gì thay mình?”

CEO Meta Mark Zuckerberg giới thiệu thiết bị Muse Charm tại sự kiện Meta Connect ở trụ sở công ty tại Menlo Park, California, Mỹ, ngày 23-9-2026. Ảnh: Reuters

Apple giới thiệu tác nhân Siri AI. Ảnh: Internet

Với khả năng thực hiện nhiều thao tác hơn trên toàn hệ thống, Siri AI có thể giúp người dùng thực hiện các tác vụ như soạn email. Ảnh: Apple

