Meta khẳng định AI agent Muse chỉ được truy cập dữ liệu khi người dùng cấp quyền. Tuy nhiên, một thử nghiệm độc lập cho biết Muse đã đồng bộ khoảng 187.000 dòng dữ liệu từ Apple Messages dù người dùng chưa cấp quyền, đặt ra câu hỏi về cơ chế bảo vệ dữ liệu của AI agent.
Meta Muse là AI agent gì?
Meta Muse là AI agent được Meta phát triển để thực hiện nhiều nhiệm vụ thay người dùng, từ nghiên cứu thông tin, tạo bản tóm tắt đến hỗ trợ mua sắm. Khác với chatbot thông thường chỉ phản hồi yêu cầu, Muse được thiết kế để chủ động thực hiện nhiều bước nhằm hoàn thành nhiệm vụ.
Theo Meta, Muse hoạt động trên một máy tính ảo riêng và có thể sử dụng dữ liệu từ những ứng dụng hoặc nguồn thông tin được kết nối. Công ty khẳng định AI agent phải tuân thủ quyền truy cập do người dùng thiết lập, không tự ý lấy dữ liệu ngoài phạm vi được cấp phép. Tuy nhiên, một thử nghiệm độc lập gần đây lại cho thấy kết quả đáng chú ý.

Muse được cho là đã xử lý 187.000 dòng dữ liệu Messages
Theo Jason Aten, cây viết của Inc, ông cài Muse trên iPhone và một máy Mac mini dùng để thử nghiệm AI agent. Chỉ sau khoảng một ngày, Muse bắt đầu đưa ra ý tưởng bài viết dựa trên các tin nhắn giữa ông và một người đồng dẫn podcast.
Khi được hỏi nguồn thông tin, Muse cho biết dữ liệu đến từ các banner thông báo xuất hiện khi có tin nhắn mới. Tuy nhiên, Aten tiếp tục kiểm tra và phát hiện lượng dữ liệu được xử lý lớn hơn nhiều. Theo kết quả thử nghiệm được công bố, Muse đã đồng bộ khoảng 187.000 dòng dữ liệu từ cơ sở dữ liệu của ứng dụng Apple Messages. Đáng chú ý, tính năng Full Disk Access trên máy Mac được cho là đã tắt.
Aten cũng cho biết ông chưa cấp quyền cho Muse truy cập Messages. Dữ liệu được đề cập là Apple Messages, không phải Messenger của Meta. Đây vẫn là kết quả từ một thử nghiệm độc lập, chưa phải kết luận chính thức rằng Muse đã cố tình vượt qua cơ chế phân quyền của hệ điều hành. Tuy nhiên, phát hiện này đủ để đặt câu hỏi về cách AI agent tiếp cận dữ liệu trên thiết bị.
Vì sao AI agent khiến vấn đề riêng tư phức tạp hơn?
Vấn đề đáng chú ý không chỉ nằm ở con số 187.000 dòng dữ liệu mà còn ở cách AI agent hoạt động. Với chatbot truyền thống, người dùng thường chủ động cung cấp nội dung để AI xử lý. Ngược lại, AI agent có thể tương tác với nhiều ứng dụng, trình duyệt, tệp tin và nguồn dữ liệu nhằm hoàn thành một nhiệm vụ.
Điều này khiến ranh giới giữa dữ liệu được phép truy cập và dữ liệu nằm ngoài phạm vi cấp quyền trở nên quan trọng hơn. Chỉ một sai sót trong cơ chế phân quyền cũng có thể khiến AI tiếp cận lượng thông tin lớn hơn dự kiến.
Đặc biệt, dữ liệu tin nhắn có thể chứa thông tin của nhiều người. Một người không sử dụng Meta vẫn có thể xuất hiện trong dữ liệu nếu họ trao đổi với người đã cài Muse.

Meta không phải công ty duy nhất đối mặt với bài toán dữ liệu
Vụ việc Muse xuất hiện trong bối cảnh Meta từng nhận nhiều sự chú ý về cách các sản phẩm AI xử lý dữ liệu cá nhân. Trước đây, Meta từng đề nghị người dùng Facebook cho phép tải liên tục thư viện ảnh lên cloud để phục vụ các tính năng AI, trong đó hệ thống có thể phân tích thời gian, địa điểm và chủ đề của hình ảnh.
Các thiết bị đeo thông minh của Meta cũng từng làm dấy lên câu hỏi về quyền riêng tư, đặc biệt liên quan đến cơ chế thông báo khi thiết bị đang ghi hình. Những trường hợp này cho thấy khi AI ngày càng được tích hợp sâu vào thiết bị cá nhân, câu hỏi không chỉ là hệ thống có thu thập dữ liệu hay không mà còn là AI được phép nhìn thấy bao nhiêu thông tin và người dùng kiểm soát quyền truy cập đến đâu.
Apple Intelligence cũng sử dụng dữ liệu cá nhân
Meta không phải công ty duy nhất xây dựng AI có khả năng làm việc với dữ liệu cá nhân. Apple Intelligence cũng có thể sử dụng thông tin từ Messages và Mail để hỗ trợ người dùng. Tuy nhiên, Apple ưu tiên xử lý nhiều yêu cầu trực tiếp trên thiết bị. Khi cần xử lý bên ngoài, Apple cho biết dữ liệu liên quan có thể được gửi tới Private Cloud Compute.
Sự khác biệt này cho thấy cuộc đua AI không chỉ xoay quanh khả năng của mô hình. Kiến trúc xử lý, quyền truy cập và cách bảo vệ dữ liệu cũng trở thành yếu tố quan trọng. Với AI agent, yêu cầu này càng cao bởi hệ thống không chỉ trả lời mà còn có khả năng thay người dùng thực hiện công việc.
Phát hiện khoảng 187.000 dòng dữ liệu Apple Messages trong thử nghiệm của Jason Aten đang đặt câu hỏi về hàng rào quyền riêng tư mà Meta tuyên bố dành cho Muse. Cần thêm phản hồi và thông tin kỹ thuật từ Meta để xác định chính xác nguyên nhân dẫn tới kết quả này.

Ở phạm vi rộng hơn, vụ việc cho thấy quyền riêng tư sẽ là một trong những bài toán quan trọng khi AI agent ngày càng phổ biến. Khi AI chuyển từ mô hình “người dùng hỏi, AI trả lời” sang “người dùng giao việc, AI tự hoàn thành”, hệ thống sẽ cần tiếp cận nhiều dữ liệu hơn.
Vì vậy, bên cạnh khả năng xử lý và mức độ thông minh, người dùng cũng sẽ cần biết rõ AI đang nhìn thấy dữ liệu gì, được phép làm gì và ai thực sự kiểm soát quyền truy cập đó.
