Cách ngăn Facebook lấy dữ liệu để huấn luyện AI

Người dùng Internet có thể xóa thông tin cá nhân đang bị Meta thu thập cho việc đào tạo mô hình AI tạo sinh.

Các mô hình AI hiện nay cần nguồn dữ liệu đầu vào khổng lồ về "học". Những dữ liệu này được thu thập từ nhiều nguồn trên mạng như hình ảnh, bài viết, bình luận... và trong đó có cả thông tin cá nhân của người dùng mạng xã hội.

Meta cung cấp cho người dùng tùy chọn thay đổi hoặc xóa bất kỳ dữ liệu cá nhân nào của họ mà công ty sử dụng để đào tạo ngôn ngữ lớn và mô hình AI liên quan. Theo cập nhật mới nhất, người dùng có thể vào trang trợ giúp, truy cập mục Quyền của chủ thể dữ liệu đối với AI tạo sinh.

Tại đây có ba lựa chọn gồm: "Tôi muốn truy cập, tải xuống hoặc sửa thông tin cá nhân bất kỳ mà các bên thứ ba cung cấp dùng cho AI tạo sinh"; "Tôi muốn xóa mọi thông tin cá nhân mà các bên thứ ba cung cấp để dùng cho AI tạo sinh" và "Ý kiến khác".

Logo Meta hiển thị trên smartphone, phía sau là ánh sáng đèn LED của một bo mạch chủ. Ảnh: Reuters

Với tùy chọn đầu tiên, người dùng có thể tải về dữ liệu đã bị "bên thứ ba" thu thập và xem xét trước khi đồng ý cho Meta dùng chúng để đào tạo AI. Trong khi đó, tùy chọn thứ hai yêu cầu nền tảng xóa những gì đang lưu trữ. Nếu có yêu cầu khác, người dùng cần cung cấp họ tên, quốc gia cư trú và email cùng ý kiến của mình, sau đó gửi đi.

Sau khi chọn một trong ba tùy chọn, họ cũng cần vượt qua bài kiểm tra kiểm tra bảo mật. Tuy nhiên, theo CNBC, một số người phản ánh không thể hoàn thành biểu mẫu vì "có vẻ như lỗi phần mềm".

Dữ liệu nào đang được Meta thu thập?

Meta định nghĩa thông tin của bên thứ ba là dữ liệu "được cung cấp công khai trên Internet hoặc các nguồn được cấp phép". Hãng cho biết loại thông tin này "có thể đại diện cho một số trong số hàng tỷ mẫu dữ liệu" được sử dụng để đào tạo AI bằng cách dùng những gì thu thập được cho tổng hợp, dự đoán và tạo ra nội dung mới.

Trong bài đăng blog ngày 30/8, Meta cho biết họ lấy thông tin công khai này, bên cạnh việc dùng dữ liệu được cấp phép từ các đối tác. "Để dạy mô hình theo cách hiệu quả, chúng tôi cần một lượng dữ liệu lớn. Do đó, chúng tôi dùng kết hợp các nguồn khác nhau trong quá trình đào tạo. Những nguồn này gồm thông tin công khai trên mạng, thông tin được cấp phép, cũng như thông tin từ các sản phẩm và dịch vụ của Meta", bài viết nêu.

Trong quá trình thu thập, Meta có thể lấy được cả thông tin cá nhân. Chẳng hạn một bài viết công khai có thể chứa thông tin tác giả. Công ty nói trong quá trình lấy dữ liệu, quyền riêng tư của người dùng được đảm bảo và có đội ngũ chuyên trách để làm điều này.

Meta hiện vận hành mô hình ngôn ngữ lớn LLaMA, được công bố đầu năm nay. Nó hoạt động dưới dạng mở, cho phép nhà nghiên cứu và tổ chức chính phủ, xã hội, học viện dùng miễn phí. Phát ngôn viên Meta cho biết phiên bản LLaMA thế hệ mới, LLaMA 2, chưa sử dụng dữ liệu của người dùng trên các nền tảng như Facebook, Instagram của Meta để huấn luyện AI.

"Tùy vào nơi sinh sống, mọi người có thể thực hiện quyền làm chủ dữ liệu, có thể phản đối chúng tôi khai thác một số dữ liệu nhất định để đào tạo AI", phát ngôn viên Meta nói. "Họ có quyền biết thông tin của họ đang được chúng tôi sử dụng thế nào".

Đến nay, hầu hết công ty công nghệ như Meta, Microsoft, Google hay OpenAI vẫn thu thập dữ liệu công khai trên Internet để phục vụ quá trình huấn luyện AI. Tuy nhiên, giới chuyên môn nhiều lần đặt câu hỏi về việc lượng lớn thông tin thu được đang sử dụng thế nào.

Tuần trước, liên minh gồm các cơ quan bảo vệ dữ liệu từ Anh, Canada, Thụy Sĩ và một số quốc gia khác đưa ra tuyên bố chung rằng các công ty công nghệ lớn như Meta, Alphabet, ByteDance, X, Microsoft cần phải tuân theo luật bảo vệ dữ liệu và quyền riêng tư tùy theo những nơi đang hoạt động. Nhóm khuyến cáo người dùng cần có ý thức cao hơn trong việc kiểm soát và bảo vệ thông tin đưa lên Internet.

Cách ngăn Facebook lấy dữ liệu để huấn luyện AI

Tin xem nhiều

Mớ tiền giả giúp giám đốc chi nhánh ngân yên tâm "thụt két" 1,2 tỷ đồng trong nửa tháng

Chốt giá vàng hôm nay ngày 26/6 tăng rất mạnh trở lại

Giá nhà Hà Nội tăng gần 100% sau 4 năm, căn hộ dưới 25 triệu đồng/m² biến mất khỏi thị trường: Chuyên gia nói gì?

Diễn biến mới trong thương vụ phát hành hơn 4 tỷ cổ phiếu của Vinhomes

Mặt tối tại Meta bị 1 cuốn hồi ký chấn động bóc trần: Lãnh đạo quấy rối nhân viên, thực hiện hàng loạt sai phạm

Lượng khách tăng cao dịp hè, Vietnam Airlines Group khuyến nghị hành khách chủ động thời gian làm thủ tục

"Đầu cơ bất động sản không biến mất nhưng bản chất đã thay đổi"

Thị trường quạt, điều hòa tại Pháp "vỡ trận" doanh số vì nắng nóng kỷ lục, các đại gia điện tử châu Á "trúng đậm"

Nên mua vàng bây giờ hay chờ giá giảm thêm?

Chuyên gia: Nếu tính cả dư nợ của 18 dự án được loại trừ, tăng trưởng tín dụng toàn hệ thống năm 2026 có thể đạt 19%

Các tin khác