Công nghệ

Cách ngăn Facebook lấy dữ liệu để huấn luyện AI

Các mô hình AI hiện nay cần nguồn dữ liệu đầu vào khổng lồ về "học". Những dữ liệu này được thu thập từ nhiều nguồn trên mạng như hình ảnh, bài viết, bình luận... và trong đó có cả thông tin cá nhân của người dùng mạng xã hội.

Meta cung cấp cho người dùng tùy chọn thay đổi hoặc xóa bất kỳ dữ liệu cá nhân nào của họ mà công ty sử dụng để đào tạo ngôn ngữ lớn và mô hình AI liên quan. Theo cập nhật mới nhất, người dùng có thể vào trang trợ giúp, truy cập mục Quyền của chủ thể dữ liệu đối với AI tạo sinh.

Tại đây có ba lựa chọn gồm: "Tôi muốn truy cập, tải xuống hoặc sửa thông tin cá nhân bất kỳ mà các bên thứ ba cung cấp dùng cho AI tạo sinh"; "Tôi muốn xóa mọi thông tin cá nhân mà các bên thứ ba cung cấp để dùng cho AI tạo sinh" và "Ý kiến khác".

Logo Meta hiển thị trên smartphone, phía sau là ánh sáng đèn LED của một bo mạch chủ. Ảnh: Reuters

Logo Meta hiển thị trên smartphone, phía sau là ánh sáng đèn LED của một bo mạch chủ. Ảnh: Reuters

Với tùy chọn đầu tiên, người dùng có thể tải về dữ liệu đã bị "bên thứ ba" thu thập và xem xét trước khi đồng ý cho Meta dùng chúng để đào tạo AI. Trong khi đó, tùy chọn thứ hai yêu cầu nền tảng xóa những gì đang lưu trữ. Nếu có yêu cầu khác, người dùng cần cung cấp họ tên, quốc gia cư trú và email cùng ý kiến của mình, sau đó gửi đi.

Sau khi chọn một trong ba tùy chọn, họ cũng cần vượt qua bài kiểm tra kiểm tra bảo mật. Tuy nhiên, theo CNBC, một số người phản ánh không thể hoàn thành biểu mẫu vì "có vẻ như lỗi phần mềm".

Dữ liệu nào đang được Meta thu thập?

Meta định nghĩa thông tin của bên thứ ba là dữ liệu "được cung cấp công khai trên Internet hoặc các nguồn được cấp phép". Hãng cho biết loại thông tin này "có thể đại diện cho một số trong số hàng tỷ mẫu dữ liệu" được sử dụng để đào tạo AI bằng cách dùng những gì thu thập được cho tổng hợp, dự đoán và tạo ra nội dung mới.

Trong bài đăng blog ngày 30/8, Meta cho biết họ lấy thông tin công khai này, bên cạnh việc dùng dữ liệu được cấp phép từ các đối tác. "Để dạy mô hình theo cách hiệu quả, chúng tôi cần một lượng dữ liệu lớn. Do đó, chúng tôi dùng kết hợp các nguồn khác nhau trong quá trình đào tạo. Những nguồn này gồm thông tin công khai trên mạng, thông tin được cấp phép, cũng như thông tin từ các sản phẩm và dịch vụ của Meta", bài viết nêu.

Trong quá trình thu thập, Meta có thể lấy được cả thông tin cá nhân. Chẳng hạn một bài viết công khai có thể chứa thông tin tác giả. Công ty nói trong quá trình lấy dữ liệu, quyền riêng tư của người dùng được đảm bảo và có đội ngũ chuyên trách để làm điều này.

Meta hiện vận hành mô hình ngôn ngữ lớn LLaMA, được công bố đầu năm nay. Nó hoạt động dưới dạng mở, cho phép nhà nghiên cứu và tổ chức chính phủ, xã hội, học viện dùng miễn phí. Phát ngôn viên Meta cho biết phiên bản LLaMA thế hệ mới, LLaMA 2, chưa sử dụng dữ liệu của người dùng trên các nền tảng như Facebook, Instagram của Meta để huấn luyện AI.

"Tùy vào nơi sinh sống, mọi người có thể thực hiện quyền làm chủ dữ liệu, có thể phản đối chúng tôi khai thác một số dữ liệu nhất định để đào tạo AI", phát ngôn viên Meta nói. "Họ có quyền biết thông tin của họ đang được chúng tôi sử dụng thế nào".

Đến nay, hầu hết công ty công nghệ như Meta, Microsoft, Google hay OpenAI vẫn thu thập dữ liệu công khai trên Internet để phục vụ quá trình huấn luyện AI. Tuy nhiên, giới chuyên môn nhiều lần đặt câu hỏi về việc lượng lớn thông tin thu được đang sử dụng thế nào.

Tuần trước, liên minh gồm các cơ quan bảo vệ dữ liệu từ Anh, Canada, Thụy Sĩ và một số quốc gia khác đưa ra tuyên bố chung rằng các công ty công nghệ lớn như Meta, Alphabet, ByteDance, X, Microsoft cần phải tuân theo luật bảo vệ dữ liệu và quyền riêng tư tùy theo những nơi đang hoạt động. Nhóm khuyến cáo người dùng cần có ý thức cao hơn trong việc kiểm soát và bảo vệ thông tin đưa lên Internet.

Các tin khác

Mua nhà trong ngõ: Sau hoang mang vì dính quy hoạch, nữ nhân viên vỡ oà hạnh phúc vì nhà trong ngõ bỗng ra mặt đường

Ban đầu, nữ nhân viên đến từ Hà Nội còn lo lắng tưởng mất trắng khi biết tin lô đất này chạm vào quy hoạch mở đường. Thế nhưng, khi kiểm tra lại, đường mở rộng chỉ chạm tới 8 cm phần đất. Lô đất bỗng trở thành “đắt giá” nhờ nằm sát mặt đường.

NĐT cá nhân và các tổ chức trong nước giao dịch thế nào trước kỳ nghỉ lễ 2/9?

Kịch bản dòng tiền qua kênh khớp lệnh tại các nhóm nhà đầu tư đã có sự thay đổi so với tuần trước khi khối ngoại mua ròng trở lại với giá trị gần 716 tỷ đồng sau 4 tuần bán ra liên tiếp trước đó, trong khi cá nhân trong nước đảo chiều bán ròng với giá trị gần 409 tỷ đồng.

Vụ ô tô tông hàng loạt xe máy: Trách nhiệm khi giao xe cho người 16 tuổi điều khiển?

Liên quan đến vụ xe ôtô 4 chỗ tông hàng loạt xe máy khi dừng đèn đỏ trên Quốc lộ 1 khiến 5 người bị thương, khi gây tai nạn tài xế mới 16 tuổi. Theo quy định Luật Giao thông đường bộ thì người lái xe gây tai nạn và cả người giao xe cho người chưa đủ điều kiện đều có hành vi vi phạm pháp luật.

Tác giả đường "né" tử thần

Qua đèo Hải Vân hay các con đèo, tuyến đường đồi dốc trên khắp cả nước, những người ôm vô lăng giờ đây quá quen với đường cứu nạn. Biết bao chiếc xe mất phanh, mất lái, bao hành khách đã thoát khỏi lưỡi hái tử thần nhờ con đường trông có vẻ đơn sơ này. Nhưng ít ai biết rằng, hơn 30 năm trước, một người con miền Trung đã ròng rã thức trắng đêm để tính toán, thai nghén và quyết làm cho bằng được công trình chưa nơi nào có bởi quá xót thương bà con gặp nạn trên dặm dài Bắc Nam.