Bạn có thể chuyển sang phiên bản mobile rút gọn của Tri thức trực tuyến nếu mạng chậm. Đóng

#FORMAT

Chặn nội dung độc hại trước khi thành 'bão mạng'

Thay vì chỉ chờ gỡ bỏ, các nền tảng và cơ quan quản lý các nước quyết định tìm cách chặn nội dung độc hại ngay từ khâu phân phối, tiếp cận và lan truyền.

Thế giới

Chặn nội dung độc hại
trước khi
thành 'bão mạng'

Thay vì chỉ chờ gỡ bỏ, các nền tảng và cơ quan quản lý các nước quyết định tìm cách chặn nội dung độc hại ngay từ khâu phân phối, tiếp cận và lan truyền.

Phương Linh

nội dung độc hại ảnh 1

Một video gây sốc có thể nhanh chóng thu hút hàng triệu lượt xem và chia sẻ trước khi nền tảng kịp gỡ bỏ. Khi đó, nội dung ban đầu có thể đã được sao chép, đăng lại và tiếp tục lan truyền trên nhiều dịch vụ khác.

Không chỉ xử lý sau khi nội dung đã phát tán, nhiều nền tảng và cơ quan quản lý ở Anh, Pháp, EU, Australia... đang đưa các biện pháp can thiệp lên sớm hơn, từ kiểm soát cách thuật toán phân phối nội dung, giới hạn người có thể tiếp cận, đến phát hiện và xử lý những nội dung có dấu hiệu lan truyền bất thường.

Những “điểm chặn” này tạo thành nhiều lớp kiểm soát, nhằm giảm khả năng nội dung gây hại tiếp cận số đông trước khi nó đạt quy mô khó kiểm soát.

Không để thuật toán khuếch đại

Một nội dung không nhất thiết phải bị xóa mới có thể bị hạn chế. YouTube là một trong những nền tảng áp dụng rõ nhất cách tiếp cận này, bằng cách tách việc cho phép nội dung tồn tại khỏi việc đưa nội dung đó vào hệ thống đề xuất.

Từ năm 2019, YouTube bắt đầu giảm đề xuất đối với “borderline content” (những nội dung "ngấp nghé") - những video chưa vi phạm đến mức phải gỡ bỏ nhưng có thể gây hại hoặc chứa thông tin sai lệch.

Theo nền tảng, sau khi thay đổi hệ thống đề xuất tại Mỹ, thời gian xem nhóm nội dung này từ các đề xuất dành cho người chưa đăng ký kênh giảm trung bình 70%. YouTube cho biết hiện nội dung borderline đến từ hệ thống đề xuất chiếm dưới 1% tổng lượng tiêu thụ loại nội dung này.

Điểm đáng chú ý là video không nhất thiết biến mất. Người dùng vẫn có thể tìm thấy nếu chủ động tìm kiếm, nhưng thuật toán không tiếp tục đẩy video lên trang chủ hoặc mục “Up next”.

nội dung độc hại ảnh 2

YouTube giảm đề xuất đối với những video chưa vi phạm đến mức phải gỡ bỏ nhưng có thể gây hại hoặc chứa thông tin sai lệch. Ảnh: Reuters.

YouTube cũng sử dụng đánh giá của con người để huấn luyện hệ thống tự động nhận diện nội dung có nguy cơ. Với những chủ đề nhạy cảm như sức khỏe, nền tảng cho biết họ sử dụng các nguồn đánh giá có chuyên môn để xác định những nội dung nào nên được ưu tiên trong kết quả tìm kiếm và đề xuất.

Cách làm này tạo ra một lớp trung gian giữa “cho phép” và “cấm”. Nội dung chưa đủ nghiêm trọng để xóa không đồng nghĩa với việc nền tảng phải giúp nó tiếp cận thêm hàng triệu người.

Một trường hợp cụ thể là QAnon (chuỗi các thuyết âm mưu cực hữu hoàn toàn không có cơ sở, xuất phát từ Mỹ vào năm 2017). YouTube cho hay sau khi thay đổi hệ thống đề xuất vào tháng 1/2019, số lượt xem nội dung QAnon từ các đề xuất dành cho người chưa đăng ký tại những kênh QAnon nổi bật giảm hơn 80%. Cùng thời gian, nền tảng cũng gỡ hàng chục nghìn video và đóng hàng trăm kênh vi phạm chính sách.

TikTok cũng có một cơ chế tương tự. Theo nền tảng, không phải tất cả nội dung được phép xuất hiện trên TikTok đều đủ điều kiện được đưa vào For You. Một số nội dung có thể bị loại khỏi hệ thống đề xuất dù vẫn tồn tại trên nền tảng.

TikTok còn cho biết họ kiểm tra lại những bài đăng đang tăng mạnh về mức độ phổ biến để bảo đảm chúng đáp ứng các tiêu chuẩn áp dụng cho lượng người dùng rộng hơn. Nếu một tài khoản thường xuyên đăng nội dung không đủ điều kiện xuất hiện trên For You, tài khoản và các bài đăng có thể bị hạn chế khả năng tiếp cận; tài khoản cũng có thể khó được tìm thấy hơn trong kết quả tìm kiếm.

THAY VÌ CHỈ CHỜ NGƯỜI DÙNG BÁO CÁO, NỀN TẢNG CÓ THỂ NHÌN VÀO CÁCH NỘI DUNG ĐANG LAN TRUYỀN ĐỂ QUYẾT ĐỊNH CÓ CẦN THÊM MỘT LỚP KIỂM TRA HAY KHÔNG

Đây là điểm quan trọng bởi một nội dung có vài trăm lượt xem và một nội dung tăng từ vài nghìn lên hàng trăm nghìn lượt xem trong thời gian ngắn tạo ra hai mức rủi ro rất khác nhau.

Đặt “hàng rào” trước người dùng

Một điểm can thiệp khác nằm ở người tiếp nhận, đặc biệt với trẻ em.

Tại Anh, Online Safety Act yêu cầu các dịch vụ trực tuyến thực hiện đánh giá rủi ro và áp dụng biện pháp bảo vệ trẻ em trước nội dung gây hại. Từ ngày 7/2025, các dịch vụ cho phép người dùng đăng tải hoặc truy cập nội dung khiêu dâm phải triển khai biện pháp xác minh độ tuổi đủ hiệu quả để ngăn trẻ em tiếp cận loại nội dung này. Ofcom cũng yêu cầu các dịch vụ có khả năng được trẻ em sử dụng đánh giá rủi ro và thực hiện biện pháp giảm thiểu phù hợp.

nội dung độc hại ảnh 3

Một số nước ngăn nội dung độc hại bằng cách kiểm soát ai có thể tiếp cận nội dung. Ảnh: Reuters.

Ofcom cho biết quy định mới không chỉ áp dụng với các website khiêu dâm chuyên biệt mà còn bao gồm những dịch vụ cho phép người dùng tự đăng tải nội dung khiêu dâm. Sau thời hạn 25/7/2025, cơ quan này đã mở các cuộc điều tra đối với nhiều nhà cung cấp để kiểm tra việc tuân thủ.

Cách tiếp cận này xuất phát từ thực tế rằng trẻ em thường không chủ động tìm kiếm nội dung gây hại mà có thể bắt gặp chúng trong quá trình sử dụng dịch vụ. Theo Ofcom, trong nhóm trẻ 11-17 tuổi từng tiếp xúc với nội dung khiêu dâm trực tuyến, 42% cho biết họ bắt gặp nội dung này khi đang lướt bảng tin, trong khi chỉ 2% chủ động tìm kiếm.

Australia áp dụng một cách tiếp cận rộng hơn với nguyên tắc khi yêu cầu an toàn được tính đến ngay từ khâu thiết kế và phát triển sản phẩm. eSafety Commissioner cho rằng các doanh nghiệp cần chủ động dự đoán, phát hiện và loại bỏ những nguy cơ có thể gây hại, thay vì chỉ bổ sung biện pháp bảo vệ sau khi sự cố xảy ra.

Theo eSafety, cách tiếp cận này có thể bao gồm thiết kế công cụ báo cáo và chặn dễ sử dụng, kiểm soát những tính năng có nguy cơ bị lạm dụng, thiết lập giới hạn đối với trẻ em và xây dựng cơ chế phản ứng khi xuất hiện hành vi gây hại.

Cơ quan này cũng lưu ý nguy cơ có thể phát sinh ở cả ba khâu sản xuất, phân phối và tiếp nhận nội dung. Vì vậy, các biện pháp phòng ngừa có thể được triển khai ở bất kỳ mắt xích nào, từ ngăn nội dung được tạo ra, hạn chế khả năng phát tán đến kiểm soát đối tượng có thể tiếp cận.

Phát hiện sớm, chặn trước khi lan rộng

Ngay cả khi một nội dung chưa đủ mức để bị gỡ bỏ, thời điểm nó bắt đầu lan nhanh vẫn là một “điểm chặn” quan trọng. Khi đó, tốc độ phát tán có thể vượt xa khả năng kiểm chứng và xử lý của nền tảng.

Một số nền tảng và cơ quan quản lý vì vậy ngày càng chú ý tới những tín hiệu như tốc độ tăng lượt xem, số lần chia sẻ hoặc mức độ tương tác bất thường để xác định nội dung cần kiểm tra.

Community Notes của X là một ví dụ đáng chú ý. Một nghiên cứu công bố trên Nature Communications năm 2026 phân tích 237.180 chuỗi lan truyền với hơn 431 triệu lượt repost. Các nhà nghiên cứu nhận thấy khi Community Notes xuất hiện trên những bài đăng gây hiểu lầm, số lượt repost tiếp theo giảm trung bình 61,2%; khả năng người đăng tự xóa bài tăng 94,3%.

nội dung độc hại ảnh 4

Community Notes của X cho phép cộng đồng bổ sung thông tin, cảnh báo hoặc ngữ cảnh dưới các bài đăng gây hiểu lầm. Ảnh: Reuters.

Các tác giả kết luận rằng Community Notes có tác dụng rõ rệt sau khi được hiển thị, nhưng thời gian phản ứng vẫn là một hạn chế lớn. Xét trên toàn hệ thống, cơ chế này chỉ làm giảm tổng mức độ tương tác với các bài đăng gây hiểu lầm khoảng 14,9%.

Đó là lý do eSafety Commissioner đề xuất các nền tảng xây dựng những cơ chế mà cơ quan này gọi là “human circuit breakers” - có thể hiểu là những “bộ ngắt” có con người tham gia - để can thiệp vào những trường hợp nội dung có dấu hiệu lan truyền bất thường.

YOUTUBE BẮT ĐẦU GIẢM ĐỀ XUẤT ĐỐI VỚI “BORDERLINE CONTENT”, TỨC NHỮNG VIDEO CHƯA VI PHẠM ĐẾN MỨC PHẢI GỠ BỎ NHƯNG CÓ THỂ GÂY HẠI HOẶC CHỨA THÔNG TIN SAI LỆCH

Trong thời gian chờ xác minh, nền tảng có thể giảm đề xuất hoặc hạn chế khả năng lan rộng. Nếu xác định nội dung vi phạm, biện pháp mạnh hơn như gỡ bỏ hoặc xử lý tài khoản có thể được áp dụng. Nếu không vi phạm, nội dung có thể tiếp tục được phân phối.

EU bổ sung một “điểm chặn” khác bằng mạng lưới trusted flaggers - các tổ chức có chuyên môn được cơ quan quản lý công nhận để báo cáo nội dung bất hợp pháp.

Tại Pháp, Arcom đã chỉ định các tổ chức hoạt động trong những lĩnh vực như bảo vệ trẻ em, chống bạo lực trực tuyến và chống phân biệt đối xử làm trusted flaggers. Các thông báo của những tổ chức này phải được nền tảng ưu tiên xử lý theo cơ chế của Đạo luật Dịch vụ số.

Từ YouTube, TikTok đến các mô hình quản lý tại Anh, Australia và EU, những biện pháp này cho thấy việc ngăn nội dung độc hại có thể diễn ra ở nhiều khâu, từ phân phối, tiếp cận đến phát hiện sớm, thay vì chỉ chờ đến bước gỡ bỏ.

Những chiếc bẫy vô hình trên mạng xã hội

Cuốn sách Vũ trụ kỹ thuật số của giáo sư Kim Sang Kyun đã đi sâu phân tích, mổ xẻ một cách tường tận, những tác động các thiết bị thông minh, thế giới ảo và mạng xã hội trong cuộc sống hiện đại.

Thế giới xử lý 'giang hồ mạng' ra sao?

Thế giới xử lý 'giang hồ mạng' ra sao?

0

Bắt streamer, cắt nguồn thu, cấm tài khoản hay phạt tù là những cách nhiều nước trên thế giới áp dụng để xử lý nội dung gây sốc trên mạng.

Phương Linh

Bạn có thể quan tâm