Khi các nền tảng công nghệ phải dọn “rác AI”
18/08/26
Những thứ tệ nhất do trí tuệ nhân tạo tạo ra đã tràn khắp internet. Google từng bị che lấp bởi các kết quả tìm kiếm kỳ quặc như công thức pizza phủ keo. Amazon xuất hiện những tiểu sử giả mạo. Facebook tràn ngập hình ảnh “Chúa tôm” và vô số nội dung gây tò mò rẻ tiền. Tất cả được gọi chung bằng một từ ngày càng phổ biến: “AI slop”, hay có thể hiểu là rác AI.
Khi chatbot, công cụ tạo ảnh và video ngày càng mạnh, lượng nội dung được sản xuất tự động cũng phình to. Vấn đề không nằm ở mọi sản phẩm AI. Nhiều nội dung tạo sinh vẫn có thể hữu ích hoặc sáng tạo. Điều các nền tảng đang nhắm tới là lớp nội dung chất lượng thấp, dễ làm, dễ phát tán, dễ tiêu thụ rồi cũng dễ bị quên lãng. Nó giống thời trang nhanh lấn át hàng may đo, hay thứ thịt nghiền rẻ tiền thay thế miếng bít tết thật.
Nếu không được kiểm soát, các nhà nghiên cứu châu Âu cảnh báo lớp đầm lầy kỹ thuật số này có thể lấn át sáng tạo của con người, làm xói mòn giá trị văn hóa và gây bất ổn cho thảo luận công cộng.
Các ông lớn bắt đầu dọn rác
Sau thời gian hưởng lợi từ tương tác do nội dung AI mang lại, nhiều công ty công nghệ phải tự dọn đống rác mà chính hệ sinh thái góp phần tạo ra. Spotify cho biết năm ngoái đã xóa 75 triệu bản tải lên hàng loạt, bài hát trùng lặp và các nội dung âm nhạc bị xem là spam. Con số này là một phần đáng kể trong kho nội dung của nền tảng.
LinkedIn cho biết hồi tháng 7, rác AI là ưu tiên lớn và đã phát triển nút để người dùng báo cáo loại nội dung này. Các nhà nghiên cứu từ Google, công ty mẹ của YouTube, miêu tả cách dịch vụ video xóa 130.000 kênh chất lượng thấp trong sáu tháng.
Không chỉ mạng xã hội hay nền tảng video, nhiều dịch vụ khác cũng đang hành động. Ứng dụng nhắn tin, trang đánh giá nhà hàng, kho lưu trữ học thuật và ứng dụng hẹn hò đều tìm cách loại bỏ hoặc giảm hiển thị nội dung do AI tạo ra. Trớ trêu là nhiều công ty phải dùng chính AI để nhận diện và dọn dẹp rác AI.
Vấn đề do chính nền tảng nuôi lớn
Nghịch lý lớn là nhiều công ty đang chống rác AI cũng là bên đã thúc đẩy công cụ tạo sinh. Tháng 7, Meta cam kết ủng hộ thỏa thuận tại châu Âu nhằm giúp nội dung AI dễ nhận diện hơn bằng phát hiện, gắn nhãn và đánh dấu. Tuy nhiên, cùng tháng đó, công ty tung ra công cụ tạo ảnh tự động đưa các tài khoản Instagram công khai vào làm nguồn tham chiếu. Sau ba ngày bị phản đối, Meta phải gỡ tính năng này.
Google cũng đặt cược mạnh vào AI, tích hợp Gemini vào Gmail, Maps, dịch vụ du lịch và tìm kiếm. Trong thử nghiệm của Kapwing, hơn 20% video ngắn ban đầu mà YouTube đề xuất cho người dùng mới là rác AI. Kapwing ước tính một trong những kênh rác AI phổ biến nhất trên YouTube từng kiếm được 4,25 triệu USD/năm, trước khi bị đình chỉ khỏi chương trình kiếm tiền.
Theo các chuyên gia, rác AI từng giúp nền tảng tăng tương tác. Tuy nhiên, khi lượng nội dung rẻ tiền quá lớn, nó trở thành gánh nặng. Người dùng khó tìm thấy nội dung chất lượng, nền tảng phải đối mặt nguy cơ mất niềm tin.
Cuộc chiến không đơn giản
Các công ty đang dùng nhiều cách khác nhau để xử lý vấn đề. Pinterest cho phép người dùng giới hạn số bài đăng AI xuất hiện trong bảng tin. Tik Tok thử nghiệm tính năng cho phép điều chỉnh lượng nội dung AI hiển thị, đồng thời cho biết đã tự động gắn nhãn hơn 3 tỷ video AI. Trong ba tháng đầu năm, TikTok xóa hơn 377.000 video vi phạm chính sách AI.
Trên X, startup phát hiện AI Pangram cho biết gần một nửa bài đăng dài hơn 50 từ được tạo bằng AI. Để xử lý tình trạng rác AI và spam trả lời, nền tảng đã cấm các ứng dụng khuyến khích bot đăng bài bằng cách trả tiền cho nội dung.
Substack cũng vào cuộc. CEO Chris Best nói ngày càng khó phân biệt điều gì là thật trên internet và các nền tảng thưởng cho sự giả tạo sẽ tạo ra cuộc đua xuống đáy. Substack công bố công cụ phát hiện AI do Pangram hỗ trợ, dùng để quét trả lời, bình luận và bài viết dài hơn 100 từ.
Song, công cụ phát hiện AI cũng gây tranh cãi. Một số tác giả bản tin phàn nàn rằng hệ thống nhận nhầm bài viết của con người là do AI tạo ra, không tính đến vai trò hỗ trợ hợp lý của AI trong sáng tạo, đồng thời buộc người viết phải bảo vệ danh tiếng trước một chỉ số khó hiểu.
Không chỉ là nội dung xấu
Thách thức lớn nhất là chưa ai thật sự thống nhất được rác AI là gì. Tại sự kiện Slop Salon ở Menlo Park, nhiều chuyên gia AI đã thảo luận về khó khăn trong việc phân loại và quản lý loại nội dung này.
Camille François – chuyên gia nghiên cứu công nghệ số gây hại tại Đại học Columbia cho rằng những biện pháp rời rạc hiện nay cho thấy đây là vấn đề mang tính hệ thống của môi trường thông tin, không chỉ là nhóm nội dung xấu có thể định nghĩa rồi xóa bỏ.
AI cuối cùng vẫn là công cụ sáng tạo đa diện. Nếu nền tảng xử lý quá thô bạo, người dùng tốt và nhà sáng tạo chân chính có thể bị ảnh hưởng. Tuy nhiên, nếu không làm gì, internet sẽ tiếp tục bị nhấn chìm trong lớp nội dung rẻ tiền, giả tạo và vô nghĩa. Vì vậy, cuộc dọn rác AI mới chỉ bắt đầu.
shared via nytimes,



