213
/
178350
Rò rỉ hệ thống kiểm duyệt mới của Trung Quốc
ro-ri-he-thong-kiem-duyet-moi-cua-trung-quoc
news

Rò rỉ hệ thống kiểm duyệt mới của Trung Quốc

Thứ 2, 31/03/2025 | 16:04:00
2,096 lượt xem

Một tập dữ liệu bị rò rỉ tiết lộ chính phủ Trung Quốc đang phát triển hệ thống kiểm duyệt tiên tiến dựa trên các mô hình ngôn ngữ quy mô lớn (LLM).

Hệ thống kiểm duyệt này không chỉ nhắm đến những chủ đề cấm kỵ truyền thống mà còn mở rộng sang các vấn đề nhạy cảm khác như tình trạng nghèo đói ở nông thôn, tham nhũng trong lực lượng cảnh sát hay đội ngũ lãnh đạo. 

Trung Quốc muốn sử dụng AI để nâng cao sức mạnh kiểm duyệt nội dung trên mạng

Tập dữ liệu dung lượng khoảng 300 GB này được phát hiện bởi nhà nghiên cứu bảo mật NetAskari, cho thấy cách mà mô hình ngôn ngữ quy mô lớn của Trung Quốc phân loại thông tin. Tập dữ liệu này được lưu trữ trong một cơ sở dữ liệu Elasticsearch không được bảo vệ trên máy chủ của công ty công nghệ Baidu, với các mục nhập mới nhất từ tháng 12.2024.

Tập dữ liệu chứa khoảng 133.000 mục nhập và có các tham chiếu đến "eb35" và "eb_speedpro", cho thấy đây là bộ dữ liệu đào tạo cho chatbot AI Ernie Bot của Baidu. NetAskari cho rằng tập dữ liệu này đang được sử dụng để phát triển một "hệ thống AI tiên tiến" nhằm tự động gắn cờ nội dung nhạy cảm cho chính phủ Trung Quốc.

Nhiều mục tiêu kiểm duyệt được quan tâm

Nội dung mục tiêu kiểm duyệt bao gồm các khiếu nại về tình trạng nghèo đói ở nông thôn, các bản tin về tham nhũng và các bài đăng liên quan đến tham nhũng tống tiền doanh nhân. Các vấn đề chính trị, xã hội và quân sự được "ưu tiên cao" trong tập dữ liệu này, yêu cầu phải được đánh dấu ngay lập tức. Đặc biệt, từ "Đài Loan" được nhắc đến hơn 15.000 lần, cho thấy sự quan tâm lớn của Trung Quốc đối với tình hình chính trị tại đây.

Xiao Zhang, một nhà nghiên cứu an ninh tại Đại học California, Berkeley (Mỹ) nhận định tập dữ liệu này là "bằng chứng rõ ràng cho thấy chính phủ Trung Quốc hoặc các chi nhánh của họ muốn sử dụng LLM để tăng cường kiểm duyệt nội dung". Các phương pháp kiểm duyệt trước đây của Trung Quốc chủ yếu dựa vào các thuật toán cơ bản để tự động chặn các từ bị cấm. Tuy nhiên, LLM có khả năng phát hiện những lời chỉ trích khó xác định bằng các thuật toán thông thường, giúp việc kiểm duyệt trở nên hiệu quả hơn. 

Theo Kiến Văn/ Thanh niên

https://thanhnien.vn/ro-ri-he-thong-kiem-duyet-moi-cua-trung-quoc-185250329193522686.htm

  • Từ khóa

Giáo dục trong kỷ nguyên AI, từ sử dụng đến làm chủ công nghệ

Việc đưa trí tuệ nhân tạo (AI) vào trường học đã được thí điểm trong năm học 2025-2026 và định hướng triển khai đại trà từ năm học 2026–2027. Nhìn lại...
17:00 - 08/09/2026
314 lượt xem

Những phụ kiện USB từng nổi tiếng nay trở thành dĩ vãng

Từng được xem là biểu tượng của kỷ nguyên máy tính cá nhân, nhiều phụ kiện USB nổi tiếng nay đã bị công nghệ hiện đại thay thế hoàn toàn.
10:22 - 03/09/2026
99 lượt xem

Điều cần biết khi muốn dùng bộ sạc smartphone cho laptop

Sạc smartphone cho laptop giúp giảm số bộ sạc phải mang theo, nhưng cáp và công suất cũng cần được kiểm tra.
08:18 - 03/09/2026
83 lượt xem

Nguyên nhân bất ngờ khiến ổ cứng bỗng dưng hoạt động chậm chạp

Tình trạng ổ cứng chạy chậm chạp không chỉ gây đơ lag hệ thống mà còn có thể là dấu hiệu cảnh báo phần cứng sắp hỏng hoàn toàn.
15:02 - 02/09/2026
97 lượt xem

Bảo vệ dữ liệu cá nhân: Yêu cầu cấp thiết từ thực tiễn

Trong bối cảnh chuyển đổi số diễn ra mạnh mẽ, dữ liệu cá nhân không chỉ gắn với quyền riêng tư của mỗi người mà còn trở thành tài nguyên quan trọng đối...
15:05 - 02/09/2026
101 lượt xem
pixel