- Nghiên cứu của CTGT cho thấy các mô hình AI được chưng cất (distillation) từ mô hình nguồn mở của DeepSeek hoặc Moonshot không nhất thiết kế thừa cơ chế kiểm duyệt chính trị của mô hình gốc.
- Khi được hỏi về các trại giam người Duy Ngô Nhĩ, mô hình DeepSeek phủ nhận bằng chứng, trong khi mô hình do CTGT huấn luyện từ dữ liệu của DeepSeek lại thừa nhận có bằng chứng về các cơ sở giam giữ.
- Kết quả này thách thức một trong những lo ngại lớn của chính phủ Mỹ rằng AI nguồn mở Trung Quốc sẽ truyền bá quan điểm chính trị của Bắc Kinh.
- CTGT sử dụng phương pháp distillation, trong đó mô hình lớn tạo dữ liệu để huấn luyện mô hình nhỏ hơn.
- Các nhà nghiên cứu từng giả định kiểm duyệt có thể được truyền sang mô hình mới thông qua quá trình học, nhưng kết quả thực nghiệm không xác nhận điều đó.
- CTGT đánh giá 152 cặp câu hỏi, gồm các chủ đề liên quan Trung Quốc và các câu hỏi đối chứng, sử dụng mô hình của xAI, Google, OpenAI và Anthropic để chấm kết quả.
- Nghiên cứu chỉ xem xét một cặp mô hình và chưa giải thích được cơ chế khiến kiểm duyệt không được kế thừa.
- Theo CTGT, nhiều doanh nghiệp tài chính còn do dự sử dụng AI Trung Quốc vì lo ngại kiểm duyệt làm sai lệch kết quả phân tích.
- Báo cáo cho rằng việc tùy biến hoặc tinh chỉnh mô hình AI Trung Quốc có thể giúp doanh nghiệp tận dụng chi phí thấp và hiệu năng cao.
- Tác giả cũng lưu ý nếu có thể loại bỏ kiểm duyệt thì các cơ chế an toàn khác cũng có thể bị loại bỏ, làm gia tăng rủi ro lạm dụng AI.
- Một số quan chức Mỹ còn lo ngại AI Trung Quốc có thể chứa cửa hậu bảo mật, nhưng bài viết cho biết hiện chưa có bằng chứng xác thực.
- Nghiên cứu được xem là cơ sở để đánh giá lại các chính sách hạn chế AI Trung Quốc, đồng thời nhấn mạnh cần tiếp tục nghiên cứu sâu hơn trước khi đưa ra kết luận.
📌 Nghiên cứu mới đặt dấu hỏi đối với quan điểm cho rằng các mô hình AI nguồn mở Trung Quốc sẽ tự động truyền tải cơ chế kiểm duyệt sang các mô hình được tinh chỉnh. Kết quả có thể làm thay đổi cách doanh nghiệp và nhà hoạch định chính sách nhìn nhận AI Trung Quốc. Tuy nhiên, nghiên cứu cũng cảnh báo rằng nếu việc loại bỏ kiểm duyệt trở nên dễ dàng thì các hàng rào an toàn khác cũng có thể bị vô hiệu hóa, đòi hỏi cơ chế quản trị AI chặt chẽ hơn.
Tổng hợp.
