- Giáo sư Joshua Caffery phát triển mô hình AI nhận dạng giọng nói cho tiếng Pháp Louisiana sau khi Alexa phát nhạc Dua Lipa thay vì nghệ sĩ Cajun Dewey Balfa, cho thấy AI phổ thông chưa hiểu các ngôn ngữ địa phương.
- Dự án sử dụng các bài đồng dao, ghi âm dân gian, phỏng vấn và biểu diễn lịch sử để huấn luyện mô hình nhận dạng tiếng nói tự động dành riêng cho tiếng Pháp Louisiana.
- Trung tâm Nghiên cứu Louisiana lưu trữ hơn 12.000 giờ tư liệu âm thanh, gồm lịch sử truyền miệng, nhạc dân gian và ghi âm trên nhiều định dạng kéo dài nhiều thập kỷ.
- Các nhà nghiên cứu xây dựng bộ dữ liệu chuẩn bằng cách phiên âm thủ công, sau đó tinh chỉnh mô hình nguồn mở mang tên Tataille để cải thiện độ chính xác.
- Mô hình sau huấn luyện nhận diện được cách viết và cách chia động từ đặc trưng của tiếng Pháp Louisiana thay vì suy diễn từ dữ liệu phổ thông trên Internet.
- Các chuyên gia cảnh báo AI nhận dạng sai ngôn ngữ thiểu số có thể ảnh hưởng đến tuyển dụng, chăm sóc sức khỏe và nhiều dịch vụ số khác.
- Tiếng Pháp Louisiana từng là ngôn ngữ phổ biến, nhưng sau Hiến pháp năm 1921, nhiều gia đình ngừng truyền dạy vì lo bị phân biệt đối xử. Năm 2023 còn khoảng 120.000 người sử dụng.
- Nhóm nghiên cứu kỳ vọng AI sẽ giúp bảo tồn, truyền dạy và khuyến khích thế hệ mới sáng tạo âm nhạc, văn hóa và nội dung số bằng ngôn ngữ địa phương.
📌AI tạo sinh và nhận dạng giọng nói không chỉ phục vụ năng suất mà còn có thể trở thành công cụ bảo tồn di sản văn hóa. Bằng cách huấn luyện mô hình trên hơn 12.000 giờ tư liệu và dữ liệu địa phương, nhóm nghiên cứu đang đưa tiếng Pháp Louisiana vào kỷ nguyên số. Cách tiếp cận này cũng mở ra cơ hội bảo vệ nhiều ngôn ngữ thiểu số khác, giúp cộng đồng giữ quyền kiểm soát bản sắc và tài sản số của mình trong tương lai.
Tổng hợp

