- 约书亚·卡弗里(Joshua Caffery)教授在Alexa因无法识别而将卡真(Cajun)艺术家杜威·巴尔法(Dewey Balfa)的音乐错放成杜阿·利帕(Dua Lipa)后,开发了一款针对路易斯安那法语的AI语音识别模型,这表明主流AI尚无法理解地方语言。
- 该项目利用童谣、民间录音、访谈和历史演出资料,来训练专门针对路易斯安那法语的自动语音识别模型。
- 路易斯安那研究中心馆藏了超过12,000小时的音频资料,其中包括跨越数十年的口述历史、民间音乐以及多种格式的录音。
- 研究人员通过手工转录构建了标准数据集,随后对名为“Tataille”的开源模型进行微调以提高准确率。
- 训练后的模型能够识别路易斯安那法语特有的拼写和动词变位方式,而不是从互联网上的主流数据中进行盲目推导。
- 专家警告称,AI对少数群体语言的错误识别可能会对招聘、医疗保健以及许多其他数字服务产生负面影响。
- 路易斯安那法语曾是一种通用语言,但在1921年宪法颁布后,由于担心受到歧视,许多家庭停止了传授。到2023年,使用者仅剩约12万人。
- 研究团队期望AI能协助保护和传授该语言,并激励新一代使用本土语言去创作音乐、文化和数字内容。
- 📌 结论: 生成式AI与语音识别技术不仅服务于提高生产力,更有望成为保护文化遗产的利器。通过在12,000多小时的文献馆藏和地方数据上训练模型,研究团队正将路易斯安那法语带入数字时代。这种方法也为保护其他众多少数群体语言开辟了新途径,帮助各社群在未来牢牢掌握自身文化认同与数字资产的控制权。
Previous ArticleAI 并不恐怖,恐怖的是人类仍然比相信机器更相信缺乏控制的判断
Next Article AI 可能在惠及劳动者之前先让投资者致富
Related Posts
© 2026 Vietmetric
