- Joshua Caffery(ジョシュア・カフェリー)教授は、Alexaがケイジャン(Cajun)人アーティストのデューイ・バルファの代わりにデュア・リパの音楽を再生したことをきっかけに、普及型のAIが地方言語をまだ理解していないことに気づき、ルイジアナ・フランス語向けのAI音声認識モデルを開発しました。
- このプロジェクトでは、ルイジアナ・フランス語に特化した自動音声認識モデルを訓練するために、わらべ歌、民俗録音、インタビュー、歴史的なパフォーマンスを利用しています。
- ルイジアナ研究センターには、数十年間にわたる口承史、民俗音楽、さまざまなフォーマットの録音など、12,000時間以上の音声資料が保管されています。
- 研究者たちは手動による文字起こし(サンプリング)を通じて標準データセットを構築し、その後「Tataille」と呼ばれるオープンソースモデルを微調整(ファインチューニング)して正確性を向上させました。
- 訓練後のモデルは、インターネット上の一般的なデータから推測するのではなく、ルイジアナ・フランス語に特有の綴りや動詞の活用を認識することができます。
- 専門家は、AIによる少数民族言語の誤認識が、採用活動、医療、その他の多くのデジタルサービスに悪影響を及ぼす可能性があると警告しています。
- ルイジアナ・フランス語はかつて広く使われていた言語でしたが、1921年の憲法制定以降、差別を恐れて多くの家庭が子供への継承を辞めました。2023年時点での話者は約12万人となっています。
- 研究チームは、AIが地方言語の保存や教育を助け、新しい世代が独自の言語で音楽、文化、デジタルコンテンツを創造することを後押しすると期待しています。
- 📌 結論: 生成AIや音声認識技術は、生産性の向上に役立つだけでなく、文化遺産を保存するための重要なツールにもなり得ます。12,000時間以上の資料と地方のデータに基づいてモデルを訓練することにより、研究チームはルイジアナ・フランス語をデジタル時代へと導いています。このアプローチは、他の多くの少数言語を保護する機会をも切り拓き、コミュニティが将来にわたって自らのアイデンティティやデジタル資産の管理権を維持するのに貢献するでしょう。
Previous ArticleAIは怖くない。恐ろしいのは、人間がいまだに機械よりも制御を欠いた判断を信じていることだ
Next Article AIは労働者に利益をもたらす前に投資家を富ませる可能性がある
