- Исследование CTGT показывает, что модели ИИ, полученные путем дистилляции из открытых моделей DeepSeek или Moonshot, не обязательно наследуют механизмы политической цензуры оригинальной модели.
- На вопрос о лагерях для уйгуров модель DeepSeek отрицала наличие доказательств, в то время как модель, обученная CTGT на данных DeepSeek, признала наличие свидетельств о центрах содержания под стражей.
- Этот результат ставит под сомнение одно из главных опасений правительства США о том, что китайский ИИ с открытым исходным кодом будет распространять политические взгляды Пекина.
- CTGT использовала метод дистилляции, при котором большая модель генерирует данные для обучения меньшей модели.
- Ранее исследователи предполагали, что цензура может передаваться новой модели через процесс обучения, но экспериментальные результаты этого не подтвердили.
- CTGT оценила 152 пары вопросов, включая темы, связанные с Китаем, и контрольные вопросы, используя модели xAI, Google, OpenAI и Anthropic для оценки результатов.
- Исследование охватило только одну пару моделей и пока не объяснило механизм, по которому цензура не наследуется.
- По данным CTGT, многие финансовые компании не решаются использовать китайский ИИ из-за опасений, что цензура исказит результаты анализа.
- В отчете говорится, что настройка или дообучение китайских моделей ИИ может помочь бизнесу воспользоваться их низкой стоимостью и высокой производительностью.
- Автор также отметил, что если цензуру можно удалить, то и другие механизмы безопасности могут быть отключены, что повышает риск злоупотребления ИИ.
- Некоторые официальные лица США опасаются «бэкдоров» в китайском ИИ, но в статье указано, что на данный момент верифицированных доказательств этому нет.
- Исследование рассматривается как база для пересмотра политики ограничений в отношении китайского ИИ, при этом подчеркивается необходимость дальнейшего изучения темы.
📌 Новое исследование ставит под сомнение мнение о том, что китайские ИИ-модели с открытым исходным кодом автоматически передают механизмы цензуры в дообученные версии. Это может изменить отношение бизнеса и регуляторов к китайскому ИИ. Однако в работе также содержится предупреждение: если цензуру легко обойти, то и другие барьеры безопасности могут быть отключены, что требует более жесткого управления ИИ.

