• Исследование CTGT показывает, что модели ИИ, полученные путем дистилляции из открытых моделей DeepSeek или Moonshot, не обязательно наследуют механизмы политической цензуры оригинальной модели.
  • На вопрос о лагерях для уйгуров модель DeepSeek отрицала наличие доказательств, в то время как модель, обученная CTGT на данных DeepSeek, признала наличие свидетельств о центрах содержания под стражей.
  • Этот результат ставит под сомнение одно из главных опасений правительства США о том, что китайский ИИ с открытым исходным кодом будет распространять политические взгляды Пекина.
  • CTGT использовала метод дистилляции, при котором большая модель генерирует данные для обучения меньшей модели.
  • Ранее исследователи предполагали, что цензура может передаваться новой модели через процесс обучения, но экспериментальные результаты этого не подтвердили.
  • CTGT оценила 152 пары вопросов, включая темы, связанные с Китаем, и контрольные вопросы, используя модели xAI, Google, OpenAI и Anthropic для оценки результатов.
  • Исследование охватило только одну пару моделей и пока не объяснило механизм, по которому цензура не наследуется.
  • По данным CTGT, многие финансовые компании не решаются использовать китайский ИИ из-за опасений, что цензура исказит результаты анализа.
  • В отчете говорится, что настройка или дообучение китайских моделей ИИ может помочь бизнесу воспользоваться их низкой стоимостью и высокой производительностью.
  • Автор также отметил, что если цензуру можно удалить, то и другие механизмы безопасности могут быть отключены, что повышает риск злоупотребления ИИ.
  • Некоторые официальные лица США опасаются «бэкдоров» в китайском ИИ, но в статье указано, что на данный момент верифицированных доказательств этому нет.
  • Исследование рассматривается как база для пересмотра политики ограничений в отношении китайского ИИ, при этом подчеркивается необходимость дальнейшего изучения темы.

📌 Новое исследование ставит под сомнение мнение о том, что китайские ИИ-модели с открытым исходным кодом автоматически передают механизмы цензуры в дообученные версии. Это может изменить отношение бизнеса и регуляторов к китайскому ИИ. Однако в работе также содержится предупреждение: если цензуру легко обойти, то и другие барьеры безопасности могут быть отключены, что требует более жесткого управления ИИ.

Share.
VIET NAM CONSULTING AND MEASUREMENT JOINT STOCK COMPANY
KONTAKT

Электронная почта: info@vietmetric.vn
Адрес: Дом 34, переулок 91, улица Чан Зуй Хынг, район Йен Хоа, город Ханой

© 2026 Vietmetric
Exit mobile version