Reuters: китайские военные обучают свои модели ИИ на разработках американских компаний OpenAI и Anthropic

Reuters: китайские военные обучают свои модели ИИ на разработках американских компаний OpenAI и Anthropic © Getty Images
Агентство изучило, как Китай использует американский ИИ в интересах своей армии.

Исследователи китайской армии использовали данные ведущих американских моделей искусственного интеллекта, разработанных OpenAI и Anthropic, для обучения своих систем искусственного интеллекта с целью развития обороноспособности Китая, сообщает агентство Reuters со ссылкой на более 80 китайских научных статей и патентов.

Эти ранее не обнародованные данные дают редкую возможность понять, как военные и силовые ведомства в Китае используют самые современные американские модели искусственного интеллекта в качестве быстрого пути к разработке собственных специализированных систем, несмотря на усилия Вашингтона по ограничению доступа Пекина к передовым микросхемам и другим стратегическим технологиям.

«Фантастика стала реальностью»: эксперт проанализировал случайный взлом Hugging Face с помощью модели OpenAI
«Фантастика стала реальностью»: эксперт проанализировал случайный взлом Hugging Face с помощью модели OpenAI

Документы демонстрируют широкое использование метода, известного как «дистилляция модели», при котором исходные данные крупной системы искусственного интеллекта используются для обучения более мелких, специализированных моделей, которые можно развертывать локально без огромных вычислительных ресурсов, необходимых для создания передовых систем искусственного интеллекта с нуля.

В своем обзоре Reuters опирается на исследование фонда Джеймстауна и отмечает, что дистилляция широко используется исследователями, связанными с Народно-освободительной армией и другими военными учреждениями Китая.

В документах отмечается, что китайские оборонные ведомства рассматривают ведущие американские модели искусственного интеллекта как источник технической информации, так и способ сократить отставание от американских конкурентов.

Спор касается именно несанкционированного извлечения, а не самого процесса дистилляции, который является широко распространенной отраслевой практикой. Этот вопрос стал одним из главных камней преткновения в преддверии переговоров между США и Китаем по вопросам регулирования и безопасности искусственного интеллекта. Американские чиновники обвинили некоторые китайские организации в использовании дистилляции для извлечения возможностей из американских моделей искусственного интеллекта, что потенциально подрывает экспортный контроль и нарушает права интеллектуальной собственности. Китай отверг эти обвинения, заявив, что Вашингтон стремится к «гегемонизму» в сфере ИИ, и утверждает, что американские компании также прибегают к подобным практикам.

Китайские разработчики также опровергают утверждения, что их достижения в области ИИ основаны на зарубежных моделях. На прошлой неделе стартап в сфере ИИ Moonshot опроверг обвинения администрации Дональда Трампа в том, что его модель Kimi K3 была создана с использованием дистилляции, заявив, что она основана на собственных инновациях.

Ученый из Джеймстауна Санни Ченг, проанализировавший более 60 китайских работ, сказал, что китайские военные ученые систематически фиксируют этапы рассуждений западных моделей, чтобы адаптировать их для наблюдения, кибервойны и принятия тактических решений.

«Научить модель правильному ответу — это одно, но научить ее обосновывать этот ответ гораздо сложнее. Эти статьи свидетельствуют о том, что китайские исследователи, связанные с военными структурами, пытаются перенести эти дорогостоящие запатентованные алгоритмы западных моделей в более простые системы, которыми они могут управлять и развертывать на местном уровне», — отметил он.

Агентство Reuters проверило академическую литературу и обнаружило ещё два десятка тематических исследований, связанных с военной деятельностью. В одной статье, опубликованной в прошлом году исследователями из подразделения 96941 НОАК— подразделения военной разведки и кибервойны в Пекине, — описано использование OpenAI GPT-3.5 для обработки конфиденциального военного исходного кода.

Исследователи отметили, что сторонние модели не подходят для обработки секретной информации. Чтобы преодолеть это ограничение, они использовали GPT-3.5 для обобщения программного кода и обучили на основе этих обобщений отечественную модель, которая работает исключительно в пределах китайских военных сетей.

Как показал анализ научных статей, проведенный агентством Reuters и организацией Джеймстаун, китайские исследователи использовали дистилляцию для различных целей — от мониторинга контента до военного применения.

В Северном университете Китая, который имеет тесные связи с оборонной промышленностью страны, исследователи использовали модель Claude 3 Haiku от компании Anthropic для генерации синтетических обучающих данных для модели классификации текста, предназначенной для мониторинга социальных сетей и модерации контента.

Компания Anthropic заявила, что не предоставляет коммерческого доступа к Claude в Китае или компаниям, контролируемым Пекином, и использует системы мониторинга для выявления нарушений политики.

Компания также добавила, что дистиллированные модели могут лишиться мер безопасности оригинальных систем, что потенциально может привести к передаче конфиденциальных возможностей моделям, находящимся вне её контроля.

В статье 2024 года, опубликованной Национальным университетом оборонных технологий НВА, описано использование дистилляции для уменьшения размера модели обработки изображений с целью ее развертывания на беспилотных летательных аппаратах, что позволяет дронам анализировать видео в режиме реального времени и поддерживать навигацию и принятие решений по наведению на цель даже в случае прерывания связи.

Аналогично, как показало исследование, опубликованное в начале этого года, исследователи из Китайской академии военных наук использовали дистилляцию для запуска модели распознавания целей на тактическом оборудовании во время имитированных морских операций с участием дронов, кораблей и беспилотных подводных аппаратов.

Китай активно внедряет технологию дистилляции, стремясь конкурировать с США в сфере передовых технологий искусственного интеллекта и, в то же время сталкиваясь с ограничениями в доступе к современным вычислительным ресурсам из-за экспортного контроля Вашингтона над высокотехнологичными микросхемами. Центральное правительство и местные органы власти содействуют «упрощению моделей» и периферийным вычислениям, направляя субсидии и средства на исследования технологий, позволяющих моделям искусственного интеллекта работать на дронах, спутниках и других устройствах с ограниченной вычислительной мощностью.

Однако эксперты предупреждают, что дистилляция имеет существенные ограничения. По мере того как китайские модели искусственного интеллекта сокращают отставание от своих американских аналогов, военные исследователи также изучают дистилляцию как потенциальный риск для безопасности.

В январе исследователи из Инженерного университета армии опубликовали статью об угрозе «дистилляции без данных» — метод реверс-инжиниринга возможностей модели без прямого доступа к её основным параметрам.

Чтобы противодействовать этой уязвимости, они предложили защитные механизмы, предназначенные для маскировки скрытой логической информации, которая проявляется в публичных результатах работы модели. Они также отметили, что дистиллированные модели также наследуют лишь отдельные возможности и не способны полностью воспроизвести широкие интеллектуальные способности передовых систем.

Заметили ошибку?

Пожалуйста, выделите ее мышкой и нажмите Ctrl+Enter или Отправить ошибку

Добавить комментарий
Всего комментариев: 0
Текст содержит недопустимые символы
Осталось символов: 2000
Пожалуйста выберите один или несколько пунктов (до 3 шт.) которые по Вашему мнению определяет этот комментарий.
Пожалуйста выберите один или больше пунктов
Нецензурная лексика, ругань Флуд Нарушение действующего законодательства Украины Оскорбление участников дискуссии Реклама Разжигание розни Признаки троллинга и провокации Другая причина Отмена Отправить жалобу ОК
Оставайтесь в курсе последних событий!
Подписывайтесь на наш канал в Telegram
Следить в Телеграмме