Через дистиляцию. США обвинили китайские ИИ-компании в масштабной краже данных
Агентства США заявили, что DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun и Z.AI могли с конца 2024 года массово получать данные от передовых американских ИИ-моделей для обучения собственных систем.
Об этом пишет издание Gizmodo .
Агентство национальной безопасности США (NSA), Агентство по кибербезопасности и защите инфраструктуры (CISA) и ФБР обнародовали совместное заявление, в котором обвинили китайские компании в использовании дистилляции в «промышленных масштабах» против американских разработчиков искусственного интеллекта.
По данным американских ведомств, компании DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun и Z.AI могли при содействии китайских властей получить миллиарды фрагментов данных в ходе миллионов запросов к американским моделям ИИ. Речь идет, в частности, о моделях и их версиях от Anthropic, OpenAI, Google и xAI.
Дистилляция сама по себе является распространенным и правомерным методом разработки ИИ. Более мощная модель-«учитель» передает меньшей модели знания и способы получения более точных результатов. Благодаря этому можно создать более компактную систему, сохраняющую часть возможностей более крупной модели.
В то же время компании, занимающиеся разработкой ИИ, пытаются препятствовать несанкционированному использованию этого метода. В Anthropic заявляют, что модели, созданные путем незаконной дистилляции, могут не иметь необходимых механизмов защиты и представлять угрозу для национальной безопасности.
В США уже ранее обвиняли DeepSeek в использовании дистилляции. В прошлом году OpenAI заявляла, что располагает собственными доказательствами того, что китайская компания получала данные из её моделей без разрешения.
В то же время генеральный директор OpenAI Сэм Альтман в июле выразил менее жесткую позицию. Он заявил, что не хотел бы, чтобы другие компании использовали дистилляцию моделей OpenAI, но отметил, что это не входит в десятку главных проблем, которые его беспокоят.
Заявление американских ведомств появилось в преддверии запланированных переговоров США и Китая по вопросам безопасности искусственного интеллекта. По данным Reuters, встреча американских и китайских официальных лиц должна состояться в сентябре.
