США говорят, что китайский ИИ втайне учился у ChatGPT и Claude

Вчера ФБР, Агентство национальной безопасности и Агентство по кибербезопасности выпустили совместное предупреждение и назвали 6 китайских компаний, которые, по их версии, годами тайно «заимствовали» чужие технологии. В списке DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun и Z.AI.

Метод называется дистилляция. Компактную модель обучают не на живых данных, а на ответах чужой, более мощной и дорогой модели. Ты просто задаёшь ей миллионы вопросов и учишь свою повторять её ответы, прогоняя миллиарды токенов через миллионы обращений и маскируя запросы через сторонние каналы.

Отдельно DeepSeek обвинили в том, что его знаменитая цифра затрат на обучение около 6 миллионов долларов ложная, ведь на деле модель выросла на чужих вложениях в миллиарды.

По версии ведомств, китайские разработчики так снимали знания с Claude, ChatGPT, Gemini и Grok начиная с конца 2024 года, причём для тонких вещей вроде агентских функций.

Юридически спор упирается в одну развилку. Формально ответы чужой модели очень трудно защитить авторским правом, поэтому обвинение строится не на краже произведения, а на нарушении условий использования сервиса. У всех этих компаний в правилах прямо запрещено использовать выдачу их модели для обучения конкурента.

Ровно на этом уже обжёгся OpenAI. В феврале этого года компания заявила Конгрессу, что DeepSeek через сторонние роутеры обходил ограничения доступа и массово собирал ответы ChatGPT. Юристы Гарварда прямо сказали, что даже неясно, охраняются ли ответы ChatGPT вообще. Ведь сам OpenAI в деле The New York Times настаивает, что обучение на чужом контенте — это добросовестное использование. Получается, что запрет на дистилляцию бьёт по самому OpenAI как бумеранг.

Компания, которая обучила свой ИИ на всём интернете без спроса, теперь требует наказать тех, кто обучил свой ИИ на ней.

Мы тут спорили, можно ли бесплатно брать и обучать. А сейчас — можно или нельзя?

Ещё почитать