Компания Anthropic опубликовала отчет, в котором заявила о систематических попытках так называемых атак дистилляции, направленных на их передовые ИИ-модели. По данным разработчика, в последние месяцы конкуренция в сфере искусственного интеллекта привела к усилению активности со стороны китайских технологических компаний, пытающихся копировать возможности американских систем.

Масштабные кампании по перехвату логики нейросетей
Согласно отчету, сторонние лаборатории используют все более сложные методы для обхода защитных барьеров Anthropic. Злоумышленники стремятся «harvesting» или собрать ключевые интеллектуальные активы модели Claude, включая навыки использования инструментов (agentic capabilities), написания программного кода, анализа данных и ведения логических рассуждений. Всего компания зафиксировала около 200 миллионов запросов, распределенных между пятью независимыми кампаниями.
Суть дистилляционных атак заключается в извлечении «цепочки рассуждений» (chain of thought), которую модель использует для формирования ответа. Обычно Anthropic скрывает эти внутренние процессы от пользователей, отображая лишь краткие резюме. Однако в рамках атак злоумышленники находили способы обмануть модель, заставляя её раскрывать пошаговый процесс анализа данных. Один из обнаруженных методов включал манипуляцию через запрос о переводе, где атакующий просил модель перевести «рабочую память» на японский язык (катакана), чтобы получить доступ к скрытым логическим следам.
Детали деятельности Alibaba и Moonshot AI
Наиболее масштабная кампания, по оценке Anthropic, была связана с корпорацией Alibaba. В период с мая по июль 2026 года специалисты зафиксировали 151 миллион попыток взаимодействия, пиковая нагрузка достигала трех миллионов запросов в сутки. Несмотря на использование 3500 различных аккаунтов, общая структура запросов указала на централизованную попытку собрать материалы для обучения моделей семейства Qwen.
Специфика атак со стороны Moonshot AI
Отдельный блок в отчете посвящен компании Moonshot AI, известной разработкой модели Kimi. Anthropic утверждает, что часть запросов к их нейросети могла поступать напрямую из структур китайских военных. В частности, зафиксированы попытки использовать Claude для анализа записей с камер видеонаблюдения с целью определения того, «ведет ли себя субъект аномально». В течение десятидневного периода через сеть из 5000 учетных записей было пропущено около 300 тысяч запросов, которые преимущественно были направлены на модель Opus.
Ранее Anthropic уже высказывалась о проблеме дистилляционных атак в феврале, а OpenAI также сообщала о подозрительной активности, связывая её с разработчиками из DeepSeek. Тем не менее, нынешняя серия атак, описанная в сентябрьском отчете, характеризуется как значительно более агрессивная и масштабная по охвату попытка перехвата технологий американских рубежных моделей.






