
Anthropic видалив приховану систему відстеження з Claude Code після того, як дослідник безпеки виявив, що асистент кодування ШІ використовував нерозголошені маркери для ідентифікації місцезнаходження деяких користувачів, використання проксі-серверів та можливих зв’язків з китайськими лабораторіями ШІ.
Ця функція, виявлена у червні розробником «Thereallo», вбудовувала сигнали у системні підказки Claude Code, які могли позначати користувачів, яких Anthropic вважав такими, що обходять обмеження або намагаються вилучити можливості моделі.
«Anthropic, ймовірно, хоче виявляти реселерів API, неавторизовані шлюзи Claude Code та канали «атак дистиляції» моделі, — написав Thereallo. — Користувацький ANTHROPIC_BASE_URL, що вказує на відомий домен реселера, є корисним сигналом. Ім’я хоста, що містить deepseek або zhipu, також є корисним сигналом».
Thereallo зазначив, що спроба Anthropic виявити реселерів, неавторизовані шлюзи Claude Code та потенційні атаки дистиляції має сенс, але розкритикував спосіб її виконання, зауваживши, що Claude Code приховував сигнали відстеження всередині системних підказок, використовуючи маркери Unicode та закодовані списки доменів, замість того, щоб розкривати систему через документацію або примітки до випуску.
«Це не зловмисна функція, але це дивний вибір для інструменту розробника, який вимагає довіри», — написав Thereallo.
Після того, як трекер був розкритий онлайн, інженер Anthropic Тарік Шихіпар повідомив на X, що його було впроваджено в березні як «експеримент» для запобігання зловживанню обліковими записами неавторизованими реселерами та захисту Claude від атак дистиляції.
«Відтоді команда застосувала сильніші заходи пом'якшення, і ми насправді давно хотіли це прибрати», — написав Шихіпар минулого тижня. «Ми об’єднали [pull request], і це має бути повністю скасовано в завтрашньому релізі».
Ця новина з'явилася, оскільки Anthropic посилив попередження щодо дистиляції моделей ШІ, коли виходи однієї системи використовуються для навчання іншої моделі. Хоча ця практика є поширеною в дослідженнях ШІ, коли справа доходить до геополітики, дистиляція стає проблемою національної безпеки. На початку цього місяця Alibaba заборонила своїм співробітникам використовувати Claude Code, назвавши інструмент «високоризикованим» програмним забезпеченням через проблеми безпеки.
У лютому Anthropic звинуватив китайських розробників ШІ DeepSeek, Moonshot AI та MiniMax у використанні шахрайських облікових записів для вилучення мільйонів відповідей Claude для навчання конкуруючих моделей. Ці заяви викликали опір критиків, які поставили під сумнів, чим ця практика відрізняється від методів, що використовуються в індустрії ШІ.
У квітні Ілон Маск свідчив, що xAI «частково» використовував моделі OpenAI під час навчання Grok, назвавши дистиляцію ширшою галузевою практикою. У червні генеральний директор Anthropic Даріо Амодеї закликав Конгрес посилити захист від іноземного вилучення ШІ після того, як стверджував, що оператори, пов’язані з Alibaba, згенерували 28,8 мільйона обмінів Claude, використовуючи майже 25 000 шахрайських облікових записів.
Anthropic не відповів відразу на запит Decrypt щодо коментарів.