Anthropic afirmă că a identificat și oprit mai multe utilizări malițioase ale asistentului său Claude, inclusiv campanii de supraveghere, proiectarea unor arme și escrocherii online. Operațiunile au fost detectate între ianuarie și iulie și ar fi avut legături cu actori din China, Iran și Africa de Vest.
Potrivit raportului companiei americane, instrumentele de inteligență artificială au fost folosite pentru monitorizarea unor disidenți și minorități etnice. Printre persoanele vizate s-ar fi numărat:
- figuri prodemocrație din Hong Kong;
- comunități tibetane și membri ai mișcării Falun Gong din Asia;
- minorități iraniene și opozanți ai regimului de la Teheran aflați în străinătate.
Într-unul dintre cazuri, actori iranieni ar fi creat o metodă de identificare a unor persoane pornind de la conturile acestora de pe rețelele sociale. Separat, un furnizor care lucra pentru autoritățile de securitate națională din Mali a utilizat Claude la dezvoltarea software-ului destinat colectării de informații.
Alte utilizări abuzive identificate
Anthropic susține că a blocat și tentative de proiectare a unor arme, cercetări biologice considerate suspecte și dezvoltarea unor aplicații false de întâlniri, create pentru a înșela utilizatorii.
Compania nu a făcut publice identitățile persoanelor implicate în studiile biologice. Anthropic precizează că acestea sunt cercetători activi și că nu afirmă că ar fi urmărit să provoace daune, în condițiile în care dezvăluirea numelor lor sau a laboratoarelor ar putea să îi pună în pericol.
Cercetările analizate vizau virusul chikungunya, transmis de țânțari, o tulpină de gripă aviară cu grad ridicat de patogenitate, virusuri din familia care include variola și mpox, precum și veninuri și alte toxine.
Anthropic acuză companii chineze
În același raport, Anthropic le acuză pe companiile chineze Moonshot și DeepSeek că ar fi folosit în secret Claude pentru a răspunde solicitărilor propriilor clienți și pentru a colecta rezultate utile la antrenarea modelelor lor. Practica este cunoscută drept „distilare” și a mai fost reclamată de laboratoare americane, inclusiv Anthropic și OpenAI.
Compania afirmă că, într-un interval de zece zile, Moonshot a transmis către sistemele Anthropic aproape 300.000 de solicitări ale utilizatorilor. Cererile ar fi fost direcționate prin 5.380 de conturi frauduloase, dintre care majoritatea păreau să fie localizate în Singapore și Japonia.
O parte dintre solicitări ar fi conținut date sensibile, ceea ce ar putea ridica probleme privind protecția vieții private. Anthropic spune că nu știe dacă Moonshot și-a informat clienții că mesajele lor erau redirecționate către companie și deveneau accesibile unei terțe părți.