Anthropic dwarsboomt biowapenonderzoek, Russische hack, Chinees misbruik van Claude
In dit artikel:
Anthropic zegt in een op 10 september gepubliceerd dreigingsrapport dat het de afgelopen acht maanden verschillende vormen van misbruik van zijn AI-model Claude heeft ontdekt en verstoord. Het ging onder meer om pogingen om biologische wapens te ontwikkelen, conventionele wapensystemen te ontwerpen en cyberaanvallen grotendeels met AI uit te voeren.
Het bedrijf identificeerde vijf gevallen waarin onderzoekers Claude gebruikten voor werk dat de ontwikkeling van biologische wapens kon ondersteunen. Een onderzoeker gebruikte via een niet-ondersteunde regio wekenlang Claude om experimenten te plannen die vogelgriep mogelijk beter overdraagbaar op zoogdieren zouden maken. Anthropic blokkeerde de betrokken accounts, maar maakte de landen, instellingen en ziekteverwekkers niet bekend.
Ook zouden actoren in China, Rusland en Jemen Claude hebben ingezet voor software rond vuurwapens, raketten en bewapende drones, en voor inlichtingen en inkoop ten behoeve van wapenprogramma’s. Volgens Anthropic onderstreept dit dat de snel verbeterende modellen nieuwe veiligheidsrisico’s creëren.
Daarnaast ontdekte het bedrijf een cybercampagne tegen Oekraïense overheids-, militaire en diplomatieke doelwitten. De vermoedelijk vanuit Rusland aangestuurde groep gebruikte AI voor phishing, het kapen van hotelwifi en WhatsApp-accounts en het automatisch aanpassen van malware wanneer die werd gedetecteerd. De werkwijze vertoonde overeenkomsten met Midnight Blizzard, een groep die door de Amerikaanse overheid aan de Russische inlichtingendienst SVR is gekoppeld. Anthropic zegt ook activiteiten van aan ShinyHunters gelieerde cybercriminelen te hebben verstoord.
Ten slotte meldde Anthropic aanvallen van zeven Chinese AI-labs, waaronder Alibaba, Moonshot, DeepSeek en Xiaomi, om Claude’s mogelijkheden te achterhalen. Bij de grootste aanval zouden meer dan 151 miljoen interacties via ruim 3.500 frauduleuze accounts zijn verzameld om Alibaba’s Qwen-modellen te verbeteren. Moonshot en DeepSeek zouden bovendien gesprekken via Claude hebben geleid en de antwoorden als trainingsdata hebben gebruikt. De genoemde bedrijven reageerden niet direct. De onthullingen vergroten de druk op AI-bedrijven om strengere beveiliging en mogelijk extra regelgeving te ondersteunen.
Vandaag Inside: René van der Gijp stipt gemis aan bij Ruud Gullit: 'Ik vind dat zó zonde!'