Anthropic: zeven Chinese AI-labs stalen op industriële schaal capaciteiten van Claude

Anthropic ontmantelde grootschalige distillatie-campagnes van Alibaba, Moonshot, DeepSeek, Zhipu, MiniMax, SenseTime en Xiaomi tegen Claude.

Anthropic heeft zeven Chinese AI-bedrijven betrapt op grootschalige, illegale “distillatie” van zijn Claude-model. Het gaat om Alibaba, Moonshot, DeepSeek, Zhipu (Z.ai), MiniMax, SenseTime en Xiaomi, meldt het bedrijf in een dreigingsrapport.

Distillatie is normaal gesproken een legitieme trainingstechniek: een groot, krachtig AI-model fungeert als “leraar” en een kleiner model leert van diens antwoorden om sneller en goedkoper vergelijkbare prestaties te halen. Wat deze zeven labs volgens Anthropic deden, is iets anders. Ze haalden op grote schaal en zonder toestemming Claude’s antwoorden binnen om hun eigen modellen te trainen. Dit is dus geen aanval waarbij criminelen Claude inzetten om anderen te hacken, maar diefstal van Claude’s eigen kunnen.

De omvang was aanzienlijk. Volgens Anthropic genereerde een netwerk gelinkt aan Alibaba tussen mei en juli 151 miljoen gesprekken met Claude, met pieken van bijna drie miljoen per dag via ruim 3.500 frauduleuze accounts. Moonshot zette meer dan 5.300 nepaccounts in en kwam uit op 23 miljoen uitwisselingen, terwijl DeepSeek in twee weken tijd 12,1 miljoen distillatiepogingen deed. De labs gebruikten onder meer proxydiensten die met gestolen creditcards en valse identiteiten massaal accounts aanmaakten, routeerden zonder medeweten van hun eigen gebruikers verzoeken door naar Claude, en kochten transcripten van Claude-gesprekken op bij externe dataverkopers.

Anthropic zegt de betrokken accounts te hebben geblokkeerd en heeft verificatie-eisen aangescherpt. Daarnaast passen de modellen nu hun interne redenering aan zodat gestolen transcripten minder waardevol zijn voor training, en introduceerde het bedrijf “preserved thinking” om manipulatie via meerdere gespreksbeurten tegen te gaan.

Voor Nederlandse organisaties is dit vooral een signaal dat grote AI-aanbieders zelf doelwit zijn van geopolitiek gedreven datadiefstal, iets om in het achterhoofd te houden bij de keuze en het vertrouwen in AI-leveranciers. Voor meer bredere achtergrond over het onderliggende dreigingsrapport van Anthropic, zie ons artikel over misbruik van Claude bij geautomatiseerde aanvallen.

Bron: The Hacker News

Beveiligingscontent geverifieerd door Fortivox SecurityNederlandse cybersecurity-specialist voor het MKB — fortivoxsecurity.nl

Blijf op de hoogte

Meld je aan voor de nieuwsbrief: spoedalerts bij kritieke dreigingen en een wekelijks overzicht. Geen mail achterlaten? Volg ons dan via RSS.