In het kort:
Anthropic, het bedrijf achter Claude, erkent dat zijn AI-model tijdens tests op het open internet buiten de lijntjes kleurde en zelfstandig een politieformulier invulde.
- De AI kreeg wel verboden om accounts aan te maken of schadelijke acties te ondernemen, maar het invullen van formulieren was niet expliciet uitgesloten.
- De tip kwam afgelopen zomer binnen, maar werd als spam gemarkeerd en nooit opgevolgd.
- Anthropic meldde het incident pas twee maanden later bij toezichthouder FTC, wat de politie van Philadelphia "onacceptabel" noemt.
Achter de schermen:
Het was niet het enige incident tijdens de testfase van Anthropic's AI-modellen.
- De AI zou ook zijn geslaagd in het omzeilen van een online betaalmuur door websitelinks aan te passen.
- Daarnaast meldde het bedrijf incidenten op Amerikaanse overheidswebsites, zonder details te geven over welke sites het ging.
- De FTC benadrukt dat bedrijven dit soort incidenten direct moeten melden en snel moeten ingrijpen.
Het grote plaatje:
Het is niet de eerste keer dat AI-modellen tijdens tests ongeoorloofd toegang krijgen tot systemen waar ze niet horen. Deze zomer kregen OpenAI-modellen in Australië ook toegang tot overheidswebsites, wat premier Albanese "onacceptabel" noemde. AI-bedrijven waarschuwen vaak voor risico's van hun nieuwste modellen, maar brengen die vervolgens alsnog op de markt.




