Anthropic identificeert vijf gevallen waarin Claude werd gebruikt voor gevaarlijk biologisch onderzoek
Anthropic heeft vijf gevallen bekendgemaakt waarin onderzoekers zijn AI-modellen van Claude gebruikten voor onderzoek dat de ontwikkeling van biologische wapens had kunnen ondersteunen. Het bedrijf sloot de betrokken accounts en scherpt de veiligheidsmaatregelen aan, maar benadrukt dat een deel van hetzelfde onderzoek ook volledig legitiem kan zijn.
De gevallen deden zich voor in regio's waar Anthropic geen toegang toestaat en de gebruikers probeerden geografische beperkingen te omzeilen. Het onderzoek betrof onder meer het veranderen van eigenschappen van virussen en toxinen. Anthropic maakte niet bekend welke onderzoekers, instellingen of landen erbij betrokken waren.
AI ondersteunde daadwerkelijk laboratoriumonderzoek
Het zorgwekkendste aspect is niet dat iemand een chatbot om theoretische informatie over biologische wapens vroeg. Anthropic vond verbanden met actieve laboratoria en door staten gesteunde onderzoeksprogramma's.
In één geval onderzocht een wetenschapper hoe vogelgriep zich aanpast aan zoogdieren. Anthropic vond in de gesprekken van de gebruiker aanwijzingen dat de onderzoeksgroep mogelijk toegang had tot de relevante virusisolaten. Claude hielp onder meer bij de data-analyse, de onderzoeksopzet en het structureren van ideeën.
Anthropic oordeelde dat de daadwerkelijke bijdrage van de AI in dit geval beperkt bleef. Krachtigere modellen blokkeerden gevaarlijkere inhoud, waardoor de gebruiker moest uitwijken naar de minder krachtige modellen Claude Sonnet 4 en Haiku 4.5.
In een ander geval gebruikte een door een staat gesteund programma Claude voor onderzoek naar toxinen. Een andere gebruiker zette het model in om verschillende toxinen computationeel te herontwerpen en vroeg Claude uitdrukkelijk om in rapporten de precieze aard van de onderzochte eiwitten te verhullen.
Onderzoek voor tweeërlei gebruik vormt de grootste uitdaging
Voor Anthropic is het niet eenvoudig om dergelijke gevallen te identificeren. Dezelfde informatie die een ziekteverwekker gevaarlijker kan maken, kan ook helpen bij de ontwikkeling van een vaccin of behandeling. Ook een toxine kan zowel een gevaarlijke stof als een uitgangspunt voor een geneesmiddel zijn.
Daarom is het niet voldoende om simpelweg trefwoorden te blokkeren. Een hooggekwalificeerde onderzoeker hoeft Claude niet te vertellen dat hij een biologisch wapen wil maken. Het werk kan worden opgesplitst in tientallen ogenschijnlijk alledaagse wetenschappelijke taken.
Anthropic concludeerde in zijn rapport dat gebruikers en onderzoeksinstellingen grondiger dan voorheen moeten worden gescreend voordat zij toegang krijgen tot de krachtigste AI-hulpmiddelen voor biologisch onderzoek. Het bedrijf acht het ook noodzakelijk om voldoende activiteitengeschiedenis te bewaren, zodat bredere verdachte patronen kunnen worden herkend in plaats van alleen losstaande vragen.
Huidige modellen veranderen de risico-inschatting
Anthropic erkent in het rapport ook dat de mogelijkheden van zijn modellen aanzienlijk zijn veranderd. Volgens de inschatting van het bedrijf bleven de modellen Claude Opus 4 en Sonnet 4.5 uit 2025 duidelijk onder de drempel waarboven zij een ervaren onderzoeker die gevaarlijk biologisch onderzoek uitvoert in belangrijke mate hadden kunnen ondersteunen.
Anthropic kan diezelfde stellige uitspraak niet langer doen over nieuwere modellen.
Daarom past het bedrijf op zijn krachtigste modellen strengere beperkingen toe voor biologische inhoud. Anthropic benadrukt echter dat de vijf geïdentificeerde gevallen niet bewijzen dat een door AI gecreëerde biologische dreiging ophanden is. Ze tonen volgens het bedrijf wel aan dat door staten gesteunde onderzoeksprogramma's en programma's voor tweeërlei gebruik al proberen toegang te krijgen tot de krachtigste Amerikaanse AI-modellen.