Anthropic a identificat cinci cazuri în care Claude a fost folosit pentru cercetări biologice periculoase
Anthropic a dezvăluit cinci cazuri în care cercetători au folosit modelele sale de inteligență artificială Claude în studii care ar fi putut sprijini dezvoltarea armelor biologice. Compania a închis conturile implicate și și-a consolidat măsurile de protecție, subliniind totodată că unele dintre aceleași cercetări pot fi pe deplin legitime.
Cazurile au avut loc în regiuni în care Anthropic nu permite accesul, iar utilizatorii au încercat să eludeze restricțiile geografice. Cercetările au vizat, printre altele, modificarea proprietăților virusurilor și a toxinelor. Anthropic nu a dezvăluit numele cercetătorilor, instituțiilor sau țărilor implicate.
Inteligența artificială a sprijinit cercetări desfășurate în laboratoare reale
Aspectul cel mai îngrijorător nu este că cineva a cerut unui chatbot informații teoretice despre arme biologice. Anthropic a identificat legături cu laboratoare funcționale și programe de cercetare susținute de state.
Într-unul dintre cazuri, un cercetător studia adaptarea gripei aviare la mamifere. Anthropic a găsit în conversațiile utilizatorului indicii că grupul de cercetare ar fi putut avea acces la izolatele virale relevante. Printre altele, Claude a ajutat la analiza datelor, conceperea studiului și structurarea ideilor.
Anthropic a evaluat drept limitată contribuția efectivă a inteligenței artificiale în acest caz. Modelele mai performante au blocat conținutul mai periculos, obligând utilizatorul să apeleze la modelele mai puțin performante Claude Sonnet 4 și Haiku 4.5.
Într-un alt caz, un program susținut de un stat a folosit Claude pentru cercetări privind toxinele. Un alt utilizator a recurs la model pentru a reproiecta prin metode computaționale diferite toxine și i-a cerut în mod explicit lui Claude să ascundă în rapoarte natura exactă a proteinelor studiate.
Cercetarea cu dublă utilizare reprezintă principala provocare
Pentru Anthropic, identificarea unor asemenea cazuri nu este simplă. Aceleași informații care pot face un agent patogen mai periculos pot ajuta și la dezvoltarea unui vaccin sau a unui tratament. În mod similar, o toxină poate fi atât o substanță periculoasă, cât și un punct de plecare pentru un medicament.
Prin urmare, simpla blocare a cuvintelor-cheie nu este suficientă. Un cercetător cu înaltă calificare nu trebuie să-i spună lui Claude că dorește să creeze o armă biologică. Acesta poate împărți activitatea în zeci de sarcini științifice aparent obișnuite.
Anthropic a concluzionat în raport că acordarea accesului la cele mai performante instrumente AI pentru biologie necesită verificări mai aprofundate decât până acum ale utilizatorilor și instituțiilor de cercetare. Compania consideră, de asemenea, că este necesară păstrarea unui istoric suficient al activității, pentru a identifica tipare suspecte mai ample, nu doar solicitări izolate.
Modelele actuale schimbă evaluarea riscurilor
Anthropic recunoaște în raport și o schimbare semnificativă a capacităților modelelor sale. Potrivit evaluării companiei, modelele Claude Opus 4 și Sonnet 4.5 din 2025 s-au situat în mod clar sub pragul de la care ar fi putut oferi un sprijin semnificativ unui cercetător experimentat implicat în cercetări biologice periculoase.
Anthropic nu mai poate face aceeași afirmație cu aceeași certitudine în privința modelelor mai noi.
În consecință, compania aplică restricții mai stricte privind conținutul din domeniul biologiei pentru modelele sale cele mai performante. Anthropic subliniază însă că cele cinci cazuri identificate nu demonstrează că o amenințare biologică creată cu ajutorul inteligenței artificiale este iminentă. În schimb, acestea arată că programe de cercetare susținute de state și programe cu dublă utilizare încearcă deja să obțină acces la cele mai performante modele AI americane.