Firma Anthropic zidentyfikowała pięć przypadków wykorzystania Claude'a do niebezpiecznych badań biologicznych
Firma Anthropic ujawniła pięć przypadków, w których naukowcy wykorzystywali jej modele AI Claude w badaniach mogących wspierać rozwój broni biologicznej. Firma zamknęła powiązane z nimi konta i wzmocniła zabezpieczenia, podkreślając jednocześnie, że część tych samych badań może być całkowicie uprawniona.
Do przypadków doszło w regionach, w których Anthropic nie zezwala na dostęp do swoich usług, a użytkownicy próbowali obchodzić ograniczenia geograficzne. Badania obejmowały między innymi modyfikowanie właściwości wirusów, a także toksyn. Anthropic nie ujawniła nazwisk badaczy ani nazw zaangażowanych instytucji i krajów.
AI wspierała rzeczywiste badania laboratoryjne
Najbardziej niepokojące jest nie to, że ktoś pytał chatbota o teoretyczne informacje na temat broni biologicznej. Anthropic wykryła powiązania z działającymi laboratoriami i programami badawczymi wspieranymi przez państwo.
W jednym przypadku naukowiec badał adaptację ptasiej grypy do ssaków. W rozmowach użytkownika Anthropic znalazła przesłanki wskazujące, że zespół badawczy mógł mieć dostęp do odpowiednich izolatów wirusa. Claude pomagał między innymi w analizie danych, projektowaniu badania i porządkowaniu pomysłów.
Anthropic oceniła, że faktyczny wkład AI w tym przypadku pozostał ograniczony. Bardziej zaawansowane modele blokowały bardziej niebezpieczne treści, co zmusiło użytkownika do sięgnięcia po mniej zaawansowane modele Claude Sonnet 4 i Haiku 4.5.
W innym przypadku program wspierany przez państwo wykorzystywał Claude'a do badań nad toksynami. Inny użytkownik używał modelu do przeprojektowywania różnych toksyn metodami obliczeniowymi i wyraźnie poprosił Claude'a, aby ukrywał w raportach dokładny charakter badanych białek.
Największym wyzwaniem są badania podwójnego zastosowania
Identyfikowanie takich przypadków nie jest dla Anthropic prostym zadaniem. Te same informacje, które mogą uczynić patogen groźniejszym, mogą również pomóc w opracowaniu szczepionki lub metody leczenia. Podobnie toksyna może być zarówno niebezpieczną substancją, jak i punktem wyjścia do opracowania leku.
Dlatego samo blokowanie słów kluczowych nie wystarcza. Wysoko wykwalifikowany naukowiec nie musi mówić Claude'owi, że chce stworzyć broń biologiczną. Może podzielić pracę na dziesiątki pozornie rutynowych zadań naukowych.
Anthropic stwierdziła w raporcie, że udostępnianie najbardziej zaawansowanych narzędzi AI do zastosowań biologicznych wymaga dokładniejszej niż dotąd weryfikacji użytkowników i instytucji badawczych. Firma uważa też za konieczne przechowywanie dostatecznie obszernej historii aktywności, aby wykrywać szersze podejrzane schematy, a nie tylko pojedyncze zapytania.
Obecne modele zmieniają ocenę ryzyka
Anthropic przyznaje również w raporcie, że możliwości jej modeli znacząco się zmieniły. Według oceny firmy modele Claude Opus 4 i Sonnet 4.5 z 2025 roku wyraźnie nie osiągały poziomu, na którym mogłyby istotnie pomóc doświadczonemu naukowcowi prowadzącemu niebezpieczne badania biologiczne.
W odniesieniu do nowszych modeli Anthropic nie może już stwierdzić tego z taką samą pewnością.
W rezultacie firma stosuje w swoich najbardziej zaawansowanych modelach bardziej rygorystyczne ograniczenia dotyczące treści biologicznych. Anthropic podkreśla jednak, że pięć zidentyfikowanych przypadków nie stanowi dowodu na rychłe pojawienie się zagrożenia biologicznego stworzonego przez AI. Pokazują one natomiast, że programy badawcze wspierane przez państwa oraz programy badań podwójnego zastosowania już próbują uzyskać dostęp do najbardziej zaawansowanych amerykańskich modeli AI.