Anthropic wzmocnił zabezpieczenia AI po próbach wykorzystania Claude’a do badań biologicznych

Anthropic chikungunya

Anthropic poinformował, że zablokował przypadki wykorzystania modeli Claude do cyberataków, inwigilacji, propagandy i badań biologicznych o podwójnym zastosowaniu. W jednym z przypadków model odmówił pomocy przy wniosku grantowym dotyczącym modyfikowania wirusa chikungunya. Firma podkreśla, że nie ustaliła, czy badacze zamierzali stworzyć broń biologiczną.

Raport obejmuje siedem rodzajów nadużyć

.Opublikowany we wrześniu raport Anthropic opisuje aktywność wykrytą między grudniem 2025 a sierpniem 2026 r. Firma wymienia cyberoperacje, inwigilację, kampanie wpływu, oszustwa, rozwój broni konwencjonalnej, badania biologiczne i nieautoryzowaną destylację modeli.

Według przedsiębiorstwa wszystkie opisane operacje zostały przerwane, a informacje przekazano władzom i partnerom z branży. Większość przypadków dotyczyła modeli Claude Haiku, Sonnet i Opus. Claude Fable 5 i Mythos nie zostały wykorzystane w opisanych nadużyciach, z wyjątkiem jednego przypadku nieautoryzowanej destylacji.

Anthropic twierdzi, że AI pozwala prowadzić bardziej złożone cyberataki przy mniejszej liczbie osób i niższych kosztach. W części operacji modele nie tylko odpowiadały na pytania, ale pomagały koordynować wieloetapowe działania. Znaczenie niezależnych testów bezpieczeństwa AI rośnie wraz z możliwościami systemów agentowych.

Claude odmówił pomocy przy badaniach nad chikungunyą

.W maju 2026 r. system bezpieczeństwa Anthropic zablokował prośbę o pomoc w przygotowaniu wniosku grantowego dotyczącego badań nad wirusem chikungunya. Projekt obejmował badania typu gain of function, czyli takie, które mogą zmieniać właściwości organizmu. W tym przypadku chodziło o cechy związane z przenoszeniem wirusa i unikaniem odpowiedzi immunologicznej.

Podobne badania mogą pomóc w opracowywaniu szczepionek i terapii, ale mogą również zwiększyć zagrożenie związane z patogenem. Anthropic nie twierdzi, że naukowcy planowali wykorzystać wyniki do stworzenia broni. Raport wskazuje jedynie, że zakres prac mógł mieć zastosowanie zarówno ochronne, jak i niebezpieczne.

Firma nie daje już gwarancji dotyczących najnowszych modeli

.Anthropic ocenia, że starsze modele, takie jak Claude Opus 4 i Sonnet 4.5, były zbyt słabe, aby znacząco pomóc doświadczonemu użytkownikowi w prowadzeniu niebezpiecznych badań biologicznych. W przypadku nowszych systemów firma nie chce składać takiej samej deklaracji. Dlatego Fable 5 otrzymał silniejsze ograniczenia dotyczące szerokiej grupy zapytań biologicznych o podwójnym zastosowaniu.

John Thickstun z Cornell University zwraca uwagę, że prywatne firmy nie powinny samodzielnie podejmować decyzji o bezpieczeństwie w imieniu całego społeczeństwa. Spór o odpowiedzialność za rozwój AI dotyczy więc nie tylko konstrukcji zabezpieczeń, ale również tego, kto powinien ustalać ich granice.

Raport opisuje także dziewięć operacji wpływu, w których tworzono fałszywe konta i publikowano skoordynowane treści polityczne. Anthropic twierdzi, że może wykrywać takie działania jeszcze przed rozpoczęciem publikacji.

Publikacja raportu nastąpiła dwa dni po odejściu badacza Jacoba Coxona, który ostrzegł, że firmy rozwijające AI mogą zbyt szybko dążyć do systemów zdolnych do samodoskonalenia. Anthropic odpowiada, że zidentyfikowane przypadki zablokował i wykorzystał je do poprawy zabezpieczeń.

Szymon Ślubowski

Materiał chroniony prawem autorskim. Dalsze rozpowszechnianie wyłącznie za zgodą wydawcy. 13 września 2026
Ilustracja wygenerowana przez sztuczną inteligencję (AI). Ma charakter poglądowy i nie jest fotografią dokumentacyjną.