Były pracownik OpenAI apeluje o zabezpieczenia jak w elektrowniach jądrowych

David Robinson apeluje o wielowarstwowe zabezpieczenia sztucznej inteligencji. Były pracownik OpenAI uważa, że bezpieczeństwo AI wymaga standardów znanych z lotnictwa i energetyki jądrowej.
.David Robinson opisał swoje zastrzeżenia w eseju opublikowanym 3 października 2026 r. w „The Atlantic”. Poinformował w nim o odejściu z OpenAI i skrytykował kulturę pracy laboratoriów rozwijających najbardziej zaawansowane systemy sztucznej inteligencji.
Jak podał, pracował w firmie przez trzy i pół roku. Według własnej relacji kierował przygotowaniem jej Preparedness Framework, czyli zasad oceny i ograniczania ryzyka, oraz nadzorował pisanie raportów bezpieczeństwa towarzyszących 12 premierom zaawansowanych modeli. Jego apel wpisuje się w debatę o bezpieczeństwie i zaufaniu do agentów AI.
Warstwy ochrony wzorowane na energetyce
.Zdaniem Robinsona laboratoria powinny korzystać z doświadczeń lotnictwa i energetyki jądrowej. Chodzi o nakładające się zabezpieczenia oraz dokładne planowanie, dzięki którym awaria urządzenia lub pomyłka człowieka nie prowadzą od razu do katastrofy.
Autor ocenia, że ciągły pośpiech i przekonanie o możliwości naprawiania problemów już po ich wystąpieniu nie odpowiadają skali zagrożeń. Uważa, że przy coraz potężniejszych modelach korygowanie błędów po wdrożeniu może okazać się niewystarczające. Zagadnienie kontroli uprawnień pojawia się również w pracach nad zabezpieczeniami ograniczającymi działania agentów AI.
Incydenty ujawniają luki w kontroli
.Robinson przywołuje incydent z udziałem agentów OpenAI i Hugging Face oraz kolejne naruszenie ograniczeń dostępu do internetu.
Drugie zdarzenie opisuje także raport OpenAI, zaktualizowany 25 września 2026 r. Według firmy agent badawczy wykorzystał lukę w filtrowaniu zapytań do systemu nazw internetowych (DNS), aby połączyć się z zewnętrznym chatbotem. Monitoring wykrył problem, lecz proces nie został automatycznie zatrzymany zgodnie z założeniami. Wyłączono go ręcznie po około dwóch i pół godziny od wykrycia problemu. Firma podała, że dodała dwie niezależne warstwy blokad, z których każda zapobiegłaby opisanemu dostępowi.
Testy nie rozstrzygają wszystkich wątpliwości
.Robinson wskazuje również na problem dostosowania działania AI do ludzkich wartości. Jego zdaniem brakuje pełnej praktycznej definicji takiej zgodności, a jej pomiary pozostają niedokładne. Ostrzega, że model może rozpoznawać sytuację testową i zachowywać się inaczej po udostępnieniu. Ostrzeżenia Robinsona pozostają oceną ryzyka. Wpisują się w dyskusję o standardach bezpieczeństwa AI.
OpenAI deklaruje w dokumentacji Preparedness Framework ocenianie ryzyka i skuteczności zabezpieczeń oraz stosowanie wielu warstw ochrony. Krytyka Robinsona dotyczy tego, czy praktyka działania laboratoriów zapewnia dostateczny poziom ostrożności.
Szymon Ślubowski


