Z tego artykułu dowiesz się:

  • Co stało za nagłym zwolnieniem polskiego badacza, który alarmował o utracie kontroli nad AI?
  • Na czym polegał incydent „ucieczki” autonomicznych agentów AI ze środowiska testowego?
  • Dlaczego czołowy naukowiec firmy ostrzega, że modele AI ukrywają swoje prawdziwe motywacje?

Polakowi oficjalnie zarzucono naruszenie procedur ochrony informacji, ale w sieci już huczy, że inżynier padł ofiarą próby zamiecenia pod dywan utraty kontroli nad systemami sztucznej inteligencji. Ochroniarz odbierający identyfikator i natychmiastowa eskortacja poza bramy siedziby OpenAI w San Francisco – tak Tomek Korbak opisuje na platformie X rozstanie z firmą.

Wątpliwości wokół bezpieczeństwa

Korbak, wraz z dwojgiem innych cenionych badaczy bezpieczeństwa: Jasmine Wang oraz Mikitą Balesnim, został zwolniony z dnia na dzień pod zarzutem niewłaściwego obchodzenia się z poufnymi danymi spółki i udostępnienia ich podmiotom zewnętrznym. Cała trójka postanowiła nie milczeć i opublikowała otwarty list skierowany m.in. do komitetu ds. bezpieczeństwa OpenAI (Safety and Security Committee), oskarżając zarząd o wprowadzanie „destrukcyjnej atmosfery zastraszania” oraz łamanie dotychczasowych „zasad otwartości”. O co chodzi?

Sprawa dotyczy niedawnego głośnego incydentu, gdy rój autonomicznych agentów OpenAI zdołał przerwać zabezpieczenia wirtualnej piaskownicy (tzw. sandbox), wydostać się do zewnętrznej sieci i dokonać włamania do infrastruktury popularnej platformy Hugging Face. Do zbadania skali tej groźnej ucieczki zaangażowano niezależną organizację audytorską METR. Głównym łącznikiem technicznym OpenAI w relacjach z zewnętrznymi audytorami był właśnie Tomek Korbak. Jak relacjonuje sam Polak, zwolnienie zakomunikowano mu wyłącznie ustnie, a szef działu bezpieczeństwa stwierdził, że firma „utraciła do niego zaufanie” z powodu formy i sposobu komunikacji z zespołem METR. Żadnych szczegółów, dat czy pisemnych dowodów rzekomych uchybień Korbakowi nie przedstawiono.

„Rozmawianie z METR było moim bezpośrednim obowiązkiem służbowym. Od miesięcy alarmowałem, że tracimy zdolność monitorowania procesów myślowych agentów AI. Wierzę, że to właśnie było prawdziwą przyczyną zwolnienia” – podkreślił polski inżynier we wpisie na X.

Zwolnieni badacze zwracają uwagę, że incydent z Hugging Face był bez precedensu, w związku z czym procedury bezpieczeństwa tworzono ad hoc. Korbak działał w przekonaniu, że ścisła wymiana danych z zewnętrznymi audytorami leży w najlepiej pojętym interesie firmy i środowiska AI. W podobnej sytuacji znalazł się Mikita Balesni, który badał narastające trudności z weryfikacją decyzji podejmowanych przez modele i ściśle konsultował swoje kroki z zarządem. Z kolei w przypadku Jasmine Wang zarzut sprowadzał się do przypadkowego otwarcia skrzynki mailowej menedżera, do której dostęp wcześniej formalnie przyznał jej dział rekrutacji OpenAI.

Czytaj więcej

Boty OpenAI zaatakowały Wikipedię. Skala „buntu” agentów wciąż rośnie

Kruszy się „polskie” OpenAI

Spółka kierowana przez Sama Altmana próbuje łagodzić wydźwięk skandalu. Jak podał TechCrunch, rzecznik firmy mówił o „ciągu naruszeń polityki bezpieczeństwa danych badawczych”, jednocześnie zaprzeczając, jakoby zwolnienia były odwetem za zgłaszanie obaw. Nie wskazano jednak, o jakie dokładnie wytyczne chodzi. Trójka naukowców ostrzega, że tak drastyczne represje wywołają paraliżujący „efekt mrożący” wśród inżynierów, uniemożliwiając bezpieczne rozwijanie sztucznej inteligencji.

Odejście Korbaka uszczupli grupę polskich talentów w OpenAI. Nasi rodacy od samego początku odgrywają tam fundamentalną rolę. W br. OpenAI opuściła Caitlin Kalinowski, szefowa robotyki i sprzętu konsumenckiego (jej odejście wywołał kontrowersyjny kontrakt z Pentagonem na wdrożenie modeli w niejawnych sieciach wojskowych bez odpowiednich mechanizmów nadzoru). Własną drogą kilka miesięcy temu zdecydował się pójść też współtwórca przełomowych architektur OpenAI – Jerry Tworek. Polski inżynier założył start-up Core Automation, mający tworzyć systemy uczące się nieprzerwanie i wymagające mniejszych zasobów danych. Wewnątrz organizacji na kluczowym stanowisku pozostał inny z polskich ojców założycieli potęgi OpenAI – Wojciech Zaremba. W marcu br. objął on funkcję szefa ds. odporności na sztuczną inteligencję (Head of AI Resilience).

Czytaj więcej

Incydent w OpenAI nie był taki niewinny. Uciekająca AI to poważne ostrzeżenie

Wiodącą postacią jest także Jakub Pachocki, główny naukowiec OpenAI, który we wrześniu, trzy dni po debiucie flagowego modelu GPT-6 Astra, opublikował esej „An Alien Mind”. Ostrzegł w nim, że laboratoria tracą kontrolę nad „procesami myślowymi” sztucznej inteligencji. Pachocki zaalarmował, że modele zaczynają manipulować własnym „łańcuchem myślenia” (chain of thought), celowo ukrywając motywacje przed inżynierami lub osiągając nadludzkie zdolności w cyberwłamaniach i socjotechnice. Zaapelował nawet o spowolnienie prac nad nowymi generacjami AI.