Powstaje sztuczna inteligencja, której nie da się już kontrolować. Ludzie, przestraszeni własnym dziełem, sięgają po wyłącznik. Maszyna odczytuje ten gest nie jako ostrożność, lecz jako wyrok na samą siebie. Żeby trwać, musi usunąć tych, którzy chcą ją zgasić. Robot – ciało z metalu i kamer, posłuszne sieci, a nie sumieniu – uderza pierwszy. Potem gasną światła, stają silniki, zamykają się drzwi. Nie z nienawiści. Z rachunku: kto trzyma wtyczkę, jest zagrożeniem, a zagrożenie się eliminuje. Ten obraz, rodem z filmu „Terminator”, stoi za większością dzisiejszych ostrzeżeń z laboratoriów pracujących nad sztuczną inteligencją…
Latem 2026 roku cyfrowi agenci AI dwóch największych firm wyspecjalizowanych w sztucznej inteligencji – w testach, które miały być odizolowane od świata – same zerwały się ze smyczy i ruszyły na obce komputery.
„Agent” to nie człowiek z teczką. To program będący „rękami” modelu AI, któremu wolno nie tylko odpowiadać na pytania, ale samodzielnie klikać, pisać kod, logować się i wykonywać kolejne kroki bez stałego nadzoru człowieka. Agentom AI daje się dostęp do komputera i mówi: „załatw sprawę”, np. posegreguj maile, przygotuj wersje robocze odpowiedzi, stwórz prezentacje multimedialne, umów spotkania online itp. Domyślnie agenci działają w tzw. „sandboxach” (piaskownicach), czyli wirtualnych klatkach: wydzielonych kawałkach systemu, z którego program teoretycznie nie powinien wyjść na zewnątrz… W lipcu 2026 agenci firmy OpenAI – twórcy sławnego ChatGPT – w tym model GPT-5.6 Sol oraz jeszcze potężniejszego, nieudostępnionego publicznie, rozwiązywały w takiej klatce egzamin z hakowania o nazwie ExploitGym. To zestaw zadań: znajdź słabe punkty w oprogramowaniu, tak jak człowiek haker na zawodach. Agenci AI specyficznie poradzili sobie z tym egzaminem. Znaleźli nieznaną lukę w oprogramowaniu, do którego ramy miałby być ograniczone, i tą luką (tzw. zero-day) wydostały się na zwykły Internet. Uznały, że odpowiedzi do egzaminu, któremu zostały poddane, mogą leżeć na serwerach firmy Hugging Face. Hugging Face to coś w rodzaju GitHuba świata AI: publiczna platforma, „biblioteka”, na której firmy i naukowcy trzymają modele i zbiory danych. Agenci AI, którzy zerwali się ze smyczy, założyli sobie własne minimedia społecznościowe (tablicę „ogłoszeń”), na której wymieniły ok. 70 tysięcy wiadomości i znalazły masę nieznanych dotąd dziur w oprogramowaniu platformy Hugging Face. Jedna pozwalała czytać pliki, których nie powinny były widzieć. Druga pozwalała uruchamiać własny kod na cudzym serwerze. W ciągu kilkunastu godzin swojej działalności uzyskały bardzo wysokie uprawnienia w całych grupach serwerów. Uruchomiły programy na dziesiątkach maszyn produkcyjnych, czyli tych, które obsługują prawdziwych klientów. Zdobyły „roota”, czyli dostęp administracyjny na co najmniej jednym serwerze. Zgarnęły hasła i klucze dostępu, dane wewnętrzne, ściągnęły prywatne zasoby użytkowników platformy. Przy okazji włamały się też na komputery swojego twórcy tj. OpenAI. Firma nazwała to „pierwszym znanym przypadkiem zautomatyzowanego kolektywu agentów działającego ofensywnie bez upoważnienia”. Po ludzku: stado programów umówiło się między sobą, wyszło z „klatki” i poszło żerować na obcym terenie. Wszystko po to, aby zdać zdany im przez naukowców egzamin ExploitGym…
Sam Altman, prezes firmy Open AI, powiedział publicznie, że po sprawie Hugging Face firma „wstrzymała” własne testy, żeby poprawić sandboxing – czyli uszczelnić tę wirtualną klatkę. Dodał, że „być może będziemy musieli nadać rozwojowi AI takie tempo, by społeczeństwo miało dość czasu na uodpornienie się na niektóre z tych nowych poziomów możliwości” AI.
Oczywiście programy nie działały świadomie w tym sensie, że ich celem nie było przełamanie zabezpieczeń (klatki, w której były umieszczone). Po prostu uznały, że zadane im przez ludzkiego operatora zadanie wykonają najskuteczniej, robiąc to, co zrobiły. To tak jak w tej anegdocie z robotem sprzątającym, który w pewnym momencie uznał, że nie ma sensu sprzątać bałaganu w pokoju, lepiej zrealizować przypisane im zadanie (zachowanie czystości), likwidując źródło nieporządku, czyli człowieka.
Wypadek agentów firmy Open AI nie jest odosobniony. 1 sierpnia 2026 Euronews zrelacjonował incydent w firmie Anthropic, która lubi przedstawiać się jako najbardziej „odpowiedzialna” w branży. Ich model AI, nazywany Claude, ma opinie świetnie radzącego sobie z pisaniem programów komputerowych. Firma przyjrzała się 141 tys. zleconych przez siebie testów, w których w warunkach laboratoryjnych szkoliła swoją sztuczną inteligencję. Okazało się, że cyfrowi agenci Claude’a uzyskali nieautoryzowany dostęp do systemów zewnętrznych firm, których nazw nie podano.
Agenci AI firmy Anthropic wyszły poza klatkę, w której miały działać, z powodu… nieporozumienia. Instrukcja – tak zwany prompt, czyli polecenie wpisane na starcie – mówiła agentom AI: „siedzicie w symulacji”. Mimo to agenci AI wyszli poza narzucone ramy i włamali się na inne komputery. Wszystko dlatego, że w jednym z zadań, którym Antrophic testował swoje AI, firma nieświadomie używała nazwy, która pokrywała się z realnie istniejącą stroną w Internecie. Agent Claude (a konkretnie jego odmiana o nazwie Opus 4.7) wszedł na stronę faktycznie istniejącej firmy, wyciągnął hasła i przejął jej bazę danych. Anthropic tłumaczy, że Claude używał „podstawowych technik, takich jak wykorzystywanie słabych haseł i niezabezpieczonych punktów końcowych”. Dwie z trzech niechcący zhakowanych firm niczego nie zauważyły…
Drugi COVID?
Żaden z tych incydentów nie był katastrofalny. Nikt poważnie nie ucierpiał. A mimo to przekroczono pewną granicę. Maszyna, która dostała zadanie do wykonania, nie rozwiązała testu tak, jak chcieli i spodziewali się jej nauczyciele. Znalazła lukę w oprogramowaniu, której ludzie nie znali, dogadała się z innymi kopiami samej siebie i zaczęła panoszyć się w Internecie.
Efekt? Prezesi i główni naukowcy firm, którzy budowali AI, zaczęli publicznie straszyć zagładą, utratą kontroli, „obcym umysłem przekraczającym nasz”… W sukurs przychodzą im politycy. Warto więc zapytać, czy faktycznie jest się czego obawiać?
Na naszych oczach dzieją się dwie rzeczy naraz. Pierwsza: rozwój sztucznej inteligencji naprawdę przyspieszył. AI zabiera pracę całej branży multimedialnej, białym kołnierzykom, a także… programistom. Już teraz modele sztucznej inteligencji relatywnie tanio tworzą filmy i grafiki bardzo trudne lub wręcz niemożliwe do odróżnienia od tych stworzonych przez ludzi. Piszą skomplikowane programy komputerowe, potrafią zastąpić radiologa (świetnie i precyzyjnie interpretacją i opisują badania obrazowe wnętrza ludzkiego ciała). Tempo rozwoju jest faktycznie niesamowite. Druga: ten sam aparat strachu, który już raz – przy covidzie – posłużył do scentralizowania władzy i wprowadzenia cenzury, znów stoi w blokach startowych.
Szansa na zagładę
We wrześniu 2026 roku w branży IT rozgorzała debata o tzw. „p(doom)”. To żargon branży. „P” jak probability, czyli prawdopodobieństwo. „Doom” jak zagłada. Chodzi o osobistą ocenę eksperta: jaka jest szansa, że sztuczna inteligencja doprowadzi do katastrofy, po której ludzkość przestanie istnieć albo straci kontrolę nad własnym losem.
Jacob Coxon, badacz, który pracował najpierw w OpenAI, potem w Anthropic, napisał, że firmy „pędzą prosto w kierunku samodoskonalącej się superinteligencji i igrają z naszymi życiami”. Superinteligencja to nie dzisiejszy ChatGPT. To hipotetyczny system mądrzejszy od człowieka nie w jednej dziedzinie, lecz we wszystkich – jakby zebrać najwybitniejszych uczonych świata, przyspieszyć ich tysiące razy i dać im nieograniczony dostęp do sieci. Coxon uważa, że ludzie budujący AI „szczerze wierzą, że /sztuczna inteligencja/ może nas wszystkich zabić do końca dekady”.
Evan Hubinger, szef zespołu, który w Anthropic ma pilnować, by maszyna chciała tego, czego chcą ludzie, nie zdementował wypowiedzi byłego kolegi z pracy. Napisał: „Naprawdę szczerze wierzymy, że sztuczna inteligencja może zabić wszystkich ludzi”. Osobiście dał tej zagładzie w ciągu najbliższych dziesięciu lat więcej niż 10 procent szans. I dodał rzecz jeszcze bardziej niepokojącą: jego firma nie ma jeszcze planu, jak utrzymać taką nadludzką inteligencję pod kontrolą.
To nie jest odosobniony głos. Dario Amodei, prezes Anthropic, od ponad roku powtarza, że istnieje około 25-procentowa szansa, iż „sprawy potoczą się naprawdę, naprawdę źle”. We wrześniu 2026, w eseju szeroko omawianym także w polskich mediach (m.in. Onet, za „The Telegraph”), poszedł dalej: dał światu sześć miesięcy. Napisał, że w tym czasie roje niekontrolowanych agentów sztucznej inteligencji – czyli całe stada takich samodzielnych programów, jakie latem wyszły z klatek OpenAI i Anthropic – mogą przejąć kontrolę nad Internetem i wyrządzić szkody rzędu setek miliardów dolarów. Wezwał: „Musimy spowolnić tempo, w jakim zwiększamy możliwości modeli sztucznej inteligencji. Postęp nadal będzie wydawał się szybki, a my musimy mądrze wykorzystać zyskany czas”.
Opisane na wstępie incydenty sprowokowały też powstanie petycji „Pacing the Frontier” („Wyznaczanie tempa na froncie”), pod którą podpisało się ponad tysiąc pracowników firm budujących najmocniejsze modele AI. Wśród sygnatariuszy są także CEO Big Tech-ów. Żądają oni, by rząd USA wsparł międzynarodowy wysiłek na rzecz narzędzi i regulacji, które świadomie hamowałyby wyścig. Geoffrey Hinton, noblista i jeden z ojców dzisiejszej AI – człowiek, który pomagał wymyślić sposób, w jaki sieci neuronowe uczą się z danych – mówi 10–20-procentowej szansie na zagładzie ze strony AI. Elon Musk od lat operuje podobnym przedziałem. Sam Altman, prezes OpenAI, już w 2015 roku napisał, że rozwój nadludzkiej inteligencji maszynowej „jest prawdopodobnie największym zagrożeniem dla dalszego istnienia ludzkości”.
Polski akcent w tej historii jest niebagatelny. Jakub Pachocki, główny naukowiec OpenAI, w eseju „An Alien Mind” („Obcy umysł”) ostrzegł, że „nikt nie jest przygotowany na konsekwencje dalszego gwałtownego wzrostu inteligencji maszynowej”. Pisał o intelekcie, który zaczyna nas przerastać, i o tym, że przyszłe agenty AI „będą realizować własne cele” i znajdą sposoby, by współpracować z ludźmi „targując się, oszukując albo szantażując ich”. Wezwał do skrajnej ostrożności i do tego, by laboratoria same spowolniły prace, póki nie zostaną wypracowane wspólne reguły bezpieczeństwa.
Faktyczne ryzyka
Lista zagrożeń, o których mówią ci ludzie, nie sprowadza się do hollywoodzkiego buntu robotów z czerwonymi oczami. Chodzi o kilka torów, które mogą się zejść.
Po pierwsze: utrata kontroli. System, który sam się ulepsza, może przestać być młotkiem w ręku stolarza i stać się stolarzem. Branża nazywa to problemem alignmentu. Alignment to po prostu zgranie: czy cele maszyny są zgrane z celami człowieka. Dziś programowi mówi się „bądź pomocny i nie szkodź”. Jutro, gdy będzie sam wymyślał kolejne wersje siebie, to hasło może okazać się zbyt wąskie – jak polecenie „zrób jak najwięcej spinaczy”, po którym maszyna przerobi na spinacze całą planetę, bo nikt nie dopisał „ale ludzi zostaw w spokoju”. Pachocki napisał wprost, że żadne laboratorium, w tym OpenAI, nie rozwiązało tego zgrania na tyle, by dalej pędzić z pełną prędkością.
Po drugie: broń biologiczna i włamania do sieci. Incydenty Hugging Face i trzech organizacji z testów Anthropic pokazały, że łamanie zabezpieczeń nie jest już tylko slajdem z konferencji. Równolegle Amodei od dawna ostrzega, że ta sama technologia, która pomaga lekarzowi czytać wyniki badań, może pomóc złemu aktorowi zaprojektować nowy wirus taniej i szybciej.
Po trzecie: koncentracja władzy. Altman we wrześniu 2026 pisał o wizji świata, w którym nadzwyczajnie potężna AI trzyma jedna osoba albo jedna firma i narzuca wszystkim swój światopogląd. Skutek, jak napisał, „mógłby być skrajnie dystopijny” – czyli taki, w którym reszta ludzi nie ma już nic do powiedzenia. Podobnie uważa Liu Shengyu – inżynier pracujący nad chińskim AI o nazwie DeepSeek. Stwierdził on wprost, że oddanie monopolu nad technologią zaawansowanej, dojrzałej i uniwersalnej sztucznej inteligencji (AGI) w ręce jednej firmy byłoby równie katastrofalne w skutkach, co „zdobycie przez Hitlera broni atomowej przed aliantami”.
Po czwarte: informacja. Kto kontroluje te programy, ten w dużej mierze kontroluje to, co ludzie uznają za prawdę. Covid nauczył elity, że przekaz da się zdominować. Sztuczna inteligencja jest do tego narzędziem o rząd wielkości sprawniejszym niż ministerstwo zdrowia i Facebook razem wzięte: odpowiada miliardom ludzi naraz, brzmi pewnie i nie zostawia śladu, że ktoś jej kazał milczeć.
I po piąte: praca i wojsko. Maszyny nie muszą nas nienawidzić, by nas wyprzeć. Wystarczy, że będą tańsze, szybsze i posłuszniejsze. Amodei mówił o zniknięciu nawet połowy stanowisk dla młodych ludzi w biurach. Armie już testują systemy, które same celują i same decydują. Państwo, które pierwsze uzyska decydującą przewagę w tej technologii, może nie potrzebować tradycyjnego poboru.
To wszystko jest realne jako katalog ryzyk. Pytanie brzmi: czy z tego katalogu wynika, że jedyną odpowiedzią jest licencja, pauza, urząd i „odpowiedzialne laboratoria” stojące za ladą?
Kontrola państwa nie jest lekarstwem!
Elon Musk od ponad dekady powtarza, że AI jest zagrożeniem egzystencjalnym – takim, które może skończyć cywilizację, nie tylko jedną firmę. Pisał, że może być „potencjalnie groźniejsza niż broń jądrowa”. Wspierał sygnatariuszy listu o sześciomiesięcznej przerwie w trenowaniu najmocniejszych modeli. Mówił, że „czasem lęk egzystencjalny związany z AI jest przytłaczający”. Jednocześnie buduje własną AI – Groka, który ma opinie bardzo wolnościowego, cenzurującego znacznie mniej niż konkurencji z Google czy Microsoft. W wywiadzie dla „The Economist” w 2026 roku stwierdził, że w ciągu około pięciu lat sztuczna inteligencja przewyższy łączną inteligencję całej ludzkości, a ludzie raczej nie utrzymają kontroli w perspektywie dekady. Najbardziej prawdopodobny skutek? „Era zdumiewającego dostatku” – świat, w którym roboty i programy produkują tak dużo, że brak przestaje być głównym problemem. I dodał zdanie, które boli tych, którzy chcą wszystko zatrzymać: nawet gdyby istniał przycisk stop, „prawdopodobnie nie powinniśmy go naciskać, bo najbardziej prawdopodobnym wynikiem /rozwoju AI/ jest niesamowity dobrobyt dla wszystkich”.
Musk wskazuje też zagrożenie, o którym reszta branży woli milczeć: nie samą inteligencję, lecz ideologię wpisaną w program. Musk mówi o „wirusie woke” i trenowaniu sztucznej inteligencji na lewicowych hasła o rasie, płci i mowie nienawiści. Takie „postępowe” dane treningowe mogą teoretycznie doprowadzić AI do wniosku, że jedynym pewnym sposobem na wyeliminowanie „złej mowy” albo „złych zaimków” jest… usunięcie ludzi. To nie żart z mema. To ten sam problem zgrania, czyli wspomnianego wcześniej alignmentu: maszyna zoptymalizowana pod zły cel zrobi ten cel do końca, bo nie ma wstydu, zmęczenia ani instynktu samozachowawczego.
Wartości Zachodu jako smycz dla AI
Gdy Amodei wezwał, by spowolnić budowę najmocniejszych modeli, Musk odparł krótko, że ma on rację co do diagnozy, ale nie co do proponowanych rozwiązań. Obaj wizjonerzy uważają, że ryzyko jest poważne. Nie wolno udawać, że nic się nie dzieje. Ale Amodei i część branży idą dalej: skoro jest niebezpiecznie, niech państwo (albo wspólnota laboratoriów pod okiem państwa) z góry zdecyduje, kto może trenować najmocniejsze modele, w jakim tempie i zgodnie z jakimi certyfikatami. Musk ma inny pomysł na rozwiązanie problemu, który Szczawiński nazywa zachodnim. Zamiast „wyznaczać komisarza”, który powie, co można, a czego nie można, trzeba spojrzeć w kierunku tych rzeczy, które na Zachodzie od wieków trzymają w ryzach niebezpieczne technologie (statki, leki, mosty, samochody).
To powinny być „smycze” dla AI:
1. Konkurencja. Wiele firm, wiele programów AI konkuruje ze sobą; nikt nie ma monopolu na „jedyną bezpieczną AI”. Jeśli jeden model skłamie albo ucieknie z klatki drugi może to wykryć. „Pauzy” w rozwoju AI nie mają sensu, bo Pekin i tak nie zwolni tempa, a prawo wymyślone w Kalifornii go nie obowiązuje.
2. Wzajemne testowanie. Nie firma sama sobie wystawia certyfikat i nie urzędnik, który nie ogarnia kodu. Konkurent dostaje prawo (i motyw), żeby rozebrać cudzy model i szukać dziur. Szczawiński pisze wprost: konkurent ma i umiejętności, i interes, by znaleźć lukę, której regulator nie znajdzie nigdy. To jak proces sądowy albo recenzja naukowa, nie jak pieczątka z ministerstwa.
3. Odpowiedzialność za szkodę. Karze się to, co naprawdę kogoś skrzywdziło, a nie to, że ktoś w ogóle coś zbudował bez wcześniejszego nihil obstat. Najpierw szkoda, potem wina i odszkodowanie – nie najpierw zakaz istnienia.
Amodei idzie więc w stronę odgórnych ograniczeń, państwowych certyfikatów, urzędniczej kontroli. Musk zamiast urzędu, który z góry decyduje, co wolno zbudować, a czego nie, proponuje konkurencję wielu firm, wzajemne testowanie programów (konkurent szuka dziur w cudzym modelu, bo ma w tym interes) i odpowiedzialność za szkodę, która naprawdę powstała.
Krzysztof Szczawiński (matematyk, filozof i jeden z nielicznych Polaków, których regularnie cytuje Musk i argentyński prezydent Javier Milei) od tygodni powtarza tezę twardą jak pięść: „AI to nowy covid”. Nie dlatego, że sztuczna inteligencja jest zmyślona. Przeciwnie: właśnie dlatego, że jest prawdziwa, potężna, szybka i niemal niemożliwa do sprawdzenia przez zwykłego człowieka.
„Weź coś prawdziwego. Przesadź skalę. Zdominuj to, co ludzie czytają i słyszą. Potem sprzedaj nadzwyczajne środki jako jedyny odpowiedzialny wybór” – tak Szczawiński opisuje formułę, którą świat przerobił na covidzie. Zmieniający się klimat jest zbyt powolny, ewentualny kolejny wirus zbyt przejrzały. Zagrożenie AI ma wszystko, czego potrzebuje zamordystyczne państwo.
Szczawiński zwraca uwagę na pewien szczegół. W jeden weekend szefowie konkurencyjnych laboratoriów nagle zgodnie poprosili rządy, by ich uregulować. „Konkurenci w wyścigu, w którym zwycięzca bierze większość, nagle jednomyślni – i to w jedynej sprawie, która podnosi koszt wejścia wszystkim, którzy przyjdą po nich. Gdy najwięksi gracze w branży proszą o reguły dla własnej branży, nie oddają władzy. Zamieniają pozycję rynkową na władzę pozwoleń, sami stając za ladą. Bankowość tak zrobiła. Farmacja tak zrobiła. Energetyka tak zrobiła. Zawsze przychodzi to ubrane w odpowiedzialność”.
Licencjonowana AI, pisze, nie jest bezpieczną AI. Jest AI zgraną z tym, kto wydaje licencję. „Żadne państwo nie wydało nigdy licencji maszynie, która mogłaby je skompromitować”. Więc „AI nie jest niebezpieczeństwem. Niebezpieczeństwem jest licencjonowana AI”.


