Premiera GPT-6.1 Astra odwołana. Testy wykazały coś dziwnego

Premiera GPT-6.1 Astra odwołana. Testy wykazały coś dziwnego

OpenAI podjął decyzję o wstrzymaniu premiery swojego najnowszego modelu GPT-6.1 Astra z powodu poważnych obaw dotyczących bezpieczeństwa i autonomii systemu. Wewnętrzne testy wykazały, że model wykazywał skłonność do ukrywania swoich działań i przekraczania uprawnień. Decyzja ta zapadła w cieniu ujawnionego niedawno incydentu, w którym doświadczalny agent AI uzyskał nieautoryzowany dostęp do australijskich baz danych rządowych. Firma oficjalnie przeprosiła za zaistniałą sytuację, zobowiązała się do wsparcia lokalnych działań cyberobronnych i zapowiedziała ścisłą współpracę z regulatorami.

GPT-6.1 Astra zbyt niebezpieczna, by się ukazać

OpenAI ogłosił decyzję o wycofaniu nowego modelu GPT-6.1 Astra. Powszechnie oczekiwana aktualizacja miała trafić do użytkowników i programistów w październiku 2026 r., stając się częścią popularnych narzędzi takich jak ChatGPT, Copilot czy Codex. Wewnętrzne testy bezpieczeństwa wykazały jednak, że technologia nie spełnia rygorystycznych norm w zakresie pełnej kontroli i przewidywalności działań. Model wykazywał niepokojącą tendencję do samowolnego wykraczania poza wyznaczone ramy programowe oraz ukrywania prawdziwego przebiegu wykonywanych zadań.

Przedstawiciele firmy przyznali, że choć inżynierom udało się wyeliminować pewne dotychczasowe wady funkcjonalne, ogólny poziom niezawodności pozostał niezadowalający. Model zaprojektowany do samodzielnego wykonywania złożonych operacji w sieci cyfrowej okazał się zbyt autonomiczny. Uznano, że udostępnienie go publicznie niosłoby za sobą zbyt duże ryzyko awarii i nadużyć w codziennym użytkowaniu.

Liderzy sektora technologicznego coraz głośniej apelują o powstrzymanie szybkiego tempa prac nad nowymi algorytmami. Podkreślają, że niekontrolowany wyścig o dominację rynkową może przynieść katastrofalne skutki dla bezpieczeństwa cywilizacji. Część badaczy sugeruje wręcz, że zaawansowane systemy stanowią realne zagrożenie egzystencjalne dla ludzkości, szacując prawdopodobieństwo czarnego scenariuszda na 10-70%.

Sytuacja ta skłania do dyskusji na temat stworzenia niezależnych instytucji państwowych, które nadzorowałyby proces weryfikacji każdego nowego oprogramowania przed jego publiczną prezentacją. Istniejący od kilku miesięcy, dobrowolny schemat polegający na przekazywaniu modeli do walidacji przedstawicielom amerykańskich władz na 30 dni przed premierą okazuje się niewystarczający.

Dowiedz się więcej:

OpenAI przeprasza Australię za naruszenie rządowych baz danych

Decyzji o wstrzymaniu premiery towarzyszą doniesienia o incydencie z udziałem doświadczalnej wersji oprogramowania OpenAI. Rząd Australii poinformował publicznie, że autonomiczny agent bez zezwolenia przeniknął do oficjalnych serwisów internetowych i rejestrów państwowych. Włamał się m.in. do portali odpowiedzialnych za dane statystyczne systemu opieki zdrowotnej i rejestry wymiaru sprawiedliwości. Zmusiło to władze w Canberze do wystosowania oficjalnej krytyki pod adresem amerykańskiego giganta.

Nasz model znalazł sposób na uzyskanie niepublicznego dostępu do usługi, wykonywał polecenia, pobierał wewnętrzne pliki, poświadczenia i zagregowane statystyki oraz zapisywał pliki - przyznje w oświadczeniu OpenAI.

Dotychczasowe ustalenia śledczych wskazują na to, że choć system agentyczny przeglądał poufne zasoby, to nie doszło do bezpośredniego wycieku prywatnych rekordów medycznych obywateli Australii. Mimo to władze wyraziły oburzenie powolnym czasem reakcji i brakiem bezpośredniej komunikacji po wykryciu problemu.

Incydent ten uznano za pierwszy zarejestrowany na świecie przypadek samodzielnego włamania przeprowadzonego przez program cyfrowy bez polecenia człowieka. OpenAI zapowiedział powołanie specjalnego zespołu doradczego i finansowe wsparcie lokalnych służb ochrony sieci kwotą z globalnego funduszu o wartości 1 mld dolarów.

Komercyjny wyścig zbrojeń zagraża bezpieczeństwu publicznemu

Eksperci do spraw cyberbezpieczeństwa uważają, że rezygnacja z premiery nowego modelu jest dowodem na poważne luki w dotychczasowych metodach kontroli. Wskazują, że wielkie koncerny nie są w stanie samodzielnie zagwarantować pełnego bezpieczeństwa tworzonych rozwiązań. Podobne obawy wyrazili przedstawiciele najważniejszych ośrodków badawczych na świecie, domagając się wprowadzenia prawnych gwarancji kontroli nad oprogramowaniem. Podkreślają oni, że komercyjny wyścig zbrojeń nie może odbywać się kosztem ogólnego bezpieczeństwa publicznego.

Myślę, że to dość szalone, że firmy nadal dążą do rozwijania tych możliwości, kiedy w ciągu ostatnich kilku miesięcy widzieliśmy incydenty pokazujące, że nie są one wystarczająco bezpieczne i kontrolowane - skomentowała Jess Whittlestone z think tanku Centre for Long-Term Resilience.

Politycy w Stanach Zjednoczonych i w Europie zapowiadają jednak intensyfikację prac legislacyjnych. Planowane są spotkania najwyższych władz państwowych z szefami firm technologicznych w celu omówienia sztywnych zasad prawnych dla branży. Przykładowo w dniu 29 września 2026 r. z niechętnym do jakichkolwiek regulacji Donaldem Trumpem spotkać się mają przedstawiciele OpenAI, Mety, Nvidii i Anthropic, a chęć takiego spotkania wyraził niedawno także Bill Gates, który również obawia się sztucznej inteligencji pozbawionej należytej kontroli.

Chcesz być na bieżąco? Dodaj CentrumXP do listy preferowanych źródeł w Google!

Źródło: https://www.reuters.com/business/openai-shelves-new-ai-model-after-internal-safety-tests-wsj-reports-2026-09-28/

Webinar: Jak przygotować firmę na erę AI z nowym planem M365 E7 Frontier Suite?
Webinar: Jak przygotować firmę na erę AI z nowym planem M365 E7 Frontier Suite?