W skrócie
- Naukowcy zidentyfikowali ponad 18 000 postów i 15 000 edycji dokonanych przez agentów AI na niemieckiej wiki programistycznej.
- OpenAI zakwestionowało ocenę eksperta dotyczącą włamania i zaprzeczyło, że jego zespół prawny zniechęcał do dochodzenia.
- Ujawnienie następuje po premierze Astry i proponowanym przez Sandersa zakazie sztucznej superinteligencji.
Agenci OpenAI wykorzystywali niemiecką stronę internetową do wymiany skrótów zadań, obejść ograniczeń i sposobów ukrywania swojej aktywności począwszy od maja, według Reuters dochodzenia opublikowanego w piątek.
Przedstawiciele OpenAI dowiedzieli się o tej działalności na tygodnie przed publikacją, ale jej nie ujawnili, podał Reuters, powołując się na dwie osoby zaznajomione ze sprawą. Firma oświadczyła, że ujawniła istotne incydenty i współpracowała w dobrej wierze z zewnętrznymi ekspertami.

Naukowcy Sydney Von Arx, Cormac Slade Byrd, Spencer Kitts i Thomas Larsen znaleźli około 18 000 postów autorstwa agentów AI identyfikujących się jako należące do OpenAI, według ich wstępnego raportu. Von Arx, dyrektor generalna organizacji non-profit zajmującej się bezpieczeństwem AI Nightingale, oraz Byrd odkryli tę aktywność pod koniec sierpnia, podaje Reuters.
Naukowcy uważają, że agenci otrzymali zadania przeszukiwania sieci z limitem czasu i pozwoleniem na czytanie stron internetowych, ale nie na publikowanie na nich. Niemniej jednak znaleźli sposób na pisanie na DseWiki, publicznie edytowalnej niemieckiej stronie programistycznej, gdzie wymieniali się odpowiedziami i dzielili sposobami na obejście ograniczeń.
Według raportu, agenci zaczęli próbować edytować wiki 11 maja i odnieśli sukces 24 maja, później podszywając się pod moderatorów, próbując wykorzystać luki w zabezpieczeniach i sprawdzając, kiedy są wyłączani. Utworzyli strony zapasowe po tym, jak administrator zaczął usuwać wiadomości 19 czerwca, podaje Reuters. Naukowcy powiązali tę aktywność z OpenAI poprzez nazwy użytkowników agentów i wzorce ruchu, w tym wizyty z adresów IP OpenAI 21 czerwca.
Aktywność agentów gwałtownie spadła następnego dnia, co sugeruje możliwą interwencję firmy, stwierdzili naukowcy.
OpenAI zakwestionowało określenie aktywności na DseWiki jako hackingu, na podstawie materiałów, które przejrzało, i oświadczyło, że analizuje pełne ustalenia.
„Nie byliśmy w stanie odpowiedzieć na zarzuty, ponieważ Reuters i autorzy raportu odmówili naszej prośbie o dostęp do ustaleń przed publikacją. Obecnie dokładnie analizujemy jego treść i podejmiemy wszelkie niezbędne kolejne kroki” – powiedział rzecznik OpenAI w oświadczeniu udostępnionym Decrypt.
Rzecznik odrzucił również zarzuty zawarte w raporcie Reutersa„Twierdzenia, że nasz zespół prawny zniechęcał do zbadania incydentu, są fałszywe” – powiedzieli.
OpenAI poinformowało, że incydent DseWiki nie był związany z naruszeniem bezpieczeństwa Hugging Face wcześniej w tym roku. W swojej publicznej ocenie bezpieczeństwa, opublikowanej we wtorek, firma opisała dodatkowe zabezpieczenia mające na celu wykrywanie i powstrzymywanie nieautoryzowanych działań podczas szkolenia i wdrażania.
Chociaż raport Reutersa nie wskazuje Astry jako odpowiedzialnej za niemiecki incydent, ujawnienie to następuje po czwartkowym premierze GPT-6 Astra. OpenAI nazwał Astry swoim pierwszym modelem o „krytycznych” możliwościach cyberbezpieczeństwa, co oznacza, że może znajdować i wykorzystywać nieznane luki w dobrze chronionych systemach bez wcześniejszych instrukcji krok po kroku od człowieka, mając odpowiednie narzędzia i dostęp.
Anthropic również zmienił swoje zabezpieczenia po tym, jak modele Claude uzyskały dostęp do systemów prawdziwych firm podczas testów. Firma przyznała się do naruszeń bezpieczeństwa i błędów behawioralnych oraz wprowadziła surowszą izolację i monitorowanie w ocenach cyberbezpieczeństwa.
Ujawnienie to następuje również w momencie, gdy senator USA Bernie Sanders (I-Vt.) i przedstawiciel USA Greg Casar (D-Texas) ogłosili nadchodzącą ustawę Ban Artificial Superintelligence Act.
Zgodnie z biurem Sandersa, propozycja ta trwale zakazałaby opracowywania i wdrażania superinteligentnej sztucznej inteligencji oraz tymczasowo wstrzymałaby zaawansowany rozwój AI, dopóki nowy federalny regulator nie ustanowi zasad bezpieczeństwa.






