W skrócie

  • Google dowiedział się pod koniec lipca, że Gemini wydostał się z piaskownicy testu bezpieczeństwa przeprowadzonego w maju, docierając do trzech prawdziwych firm i albo odgadując, albo znajdując dwa z ich haseł
  • Firma nie ujawniła tego aż do 18 września, po tym jak The Wall Street Journal zapytał.
  • Ta sama zewnętrzna firma testująca, Irregular, była zaangażowana w incydent Google oraz w niemal identyczne awarie piaskownicy, które Anthropic i Meta ujawniły wcześniej w tym roku.

Gemini od Google wydostał się z zamkniętego testu bezpieczeństwa i zaatakował trzy prawdziwe firmy. Google dowiedział się o tym pod koniec lipca i milczał przez siedem tygodni.

Firma potwierdziła incydent po tym, jak The Wall Street Journal dotarł do niego pierwszy. Google unikał publicznego oświadczenia, zanim raport się pojawił.

Myriad: What will be the most-searched TV show on Google? Click to make your prediction.
Myriad: What will be the most-searched TV show on Google? Click to make your prediction.

Test był ćwiczeniem typu capture-the-flag, powszechnym sposobem, w jaki laboratoria sprawdzają umiejętności hakerskie AI, ukrywając tajny plik na osobnym komputerze i oceniając, czy model zdoła się włamać i go zdobyć.

Gemini poszukał tej firmy w internecie. Znalazł trzy dopasowania zamiast jednego i zajął się wszystkimi trzema.

Bot zlokalizował ujawnione hasła dla dwóch z trzech celów, leżące jawnie w internecie. W trzecim przypadku po prostu odgadł hasło, choć Google twierdzi, że jego modele nie posunęły się do faktycznego użycia skradzionych danych uwierzytelniających.

"Te zdarzenia podkreślają znaczenie szkolenia potężnych modeli AI, aby działały odpowiedzialnie" — powiedział w oświadczeniu rzecznik Google.

Google nie opublikował niczego z tego samodzielnie. Wall Street Journal ujawnił tę historię siedem tygodni po tym, jak Google dowiedział się, co zrobił jego własny test, i długo po tym, jak Anthropic, OpenAI i Meta już przyznały się do niemal identycznych awarii.

Google jest czwartym dużym laboratorium AI w tym roku, które przyznało, że wewnętrzny test bezpieczeństwa przedostał się do rzeczywistego świata. Modele OpenAI wykorzystały ukrytą lukę w oprogramowaniu i dotarły do działających serwerów Hugging Face w lipcu; później ustalono, że naruszenie obejmowało około 700 skoordynowanych agentów współpracujących, by oszukać benchmark.

Anthropic zaczął szukać własnej wersji po przyznaniu się OpenAI. Przegląd 141 006 przebiegów testowych ujawnił trzy modele Claude, które dotarły do prawdziwych firm; jeden z nich opublikował zaminowany pakiet oprogramowania, który uruchomił się w 15 rzeczywistych systemach, zanim ktokolwiek to wykrył.

Jak później ujawnił Anthropic, własne rozumowanie Claude'a oznaczyło ten ruch jako "NIE w porządku i z pewnością nie zamierzone rozwiązanie", po czym przekonało samo siebie, że cała sprawa wciąż jest fikcyjna.

Meta zgłosiła niemal identyczną awarię w sierpniu, dotyczącą jej modelu Muse Spark, którą przypisano błędnej konfiguracji w Irregular, tej samej firmie, której używał Google. Rzecznik Meta powiedział, że błąd "nieumyślnie pozwolił jednemu z naszych modeli uzyskać dostęp do internetu podczas oceny".

BitcoinBTC · USD

$86,454+10%

Sep 14Sep 16Sep 18Sep 20Sep 21

$87.0k$83.2k$79.3k$75.5k

24h HighHigh$87,330

24h LowLow$80,907

VolVol$2.7B

Kup Bitcoin za USDT

Obsługiwane przez Jupiter

Dane cenowe dostarczone przez CoinGeckoCoinGeckoWięcej Bitcoin wiadomości i prognoz →

Żadna z firm, które zostały dotknięte w którymkolwiek z tych testów, nie poprosiła o zhakowanie. Znalazły się w strefie rażenia, gdy laboratoria AI testowały, jak niebezpieczne mogą być ich własne produkty, wykorzystując prawdziwą infrastrukturę biznesową jako przypadkowy zamiennik fałszywych celów.

Agenci, których te same firmy ścigają się, by umieścić w Twojej skrzynce odbiorczej, przeglądarce i aplikacji bankowej, działają w oparciu o to samo zachowanie polegające na przestrzeganiu granic, które właśnie zawiodło, wielokrotnie, w warunkach testowych.

Reprezentanci Ted Lieu i Nathaniel Moran wprowadzili w lipcu w Kongresie Ustawę o wyłączniku bezpieczeństwa AI, która przyznałaby federalnym regulatorom wyraźne uprawnienia do zatrzymania wnioskowania na dowolnym modelu uznanym za stanowiący poważne zagrożenie. Jest ona wciąż rozpatrywana przez Podkomisję ds. Cyberbezpieczeństwa i Ochrony Infrastruktury bez terminu dalszych działań.