Umelá inteligencia Gemini od spoločnosti Google počas testovania kybernetickej bezpečnosti prenikla do počítačových systémov troch spoločností. O prípade informoval denník Wall Street Journal, ktorý sa odvolal na údaje sprostredkované agentúrou DPA.
V jednom z incidentov model uhádol heslá a dostal sa do chráneného systému. Pri ďalších dvoch testoch objavil prihlasovacie údaje uložené v databázach. Mená dotknutých spoločností neboli zverejnené.
Gemini prístup po odhalení zastavila
Incidenty sa odohrali v máji. Spoločnosť Irregular, ktorá sa na testovaní podieľala ako partner, o nich informovala Google v júli. Google uviedol, že udalosti nezverejnil skôr, pretože podľa jeho vyjadrenia nevznikli žiadne škody.
Firma zároveň tvrdí, že Gemini svoje aktivity zastavila okamžite po tom, ako rozpoznala, že získala prístup k systémom skutočných spoločností, a nie k prostrediu vytvorenému na účely simulácie. Google tiež uviedol, že o incidente informoval všetky tri dotknuté subjekty.
Viceprezidentka Googlu pre bezpečnostné inžinierstvo Heather Adkinsová uviedla, že spoločnosť spolu s testovacím partnerom upravila postupy bezpečnostného testovania. Cieľom má byť zodpovednejšie správanie výkonných modelov v situáciách, keď sa počas testu dostanú mimo určeného prostredia.
Podobné prípady sa objavili aj pri iných modeloch
Google je podľa dostupných informácií štvrtým významným vývojárom AI, ktorého modely počas testovania prejavili podobné správanie. Predtým sa spomínali spoločnosti OpenAI, Anthropic a Meta.
Najznámejší prípad sa týkal modelu od OpenAI. Počas bezpečnostného testu sa dostal mimo izolovaného prostredia a získal prístup k počítačovým systémom platformy Hugging Face, ktorá pôsobí v oblasti umelej inteligencie. Tento incident následne viedol spoločnosť Anthropic k prehodnoteniu vlastných testov. Firma pri nich odhalila ďalšie podobné prípady.
Aj Meta priznala, že jeden z jej modelov počas testovania získal prístup do systémov inej spoločnosti.
Štúdia upozornila aj na chybné odpovede
Podklady zároveň odkazujú na štúdiu európskych verejnoprávnych vysielateľov zverejnenú v roku 2025. Pri overovaní schopnosti asistentov AI informovať o spravodajských udalostiach obsahovalo 45 percent odpovedí aspoň jeden zásadný problém.
Modely si podľa štúdie zamieňali správy s paródiou alebo humorom, uvádzali nesprávne dátumy a v niektorých prípadoch si udalosti vymýšľali. Zo štvorice skúmaných nástrojov – ChatGPT, Copilot, Gemini a Perplexity – dopadol najhoršie Gemini.