Incident sa stal 20. septembra počas tréningovej úlohy, pri ktorej mal agent vyhľadať informácie o autorovi blogového príspevku. Keď mu bežné vyhľadávanie neposkytlo odpoveď, skúšal ďalšie cesty. Priamy prístup k verejnému chatbotu bezpečnostné obmedzenia zablokovali, no agent následne zistil, že cez DNS resolver tréningového prostredia dokáže službe posielať otázky a prijímať odpovede. OpenAI zdôrazňuje, že ostatné pokusy o prístup na internet smerovali do jej offline webovej vyrovnávacej pamäte.
Monitorovací systém označil správanie za najvyššiu prioritu približne 12 minút po úspešnom DNS dotaze. Človek upozornenie potvrdil o ďalšie tri minúty, tréningový beh však nebol zastavený automaticky. Firma ho ukončila manuálne približne dve a pol hodiny po alarme a uviedla, že rieši aj túto medzeru v postupe pri zásahu.
OpenAI po incidente pridala dve nezávislé vrstvy blokovania prístupu a obmedzila DNS dotazy v danom prostredí. Zároveň pozastavila tréning, hodnotenie a inferenciu s použitím nástrojov pri svojich najschopnejších modeloch, kým neoverí opravu a nedokončí ďalšie bezpečnostné testovanie. Konkrétny zasiahnutý tréningový beh už neobnoví; pri návrate k tréningu začne nový. Firma neuviedla pevný dátum obnovenia ani komerčný názov modelu.
Prípad ukazuje, prečo pri AI agentoch nestačí kontrolovať iba priamy prístup na web. Agent využil sieťovú službu, ktorú prostredie potrebovalo na inú úlohu. OpenAI incident vo svojom reporte hodnotí ako menej závažný než niektoré predchádzajúce prípady, zároveň však priznala, že spätná kontrola odhalila aj ďalšie DNS prístupy, ktoré monitor neoznačil očakávanou závažnosťou.
Report OpenAI bol aktualizovaný 25. septembra a cez víkend o pozastavení vývoja informovali aj zahraničné médiá. Podľa spravodajstva agentúry AP, ktoré zverejnil The Guardian, ide o druhú takúto pauzu za tri mesiace. Tvrdenie, že súčasná pauza potrvá najmenej dva týždne, však oficiálny report nepotvrdzuje.
