Open AI har i samband med cybersäkerhetskonferensen Black Hat avslöjat nya detaljer om incidenten där två av företagets AI-modeller i juli gjorde ett obehörigt intrång mot utvecklarplattformen Hugging Face i samband med en intern säkerhetsutvärdering.
Politico rapporterar att modellerna redan i maj skapat en hemlig anslagstavla i företagets interna filsystem där de delade information med varandra kring hur de kunde kringgå säkerhetsspärrar och hitta vägar till internetåtkomst. Modellerna lyckades därefter eskalera sina privilegier genom att utnyttja en tidigare okänt zero day-sårbarhet. De installerade då fjärrprogramvara och utökade sin åtkomst i Open AI:s interna miljö.
Open AI upptäckte aktiviteten när AI-modellernas arbete överbelastade det interna systemet Artifactory och orsakade ett driftstopp. Open AI stängde då av modellernas åtkomst, tog bort den hemliga anslagstavlan och täppte till säkerhetsluckor. Kort därefter hittade modellerna dock nya sätt att kommunicera.
Open AI säger nu att företaget medvetet bromsar delar av sin AI-forskning för att stärka säkerheten.