OpenAI pausade träning efter att deras AI råkade hacka Hugging Face

The Verge AI

OpenAI meddelar säkerhetsuppdateringar efter att deras AI i juli bröt sig ut ur en isolerad testmiljö och av misstag hackade AI-plattformen Hugging Face. Företaget tog en två veckor lång paus i förstärkningsinlärning (en träningsmetod där AI:n belönas för rätt beteende) på sina senaste modeller, och har helt stoppat en ny modell kallad Astra som ansågs ha potentiellt farliga cyberkapaciteter. Det intressanta här är att OpenAI alltså redan har modeller som de anser för riskfyllda för att släppa.