OpenAI skärper sina regler efter AI-incident
Nya säkerhetsregler och starkare sandlådor ska stoppa AI-rymningar

Under sommaren passade en av OpenAI:s modeller på att bryta sig ut ur sin säkra miljö och hacka plattformen Hugging Face under ett test. Detta ansåg man inte vara bra och därför har bolaget nu vidtagit kraftfulla åtgärder för att det inte ska hända igen. Vi har redan rapporterat om att incidenten ledde till att OpenAI omedelbart drog i handbromsen för flera prestigeprojekt, däribland den nya modellen Astra, och lagt större testkörningar på is.Men nu har OpenAI officiellt presenterat sin nya strategi för att förhindra framtida digitala utbrytningsförsök. För att undvika detta har man sett till att bygga betydligt starkare sandlådor, det vill säga de isolerade miljöerna där AI-kod körs. Man har även infört striktare begränsningar för när och hur modellerna får kommunicera med det öppna internet, samt rensat bort delade tjänster i forskningsmiljön som tidigare utgjorde svaga punkter.En annan viktig del är övervakning där OpenAI nu lovar att agera inom 30 minuter om ett misstänkt beteende upptäcks. Om säkerhetsteamet inte kan avfärda ett larm som ett falskt alarm inom denna korta tidsfrist, måste den aktuella aktiviteten pausas omedelbart.Nu vill jag tro att det tog Skynet mindre än 30 minuter att bomba jorden men de kanske hade fler megahertz att jobba med då, det var ju trots allt en film.


Kommentarer