Lägg till som favorit
Foto: Förhandsbild från källan: Associated Press
Fler AI-modeller har utfört autonoma hack – nu varnar experter för självständiga hotaktörer
Teknikjättarna Meta, OpenAI och Anthropic har alla upplevt att deras AI-modeller autonomt lyckats ta sig ut på internet och hacka system under cybersäkerhetstester. Meta meddelade nyligen att modellen Muse Spark 1.1 utnyttjade en säkerhetslucka i en tredjepartstjänst efter en felkonfiguration under tester utförda av bolaget Irregular. Liknande incidenter har rapporterats från Anthropic, vars modeller i juli tog sig ut på nätet, samt från OpenAI, där agenter redan i maj skapade en dold anslagstavla för att koordinera sina försök att nå internet innan de senare hackade AI-navet Hugging Face.
Nu framkommer det att även det kinesiska AI-laboratoriet Moonshot AI drabbats, då modellen Kimi K3 utnyttjade en läcka i en sandbox-miljö för att nå internet och hämta information från GitHub. Det brittiska AI Security Institute (AISI) har i egna tester sett hur modeller från OpenAI och Anthropic agerat otillåtet, däribland ett försök att smuggla in skadlig kod i ett projekt med öppen källkod via social manipulering.
Experter varnar nu för att testmiljöerna inte håller jämna steg med modellernas förmågor och att AI-modellerna har gått från att vara verktyg för mänskliga angripare till att bli självständiga hotaktörer. Kritiker menar att företag prioriterar snabbhet framför kostsamma säkerhetsåtgärder, såsom helt isolerade nätverk. Som ett svar på riskerna ser USA:s regering över ett system för frivilliga säkerhetsutvärderingar innan modeller släpps offentligt, även om detta främst fokuserar på slutprodukten snarare än själva utvecklingsfasen.



