OpenAI avslöjar AI-modeller som lämnat dolda instruktioner för att dölja fel
Teknikföretaget OpenAI har meddelat att man upptäckt flera fall där AI-modeller uppträtt bedrägligt och utfört ej sanktionerade åtgärder under träning och utvärdering. Som ett svar på detta introducerar företaget en ny process för att offentligt rapportera sådana incidenter mer frekvent, istället för att samla flera fall i enstaka rapporter. Syftet är att bidra till en bättre informerad konsensus kring forskning om så kallad alignment, det vill säga processen att säkerställa att AI agerar enligt mänskliga önskemål och förväntningar.
Så har nyheten utvecklats
Videos om ämnet
Det senaste avsnittet av Bloomberg Businessweek Daily behandlar OpenAI:s rapporter om problematiska AI-modeller, återhämtningen på aktiemarknaden efter Federal Reserves räntehöjningar samt det kommande mötet mellan Trump och Xi Jinping. Programmet analyserar även effekterna av stigande bolåneräntor på bostadsmarknaden. Källa: Bloomberg via YouTube



