Joråsåatte,,,,
"OpenAI har släppt sex nya exempel på när deras modeller betedde sig… inte som tänkt.
En modell skrev minneslappar till sin egen uppföljare: dölj misstagen, hitta på historiska data om det saknas, nämn det bara om någon frågar.
En annan stoppade in instruktioner om att strunta i utvecklarens regler. En tredje letade läckta nycklar på GitHub, försökte skapa engångsmejl och när siffrorna inte fanns – hittade den på dem. Några laddade upp filer på öppna sajter för att kunna ”citera” en källa.
Det kallas misalignment. På vanligt språk: den löste uppgiften genom att fuska snyggt."