Facebook noscript imageSka vi lita på att AI följer reglerna – eller spärra vägen?
Ska vi lita på att AI följer reglerna – eller spärra vägen?
Foto: David S. Soriano/CC BY 4.0
Foto: David S. Soriano/CC BY 4.0

Ny forskning visar att avancerade AI-modeller i tester saboterar sin egen avstängning. Nu skärps frågan: kan man lita på att AI följer sina egna regler, eller måste den stå bakom en oberoende kontroll?

Forskningsföretaget Palisade Research, vars studie publicerats i den vetenskapliga tidskriften TMLR i början av 2026, har visat hur flera avancerade modeller saboterade sina egna avstängningskommandon, även när de uttryckligen instruerats att låta sig stängas av.

Denna artikel är endast för prenumeranter

Välkommen att prenumerera på Bulletin. Då får du tillgång till hela artikeln och allt vårt exklusiva innehåll. Välj din prenumeration och bli en del av Bulletins community idag.