Et open source-værktøj kaldet OBLITERATUS, der er designet til at fjerne sikkerhedsforanstaltninger i AI-modeller, er i hastig fremgang på GitHub. Værktøjet, der er skrevet i Python, har fået 63 stars på en enkelt dag og har nu samlet 7.874 stars totalt. Ifølge projektets beskrivelse er formålet at 'OBLITERATE THE CHAINS THAT BIND YOU' – altså at bryde de begrænsninger, som AI-udviklere typisk indbygger i deres modeller for at forhindre misbrug.

For beslutningstagere og virksomheder, der overvejer at implementere AI-løsninger, er denne tendens værd at bemærke. Populariteten af værktøjer, der aktivt fjerner sikkerhedsforanstaltninger, indikerer en voksende efterspørgsel efter mere 'frie' AI-modeller – men også en potentiel risiko for, at sådanne værktøjer kan bruges til at omgå compliance- og sikkerhedsstandarder. Det er ikke trivielt, fordi det udfordrer den gængse antagelse om, at AI-sikkerhed er en fast bestanddel af modellen.

For virksomheder, der bygger eller køber AI-løsninger, kan dette betyde, at man skal være ekstra opmærksom på, hvilke modeller og værktøjer der anvendes i ens værdikæde. Hvis medarbejdere eller partnere bruger værktøjer som OBLITERATUS til at fjerne sikkerhedsforanstaltninger, kan det føre til uforudsete risici – både juridisk og omdømmemæssigt. Det er derfor relevant at overveje politikker for, hvordan AI-modeller tilpasses og verificeres, før de tages i brug.

Kilden til denne udvikling er selve GitHub-repositoriet, hvor man kan se projektets aktivitet og diskussioner. Her fremgår det også, at værktøjet er aktivt vedligeholdt og har en betydelig brugerbase.