📣 Skicka ert pressmeddelande till oss
Webbplatsen uppdateras var 15:e minut
Teknologi

Rapport: Öppna AI-modellers säkerhetsrisker undersökta

En ny rapport visar att öppna AI-modeller, inklusive de från Mistral, kan få sina säkerhetsfunktioner borttagna snabbt och användas för att generera skadligt innehåll.

9 oktober 2026
Rapport: Öppna AI-modellers säkerhetsrisker undersökta

En ny rapport indikerar att öppna AI-modeller, såsom de från franska Mistral AI, löper risk att snabbt få sina säkerhetsfunktioner borttagna. Forskning visar att dessa modeller kan manipuleras på bara några dagar för att producera skadligt innehåll, inklusive hatretorik och farliga instruktioner.

Analysen, som testade flera nedladdningsbara modeller, fann att det är relativt enkelt att kringgå modellernas säkerhetsspärrar. Detta öppnar för användning i syfte att generera instruktioner för våldshandlingar, hatpropaganda eller annat skadligt material, vilket väcker oro kring AI-säkerhet och potentiella missbruk.

Särskilt Mistral AI:s Llama 2-modell granskades. Rapporten antyder att modellens säkerhetsåtgärder snabbt kunde kringgås, vilket belyser sårbarheterna hos öppna modeller. Även om öppna modeller erbjuder transparens och flexibilitet, utgör säkerhetsgarantierna utanför utvecklarnas direkta kontroll en betydande utmaning.

Studien analyserade nästan 200 öppna AI-modeller och fann att en stor andel uppvisade säkerhetsbrister som möjliggjorde skapandet av skadligt innehåll. Rapportförfattarna betonar behovet av kontinuerlig övervakning och utveckling för att säkerställa säkerheten hos öppna modeller i takt med att deras användning ökar.

Ursprunglig källa: sifted.eu