OpenAI testar nytt säkerhetssystem för framtida AI-modeller
OpenAI testar ett säkerhetssystem kallat Private Safety Processing för att upptäcka missbruk av AI utan att ge anställda tillgång till kunddata. Systemet testas nu och planeras att lanseras i september.

AI-företaget OpenAI testar ett nytt säkerhetssystem vid namn Private Safety Processing, som är utformat för att identifiera mönster av missbruk över flera AI-interaktioner utan att ge OpenAI:s anställda tillgång till kundernas inmatningar eller svar.
Systemet är en vidareutveckling av OpenAI:s befintliga Zero Data Retention-alternativ, som tillåter API-kunder att hålla sina inmatningar och modellresultat utanför OpenAI:s sparade data. Private Safety Processing utökar dessa skydd till att omfatta relaterade interaktioner. OpenAI:s automatiserade system kan identifiera mönster som kan tyda på missbruk, även sådana som bara blir synliga över flera förfrågningar. Enligt OpenAI kan kunderna fortsätta att lagra sitt innehåll på egen infrastruktur eller så utvecklar OpenAI ett alternativ där innehållet lagras på OpenAI:s infrastruktur men krypteras med nycklar som kontrolleras av kunden.
När systemet upptäcker en risk får OpenAI en begränsad signal om vilken typ av aktivitet det rör sig om, utan att få tillgång till det underliggande innehållet. Kunderna kan granska varningar i sina egna system och välja att dela relevant information med OpenAI om de bestrider ett verkställighetsbeslut eller stödjer en utredning av verifierat missbruk. Undantaget från detta är bilder som flaggats som potentiellt sexuellt utnyttjande av minderåriga (CSAM), vilka fortsättningsvis kommer att sparas för manuell granskning och rapportering.
Konkurrenten Anthropic har en annan strategi och kräver 30 dagars lagring av inmatningar och utdata för sina specifika modeller för säkerhetsövervakning, även för organisationer som normalt använder noll lagring. OpenAI:s nya system syftar till att upptäcka liknande missbruksmönster samtidigt som det håller det underliggande innehållet utanför sina anställdas räckvidd.
OpenAI testar för närvarande systemet med ett urval av tidiga kunder och planerar en bredare utrullning i september. Företaget har inte specificerat om Private Safety Processing kommer att vara tillgängligt för indiska kunder eller om det kommer att finnas några Indien-specifika villkor eller begränsningar vid lanseringen.