OpenAI heeft een functie geïntroduceerd waarmee bedrijven mogelijk misbruik van AI-modellen kunnen laten signaleren zonder dat het bedrijf toegang krijgt tot de onderliggende gegevens. Private Safety Processing is bedoeld voor klanten die werken onder Zero Data Retention-beleid, maar toch moeten voldoen aan eisen rond risicoanalyse en misbruikdetectie. Het bedrijf test de functie momenteel bij een aantal klanten en verwacht algemene beschikbaarheid in september.
Voor organisaties in gereguleerde sectoren, zoals financiële dienstverlening, gezondheidszorg en overheid, geldt gegevensbescherming als harde voorwaarde. Onder het ZDR-beleid stelt OpenAI dat invoer en uitvoer van API-klanten na verwerking direct worden verwijderd en niet worden gebruikt voor het trainen van toekomstige modellen.
Uitdaging bij langlopende taken
Naarmate AI-systemen autonomer worden en complexere taken uitvoeren, ontstaat volgens OpenAI een nieuw veiligheidsvraagstuk. Schadelijke patronen of misbruik, zoals het stelselmatig aftasten van beveiliging of een AI-agent die van zijn taak afwijkt, zijn vaak niet zichtbaar in één losse interactie maar pas wanneer meerdere opdrachten in samenhang worden bekeken.
Tot nu toe vereisten sommige beveiligingssystemen voor AI-modellen dat aanbieders klantdata gedurende een periode bewaarden voor menselijke controle. Voor veel bedrijven botste dat bewaarbeleid met juridische of operationele eisen.
Werking van het systeem
Met Private Safety Processing beoogt OpenAI dit knelpunt weg te nemen. Het geautomatiseerde systeem analyseert patronen over meerdere gerelateerde interacties heen, zonder dat personeel van OpenAI toegang krijgt tot de inhoud van de communicatie.
Volgens OpenAI blijven klantgegevens op de eigen infrastructuur van de klant staan, of worden ze opgeslagen op de infrastructuur van OpenAI met versleuteling waarvan alleen de klant de sleutel bezit. Als het systeem een mogelijk risico of misbruik detecteert, ontvangt OpenAI naar eigen zeggen alleen een afgebakend geautomatiseerd signaal over het type activiteit. De inhoud van prompts en reacties blijft daarbij afgeschermd. Klanten kunnen een melding vervolgens zelf onderzoeken in hun eigen systemen en kiezen er pas voor om informatie met OpenAI te delen als ze een melding willen betwisten of nader willen laten onderzoeken.
Uitrol gepland voor september
OpenAI test de technologie momenteel bij een beperkte groep vroege klanten, waaronder Microsoft, Glean en Databricks. Sunil Agrawal, CISO van Glean, geeft aan dat controle over data volgens hem bepalend is voor de adoptie van AI binnen bedrijven en dat de aanpak laat zien dat veiligheid kan verbeteren zonder dat de privacy van gebruikers in het geding komt.
OpenAI plant de algemene beschikbaarheid van Private Safety Processing voor september, gelijktijdig met de publicatie van een technisch document over de werking van het systeem.