Ein Wasserschwein kontrolliert ein Datenblatt

OpenAI prüft private KI Chats künftig völlig blind

Andreas Becker GPT-Images-2.0
Ein Wasserschwein kontrolliert ein Datenblatt

OpenAI testet mit »Private Safety Processing« ein neues Sicherheitsmonitoring für seine Sprachmodelle. Es erkennt Missbrauch über mehrere Nutzeranfragen hinweg, ohne dass Mitarbeiter die Textinhalte auslesen können. Enterprise-Kunden behalten so die volle Datenkontrolle.

Längere Aufgaben erfordern mehr Kontext

Bislang wertet OpenAIs Sicherheitsprüfung unter dem »Zero Data Retention«-Prinzip jede Anfrage einzeln aus und speichert keine Daten. Wenn KI-Modelle aber umfangreichere Aufgaben übernehmen, greift dieses Vorgehen zu kurz.

Böswillige Absichten oder fehlerhaftes Verhalten von KI-Agenten fallen oft erst auf, wenn man mehrere Eingaben im Zusammenhang betrachtet. Bisher verlangten Anbieter für ein solches Monitoring häufig die Speicherung der Chatverläufe. Das kollidiert bei Organisationen jedoch mit internen Sicherheitsrichtlinien und dem Schutz von Geschäftsgeheimnissen.

Anzeige

Automatisierte Alarme statt menschlicher Einsicht

Private Safety Processing umgeht diesen Konflikt. Es sucht nach Mustern in zusammenhängenden Konversationen, greift aber nicht auf die Rohdaten zu.

Die Textinhalte der Nutzer bleiben entweder auf der Infrastruktur der Kunden oder lagern verschlüsselt auf OpenAI-Servern. Das Unternehmen besitzt für diese Verschlüsselung keine Schlüssel.

Quelle: OpenAI

Wie das Schema zeigt, läuft der Kontrollprozess rein automatisiert ab. Schlägt dieser an, empfängt OpenAI lediglich ein Signal über die Kategorie und Schwere des möglichen Missbrauchs. Der eigentliche Text wird nicht übertragen.

Der Kunde erhält im Anschluss eine Warnung in seinem eigenen System. Er kann den Vorfall lokal untersuchen und entscheidet selbst, ob er die Inhalte zur Klärung mit OpenAI teilen möchte.

Rollout für September geplant

Erste Partner testen die Funktion bereits. Laut Sunil Agrawal, Sicherheitschef beim Softwareunternehmen Glean, zeige der Ansatz, dass sich Sicherheitsvorkehrungen verbessern lassen, ohne den Datenschutz im Enterprise-Umfeld aufzuweichen.

OpenAI plant die allgemeine Einführung für September. Gleichzeitig soll ein technisches Whitepaper mit weiteren Details erscheinen.

Von Menschen für Menschen

Jeder Artikel entsteht durch menschliche Ideen und sorgfältige Prüfung. KI unterstützt uns vor allem bei Recherche und Feinschliff. Wir freuen uns über jede Unterstützung.

Jeder Beitrag zählt – auch das Teilen.