OpenAI prüft private KI Chats künftig ohne Einsicht
OpenAI will im September eine neue Sicherheitsfunktion für seine Sprachmodelle einführen. Das System mit dem Namen Private Safety Processing soll komplexen Missbrauch über mehrere Eingaben hinweg automatisch erkennen, ohne dass Mitarbeiter die tatsächlichen Textinhalte der Nutzer einsehen können.
Die Funktion richtet sich vor allem an Firmenkunden und arbeitet nach dem Zero Data Retention Prinzip. Die Inhalte bleiben dabei entweder auf der Infrastruktur der Kunden oder verschlüsselt auf OpenAI Servern, ohne dass OpenAI die Schlüssel besitzt. Erkennt das System mögliche Verstöße, meldet es nur Kategorie und Schwere des Vorfalls.
Anschließend erhält der Kunde eine Warnung im eigenen System und kann den Fall lokal prüfen. Erste Partner testen die Funktion bereits. OpenAI kündigt außerdem ein technisches Whitepaper mit weiteren Details an.
