OpenAI hat mit der Einführung des „Lockdown Mode“ begonnen, einer optionalen Sicherheitsfunktion, die Nutzer gezielt vor sogenannten Prompt-Injection-Angriffen schützen soll. Bei dieser Angriffsform handelt es sich um eine spezielle Art von Social Engineering, die auf konversationelle KI-Systeme abzielt. Während KI-Modelle zunehmend in der Lage sind, Informationen aus dem Internet abzurufen und zu verarbeiten, nutzen Angreifer versteckte Anweisungen auf Webseiten oder in anderen Inhalten, um die Systeme zu manipulieren. Der Lockdown Mode fungiert hier als eine Art letzte Verteidigungslinie und ergänzt die bereits bestehenden Sicherheitsvorkehrungen von ChatGPT, den zugrunde liegenden Modellen und den Backend-Systemen.
Was ist der Lockdown Mode und für wen ist er gedacht?
Der Lockdown Mode ist keine Funktion, die für den alltäglichen Gebrauch gedacht ist. OpenAI richtet sich mit diesem Feature explizit an Personen und Organisationen, die mit sensiblen Daten arbeiten und ein besonders hohes Sicherheitsbedürfnis haben. Es geht vor allem darum, das Risiko einer Datenexfiltration zu minimieren, also den unbefugten Abfluss vertraulicher Informationen aus dem eigenen Konto. „Der Lockdown Mode ist nicht für jedermann bestimmt“, stellt OpenAI klar. Er biete einen strengeren Schutz vor den Risiken, die mit Prompt-Injection-Angriffen verbunden sind.
Wie funktioniert der erweiterte Schutz?
Um diesen Schutz zu gewährleisten, schränkt der Lockdown Mode bestimmte Funktionen von ChatGPT und anderen OpenAI-Produkten ein. So können Nutzer zwar weiterhin die Bildgenerierung verwenden und Fotos hochladen, das System ruft jedoch keine Bilder aus dem Internet ab und zeigt auch keine Bilder innerhalb von Antworten an. Auch das Herunterladen von Dateien zur Analyse durch die KI wird unterbunden. Dokumente lassen sich weiterhin manuell hochladen, wenn man die Analyse durch das Modell wünscht. Deutlich tiefer greifen die Einschränkungen bei Funktionen wie Deep Research und dem Agent Mode – beide werden im Lockdown Mode vollständig deaktiviert.
Wichtig zu wissen: Der Lockdown Mode hat keinen Einfluss auf den Verlaufsspeicher (Memory), das Hochladen von Dateien, die Möglichkeit, Unterhaltungen zu teilen, oder darauf, ob die eigenen Konversationen zur Verbesserung der Modelle verwendet werden. Diese Einstellungen lassen sich weiterhin separat über die Administrations-Oberfläche konfigurieren.
Was ist eine Prompt-Injection-Attacke?
Eine Prompt-Injection ist eine Sicherheitslücke, die spezifisch für große Sprachmodelle ist. Angreifer platzieren dabei versteckte Anweisungen in Texten, Webseiten oder anderen Inhalten, die von der KI verarbeitet werden. Das Ziel ist es, das Modell zu unerwünschten Handlungen zu bewegen – etwa zur Preisgabe vertraulicher Informationen oder zur Ausführung von Aktionen, die der Angreifer kontrolliert. Der Lockdown Mode verhindert nicht, dass solche schädlichen Inhalte in den von ChatGPT verarbeiteten Daten auftauchen. Seine Stärke liegt vielmehr darin, die Netzwerkanfragen zu begrenzen, die ein Angreifer für den Datendiebstahl ausnutzen könnte.
So aktivieren Sie den Lockdown Mode
Der Lockdown Mode steht allen persönlichen Konten zur Verfügung, auch denen, die ChatGPT über die kostenlose Version nutzen. Die Aktivierung ist denkbar einfach: Öffnen Sie das Einstellungsmenü von ChatGPT und navigieren Sie zum Bereich „Safety and security“. Unter dem Punkt „Advanced security“ finden Sie den Menüeintrag „Lockdown mode“. Ein Klick auf den Schalter aktiviert die Funktion. Für den Fall, dass Sie für eine bestimmte Unterhaltung doch einmal auf die zusätzlichen Funktionen angewiesen sind, lässt sich der Schutz temporär deaktivieren. Dazu wählen Sie im Chat-Fenster oben die Option „Manage“ aus und klicken auf „Turn off for this chat“.
Neuer Sitzungsmanager für mehr Kontrolle
Parallel zum Lockdown Mode führt OpenAI einen sogenannten Active Session Manager ein. Dieses Tool zeigt Nutzern an, welche Geräte oder Browser derzeit auf ihr Konto zugreifen oder in der Vergangenheit zugegriffen haben. Von dort aus können einzelne Sitzungen oder auch alle aktiven Sitzungen auf einmal beendet werden. OpenAI weist jedoch darauf hin, dass der Vorgang des globalen Ausloggens bis zu 30 Minuten in Anspruch nehmen kann. „Wenn Sie den Verdacht haben, dass jemand unbefugt auf Ihr Konto zugegriffen hat, ändern Sie Ihr Passwort, überprüfen Sie Ihre Anmeldemethoden und kontaktieren Sie den OpenAI-Support“, empfiehlt das Unternehmen.
Mit der Einführung des Lockdown Mode und des Sitzungsmanagers reagiert OpenAI auf ein wachsendes Sicherheitsbedürfnis in einer Umgebung, in der KI-Assistenten zunehmend in kritische Geschäftsprozesse und den Umgang mit vertraulichen Daten eingebunden werden. Die Maßnahmen zeigen, dass das Unternehmen die Risiken ernst nimmt, die mit der zunehmenden Autonomie und Vernetzung seiner Modelle einhergehen. Ob der Lockdown Mode in der Praxis tatsächlich die gewünschte Wirkung entfaltet, wird sich zeigen – insbesondere dann, wenn Angreifer neue Wege finden, die Einschränkungen zu umgehen. Für Nutzer, die höchste Sicherheitsstandards benötigen, ist die Funktion jedoch ein wichtiger und längst überfälliger Schritt.