Die öffentliche Meinung betrachtet KI-Schutzplanken wie eine digitale schusssichere Weste. Die Logik ist simpel: Wenn ein Modell sich weigert, bösartigen Code zu schreiben, haben Hacker eine Waffe weniger in ihrem Arsenal. Hinter dem Unternehmensmarketing und der staatlichen Aufsicht machen diese Sicherheitsmaßnahmen derzeit genau jene Leute blind, die unsere Geräte vor Angriffen aus der realen Welt schützen. Durch den Versuch, die Türen vor Kriminellen zu verriegeln, sperren KI-Labore versehentlich die Schlüsseldienste aus.
Technologen und Sicherheitsforscher schlagen Alarm wegen eines Trends, der die Optik über die tatsächliche Sicherheit stellt. Während Unternehmen wie Anthropic und OpenAI ihre Modelle als leistungsstarke Motoren der Innovation vermarkten, haben sie diese auch in Schichten aus restriktivem Code gehüllt, der "Missbrauch" verhindern soll. Für den Durchschnittsnutzer bedeutet dies, dass die Software, auf die Sie sich verlassen – von Ihrer Banking-App bis zum Betriebssystem Ihres Smartphones – immer schwerer zu verteidigen ist.
Das grundlegende Problem mit KI-Schutzplanken ist, dass Cybersicherheit keine Einbahnstraße ist. Um ein Loch in einer Wand zu reparieren, muss ein Maurer zuerst genau verstehen, wie diese Wand durchbrochen werden kann. In der digitalen Welt nennt man dies offensive Forschung. Seriöse Sicherheitsexperten verbringen ihre Tage damit, wie Hacker zu agieren, um Schwachstellen zu finden, bevor es die echten Kriminellen tun.
Chris Anley, leitender Wissenschaftler beim Sicherheitsberatungsriesen NCC Group, verwendet hierfür eine einfache Analogie. Ein Hammer ist ein Werkzeug, das man braucht, um ein Haus zu bauen, aber er ist auch eine Waffe. Ohne einen solchen kann man keine Struktur errichten. Wenn man Hämmer verbietet, um Gewalt zu verhindern, stellt man auch sicher, dass keine Häuser gebaut werden. Wenn ein Forscher eine KI bittet, einen Fehler auszunutzen, versucht er zu beweisen, dass eine Schwachstelle real ist, damit ein Hersteller sie beheben kann. Wenn die KI die Antwort verweigert, weil die Anfrage "bösartig" aussieht, bleibt der Verteidiger ohne sein effizientestes Werkzeug zurück.
Dies schafft ein Paradoxon, in dem derselbe Mechanismus, der einen Hacker behindern soll, auch einen Verteidiger stoppt. Beide Rollen verwenden exakt dieselben Techniken. Durch die Einschränkung des Zugangs zu diesen Fähigkeiten machen KI-Unternehmen die Arbeit von Netzwerkverteidigern erheblich schwerer. Dies führt dazu, dass Softwarefehler länger offen bleiben, was echten Kriminellen mehr Zeit gibt, sie zu finden und zu nutzen.
Für viele Forscher ist die Nutzung eines modernen KI-Modells wie die Arbeit mit einem unermüdlichen Praktikanten, der zudem unglaublich paranoid ist. Sie bitten den Praktikanten vielleicht, einen Codeabschnitt auf Fehler zu analysieren. Der Praktikant sieht das Wort "Exploit" oder "Schwachstelle" und stellt sofort die Arbeit ein, um Ihnen stattdessen einen Vortrag über Ethik zu halten, anstatt die angeforderten Daten zu liefern.
Chris Thompson, Geschäftsführer von RemoteThreat, stellt fest, dass Forscher mittlerweile einen massiven Teil ihres Tages damit verbringen, mit dem Modell zu verhandeln. Anstatt sich auf das eigentliche Sicherheitsproblem zu konzentrieren, versuchen sie herauszufinden, warum ein Modell gestern eine hilfreiche Antwort gab, heute aber das Sprechen verweigert. Diese Über-Sanitisierung der KI-Ausgabe führt zu inkonsistenten Ergebnissen.
In einigen Fällen sind die Schutzplanken so empfindlich, dass sie schon bei der bloßen Erwähnung sicherheitsrelevanter Themen auslösen. Ein Forscher, der für einen großen Smartphone-Komponentenhersteller arbeitet, berichtete, dass seine KI-Tools fast nutzlos sind, weil die Schutzplanken zu streng sind. Sobald das Modell Wind von einer sicherheitsrelevanten Aktivität bekommt, schaltet es einfach ab. Dies schafft eine Produktivitätssteuer für genau die Menschen, die eigentlich die globale Lieferkette schützen sollen.
KI-Labore sind nicht blind für dieses Problem, aber ihre Lösung ist eine Schicht Bürokratie. Anthropic hat sein Cyber Verification Program, und OpenAI bietet Trusted Access for Cyber an. Dies sind geprüfte Programme, bei denen Forscher einen speziellen Zugang zu Modellen mit weniger Einschränkungen beantragen können.
Diese Programme sind jedoch oft undurchsichtig und exklusiv. Der Zugang ist häufig auf bestimmte westliche Organisationen oder solche beschränkt, die strenge Unternehmenskriterien erfüllen. Selbst wenn ein Forscher zugelassen wird, können sich die Grenzen ohne Vorankündigung verschieben. Dieses Gatekeeping zeigt sich besonders deutlich im Fall von Anthropics Mythos-Modell. Das Unternehmen hat Mythos als High-End-Tool vermarktet, das so leistungsstark ist, dass es eine staatliche Aufsicht erfordert.
Im Juni wandte die US-Regierung kurzzeitig Exportkontrollen auf Mythos und ein weiteres Modell namens Fable an. Dieser Schritt folgte auf Berichte, wonach die Schutzplanken der Modelle umgangen werden könnten, um Cyberangriffe auszuführen. Während die Kontrollen später für geprüfte US-Organisationen gelockert wurden, verdeutlichte der Vorfall einen wachsenden Trend, KI als kontrollierte Waffe statt als Allzweckwerkzeug zu behandeln. Diese Art von Gatekeeping stoppt keine Hacker, die ihre eigene Hardware verwenden, schafft aber eine massive Hürde für legitime Unternehmen, die versuchen, der Entwicklung voraus zu sein.
Wenn legitime Forscher von US-basierten KI-Unternehmen blockiert werden, hören sie nicht einfach auf zu arbeiten. Stattdessen suchen sie nach Werkzeugen, die diese restriktiven Filter nicht haben. Dies bedeutet oft eine Abkehr von polierten Cloud-Modellen hin zu Open-Source-Alternativen, die auf privater Hardware laufen können.
Paolo Stagno, Chief Technology Officer bei Crowdfense, erklärt, dass sein Team Cloud-basierte Modelle für sensible Arbeiten vermeidet. Das Einspeisen eines geheimen Softwarefehlers in eine Cloud-KI birgt das Risiko, dass diese Daten geleakt oder in einen zukünftigen Trainingslauf absorbiert werden. Um die Privatsphäre zu wahren und das "Babysitting" durch Unternehmens-Schutzplanken zu vermeiden, nutzen viele Experten nun Open-Source-Modelle, die sie lokal und ohne Aufsicht betreiben können.
Hier besteht ein strategisches Risiko. Wenn US-Forscher feststellen, dass einheimische Modelle zu restriktiv sind, um nützlich zu sein, könnten sie sich leistungsstarken Open-Source-Modellen zuwenden, die in anderen Ländern entwickelt wurden. Chris Thompson weist darauf hin, dass Forscher bereits in Richtung chinesischer Modelle wie GLM gedrängt werden. Diese Modelle sind frei herunterladbar und unterliegen keinen Nutzungsbeschränkungen. Diese Verschiebung bewegt das Zentrum der Innovation weg von der US-Governance und in Umgebungen, in denen westliche Sicherheitsstandards überhaupt nicht gelten.
Datenschutz ist ein grundlegendes Anliegen für jeden, der in der hochriskanten Cybersicherheit arbeitet. Wenn ein Forscher einen "Zero-Day" findet – einen Fehler, den der Softwarehersteller noch nicht kennt –, ist diese Information auf dem freien Markt Millionen von Dollar wert. Sie ist zudem eine kritische Information für Regierungen.
Diese Informationen an einen Server von OpenAI oder Anthropic zu senden, ist ein massives Risiko. Selbst mit speziellen Zugangsprogrammen gibt es keine Garantie, dass die Daten nicht zum Training der nächsten KI-Version verwendet werden. Einige Forscher, wie Giuseppe Cali, nutzen KI nur für die langweiligen Teile des Jobs, wie das Übersetzen von komplexem Code in ein lesbares Format. Sie weigern sich, sie für die eigentliche Entdeckung von Fehlern zu verwenden, weil sie ihre Arbeit privat halten wollen.
Diese Vorsicht bedeutet, dass die fortschrittlichsten KI-Modelle derzeit eher für Aufgaben auf niedriger Ebene als für die hochgradige Logik eingesetzt werden, die die globale Sicherheit tatsächlich verbessern könnte. Die Schutzplanken und die Cloud-basierte Natur dieser Tools schaffen eine Obergrenze dafür, wie sehr sie den Menschen, die unsere Netzwerke schützen, tatsächlich helfen können.
Das Fazit für den Durchschnittsverbraucher ist, dass unsere digitalen Abwehrmechanismen nicht mit der Geschwindigkeit von KI-gestützten Angriffen Schritt halten. Kriminelle halten sich nicht an die Regeln und nutzen keine geprüften Programme. Sie verwenden unzensierte Open-Source-Modelle oder ihre eigene, speziell entwickelte KI, um den Prozess des Findens und Treffens von Zielen zu automatisieren.
Währenddessen stecken die "Guten" in einem Kreislauf aus dem Beantragen von Berechtigungen und dem Diskutieren mit Chatbots fest. Praktisch gesehen bedeutet dies, dass die Software auf Ihrem Telefon und Laptop Schwachstellen aufweisen kann, die länger ungepatcht bleiben. Es bedeutet auch, dass die Kosten für Cybersicherheit steigen, da Firmen mehr Zeit für manuelle Arbeit aufwenden müssen, die eine KI theoretisch in Sekunden erledigen könnte.
Um die digitale Welt sicher zu halten, müssen KI-Labore von der Vorstellung abrücken, jeden Nutzer bevormunden zu können. Anstatt Mauern zu bauen, die jeden blockieren, müssen sie den Menschen, die tatsächlich an vorderster Front stehen, einen verantwortungsvollen Hochgeschwindigkeitszugang ermöglichen. Ohne diesen Wandel verlangen wir von unseren Sicherheitsforschern im Grunde, ein Hochgeschwindigkeitsrennen zu gewinnen, während wir diejenigen sind, die ihnen die Schnürsenkel zusammenbinden.
Quellen:



Unsere Ende-zu-Ende-verschlüsselte E-Mail- und Cloud-Speicherlösung bietet die leistungsfähigsten Mittel für den sicheren Datenaustausch und gewährleistet die Sicherheit und den Schutz Ihrer Daten.
/ Kostenloses Konto erstellen