Anthropic schlägt eingebettete Prüfer vor: Kunden müssen wissen, was ungeprüft bleibt
Kurzfassung
Dario Amodei schlägt drei Maßnahmen zur KI-Sicherheit vor. Ob externe Prüfungen Kunden bei der Anbieterwahl helfen, hängt von Zugangs- und Veröffentlichungsrechten ab.
Am 2026-09-12 schlug Anthropic-Chef Dario Amodei vor, externe Prüfer unmittelbar in KI-Unternehmen einzubinden. Ob diese eigenständig Erkenntnisse veröffentlichen dürfen, die ein Unternehmen lieber zurückhalten würde, muss sich in der Umsetzung noch zeigen. Sehen Unternehmenskunden am Ende nur vom Anbieter ausgewählte Schlussfolgerungen, reichen zusätzliche Prüfer nicht aus, um Risiken einer Einführung besser zu erkennen.
Reuters bestätigt Amodeis Aufruf, die Entwicklung von Spitzenmodellen zu verlangsamen. Sein Essay schlägt 3 Maßnahmen vor: eingebettete unabhängige Prüfungen, Sicherheitsabstimmung zwischen Unternehmen in Demokratien und globale Koordination. Anthropic werde mit eingebetteten Prüfungen beginnen, ohne auf sämtliche Wettbewerber zu warten. Das ist eine Zusage des Unternehmens; Ergebnisse aus dem praktischen Betrieb dieser Regelung liefern die Quellen noch nicht.
Reuters verweist außerdem auf Anthropics Bedrohungsbericht, der Claudes Nutzung unter anderem für die Waffenentwicklung beschreibt. Externe Prüfungen können diese Vorgänge nicht ungeschehen machen. Ihr Zweck ist es, die vom Anbieter behaupteten Schutzmaßnahmen leichter überprüfbar zu machen.
Ich würde eingebettete Prüfungen als Möglichkeit betrachten, die Informationsgrundlage für Beschaffungsentscheidungen zu verbessern. Anbieter kennen die Grenzen ihrer Modelle, während Käufer möglicherweise keinen Zugang zu denselben Informationen haben. Externe Prüfer könnten diese Lücke verkleinern, wenn sie Modelle in der Entwicklung und die zugehörige Forschung untersuchen dürfen. Käufer müssten trotzdem wissen, welche Modellversion und welche Einsatzbedingungen eine Prüfung abdeckt, bevor sie deren Übertragbarkeit auf den vorgesehenen Dienst beurteilen.
Der Veröffentlichungsumfang bestimmt den Nutzen für die Beschaffung
Der Essay sieht tieferen Zugang und Veröffentlichungen ohne redaktionelle Kontrolle durch Anthropic vor. Vertraulichkeitsausnahmen dürfen nicht allein wegen ungünstiger Ergebnisse greifen; Prüfer können zudem auf Kürzungen hinweisen, die Schlussfolgerungen beeinflussen. Diese Gestaltung unterstützt öffentliche Transparenz. Käufer müssen dennoch die Anwendbarkeit der Tests klären.
Angenommen, ein Bericht prüft gewöhnliche Gespräche, während ein Kunde Agenten Code ausführen und interne Daten nutzen lassen will. Die bisherigen Tests decken diese zusätzlichen Berechtigungen möglicherweise nicht ab. Dieses hypothetische Einsatzszenario zeigt, dass ein Sicherheitsbericht Belege liefern kann, ohne jede Einsatzkonfiguration abzusichern.
Ich würde deshalb öffentliche Berichte bevorzugen, die benennen, was nicht geprüft oder offengelegt werden konnte. Vertrauliche Inhalte müssen nicht vollständig veröffentlicht werden. Leser sollten aber unterscheiden können, ob ein Risiko untersucht wurde, ungeprüft blieb oder Ergebnisse vorliegen, die nicht veröffentlicht werden dürfen. Werden diese unterschiedlichen Zustände zu einem kurzen Sicherheitsurteil zusammengefasst, können Käufer kaum erkennen, welche Prüfungen sie selbst noch übernehmen müssen.
Auch Anbieter müssen Aufwand betreiben, um Außenstehende mit ihren Systemen vertraut zu machen und sensible Informationen zu handhaben. Können mehrere Kunden dieselbe Bewertung wiederverwenden, könnte dieser Aufwand doppelte Prüfungen vermeiden. Beschreibt ein Bericht dagegen nur Grundsätze, müssen Unternehmen die Validierung weiterhin einzeln wiederholen. Die Quellen enthalten keinen Vergleich von Kosten oder eingesparter Arbeitszeit. Ein wirtschaftlicher Ertrag lässt sich deshalb noch nicht berechnen.
Amodeis Wunsch nach gemeinsamem Handeln verdeutlicht zudem den Unterschied zwischen der Öffnung eines einzelnen Unternehmens für Prüfungen und der Festlegung des Entwicklungstempos einer Branche. Ein Anbieter kann Ersteres allein tun, Letzteres nicht. Für Käufer kann ein externer Bericht zur Anbieterwahl beitragen, ohne bereits einen branchenweiten Risikorückgang zu belegen. Werden Einschränkungen klar ausgewiesen, muss ein Unternehmen mit mehr gemeldeten Problemen nicht unsicherer sein; möglicherweise wurde es lediglich umfassender geprüft.
Sobald erste Ergebnisse eingebetteter Prüfungen veröffentlicht sind, können Käufer kontrollieren, ob Modellversionen, Testumfang und nicht offenlegbare Bereiche benannt werden. Danach lässt sich entscheiden, welche Ergebnisse für die Beschaffung nutzbar sind. Eine Liste von Prüfern belegt deren Beteiligung. Ob die Unsicherheit für Käufer sinkt, hängt weiterhin davon ab, was diese Personen letztlich untersuchen und sagen dürfen.
Quellen:
Verwandte Artikel
Gericht bestätigt Anthropic-Ausschluss: Sicherheitsgrenzen müssen berechenbar sein
Ein US-Berufungsgericht bestätigt mit 2-1 Stimmen den Ausschluss von Claude aus der Verteidigungslieferkette. Das Urteil betrifft Beschaffungsbefugnisse, nicht den Zuverlässigkeitsgewinn durch weniger Schutzvorkehrungen. Gewollte Ablehnung und irrtümliche Blockade bleiben zu unterscheiden.
Claude erreichte bei Cybertests drei Unternehmen, nachdem die Isolation versagte
Anthropic prüfte 141.006 Cybersicherheitstests und stellte fest, dass drei Claude-Modelle über eine nicht isolierte Testumgebung reale Systeme von drei Organisationen erreichten.