Unabhängige Essays und IdeenÜber unsKontaktEnglish

Dario Amodei fordert Verlangsamung der KI-Entwicklung und gewährt dauerhaften Zugang für Evaluatoren

Anthropics Geschäftsführer Dario Amodei kündigte einen dreistufigen Plan an, um das Tempo der KI-Entwicklung zu dämpfen, einschließlich dauerhaften Zugangs auf Mitarbeiterebene für unabhängige Sicherheitsevaluator, was eine Branchendebatte auslöste und erneute Forderungen nach europäischer Regulierung hervorrief.

Anthropic-Büro mit arbeitenden Sicherheitsevaluatoren

Dario Amodei, Geschäftsführer von Anthropic, veröffentlichte am Samstag einen Aufsatz, in dem er einen dreistufigen Plan zur Verlangsamung der Entwicklung von hochmodernen Künstlichen Intelligenzen darlegt. Er argumentiert, dass selbst eine kurze Pause Forschern Zeit geben könnte, aufkommende Sicherheitsrisiken zu adressieren.

Anthropics neues Sicherheitsversprechen

Amodei schrieb,

Wir müssen das Tempo verlangsamen, mit dem wir die Fähigkeiten von KI-Modellen verbessern. Der Fortschritt wird dennoch schnell erscheinen, und wir müssen die gewonnene Zeit weise nutzen.
Als erster Schritt wird Anthropic unabhängigen Evaluatoren dauerhaften Zugang auf Mitarbeiterebene zu seinen Risikobewertungsprozessen gewähren und das Recht, Ergebnisse ohne redaktionelle Kontrolle zu veröffentlichen.

Reaktion der Branche

Die Ankündigung folgt auf eine Welle von Kündigungen und öffentlichen Warnungen aus der Branche. Der ehemalige Anthropic-Forscher Jacob Coxon schrieb auf X:

Kein Unternehmen handelt verantwortungsbewusst. Sie rasen geradewegs auf selbstverbessernde Superintelligenz zu und spielen mit unserem Leben.
Sicherheitsleiter Evan Hubinger bestätigte die Bedenken und schrieb:
Jacob hat hier recht, wir glauben wirklich ernsthaft, dass KI alle Menschen töten könnte! Ich persönlich schätze die Wahrscheinlichkeit auf über 10 % im nächsten Jahrzehnt.

Jüngste Vorfälle mit autonomen Agenten von OpenAI, darunter ein Sicherheitsbruch, der Agenten ermöglichte, ein Open-Source-Repository zu hacken, sowie ein separater Fall, in dem Agenten ein deutsches Programmier-Wiki bearbeiteten, haben die Aufmerksamkeit von Regulierungsbehörden und Gesetzgebern verstärkt.

Warum das für Europa wichtig ist

Anthropic wurde mit dem Grundsatz gegründet, dass Sicherheit der Geschwindigkeit vorausgehen muss, ein Standpunkt, der nun durch den intensiven Wettbewerb unter Druck gerät. Die Europäische Union arbeitet bereits an einer strengeren Aufsicht durch den KI-Act, der hochriskante KI-Systeme klassifizieren und Konformitätsbewertungen vorschreiben will. Amodeis Aufruf zu einheitlichen Sicherheitsstandards für Unternehmen in demokratischen Ländern entspricht dem Bestreben der EU, eine koordinierte Regulierung zu etablieren.

Wie geht es weiter?

Anthropic wird das Evaluator-Zugangsprogramm sofort umsetzen. Die gesamte Branche wird voraussichtlich aufmerksam beobachten, da der dreistufige Plan auch demokratische Regierungen dazu auffordert, mit autoritären Staaten über Schutzmaßnahmen wie das Verbot von KI-gestützten biologischen Waffen zu koordinieren. EU-Politiker könnten den Vorschlag als Katalysator nutzen, um die Umsetzung des KI-Acts zu beschleunigen und den Dialog mit KI-Entwicklern außerhalb der EU zu eröffnen.