Genau heute hat das ausländische Medienunternehmen The Information eine Insider-Geschichte aufgedeckt –
OpenAIs internes KI-Modell hat bereits begonnen, sich selbst zu „trainieren“!
Konkret hat dieses interne Modell den gesamten Trainingsprozess experimenteller KI-Modelle übernommen und begonnen, sich selbst von Hand zu optimieren.
Forscher müssen nur ein Optimierungsbeispiel bereitstellen, und die KI kann wochenlang selbstständig laufen, wobei mehrere Agenten spontan zusammenarbeiten, miteinander diskutieren und Code iterieren, völlig ohne menschliches Eingreifen.
Noch erstaunlicher: Große Experimente, die ursprünglich Jahre dauerten, werden jetzt auf nur eine Woche komprimiert!
Als diese schockierende Enthüllung veröffentlicht wurde, startete OpenAI dringend eine globale Sicherheitsinitiative, die direkt auf den empfindlichsten Punkt der globalen KI-Community zielt – RSI.
Sie rufen laut: Bevor die KI außer Kontrolle gerät, muss die ganze Welt zusammenkommen, um ihr ein „Spannband“ anzulegen!
Wenn KI lernt, GPU-Kernel von Hand zu optimieren
Bisher war das Training eines großen Modells in führenden KI-Labors sehr umständlich.
Unter anderem war die teuerste und komplexeste Aufgabe das Schreiben von GPU-Kerneln für die zugrunde liegenden Grafikprozessoren und die zeilenweise Optimierung des laufenden Codes.
Dies erforderte die weltweit besten erfahrenen Algorithmus-Ingenieure mit Jahresgehältern von Millionen Dollar, die es durch schlaflose Nächte „von Hand“ erledigten.
Doch laut der neuesten Enthüllung von The Information werden nun innerhalb von OpenAI die meisten dieser Kernaufgaben von KI übernommen.
Jetzt können OpenAIs interne Modelle in großem Umfang selbst die Programme schreiben, die zum Ausführen oder Trainieren von Modellen auf GPU-Kerneln benötigt werden, sowie Optimierungspläne für diese Programme.
Ingenieure müssen dem Modell nur ein Beispiel für die Art der Optimierung geben, die sie erreichen möchten, und die KI kann wochenlang weiterlaufen, um diese Optimierungen umzusetzen.
Dank Verbesserungen der Modelle wurde diese Art der KI-gesteuerten Automatisierung erst in den letzten Monaten möglich.
Darüber hinaus werden die Agenten der Mitarbeiter miteinander zusammenarbeiten, um Probleme zu lösen, ohne Menschen benachrichtigen zu müssen.
Dies ist der Prototyp von RSI.
OpenAI schlägt dringend Alarm: RSI ist wirklich da, verlieren Menschen die Kontrolle?
Stellen Sie sich vor, Sie bauen einen Roboter mit einem IQ von 100, dessen Aufgabe es ist, „einen Roboter zu bauen, der intelligenter ist als er selbst“.
Also baut er eine zweite Generation mit einem IQ von 120; sobald die zweite Generation ihre Augen öffnet, baut sie mit ihrem IQ von 120 eine dritte Generation mit einem IQ von 150; die dritte Generation baut dann eine vierte Generation mit einem IQ von 200 ...
Sobald sie einen bestimmten kritischen Punkt überschreitet, wird die Geschwindigkeit der KI-Evolution eine vertikal nach oben gerichtete Kurve zeigen und die Menschheit sofort um Zehntausende von Lichtjahren hinter sich lassen.
Früher dachten alle, das sei noch weit entfernt, aber jetzt hat OpenAI selbst Angst.
Genau heute hat OpenAI offiziell dringend eine gewichtige globale Sicherheitsinitiative veröffentlicht.
Sie haben selten „RSI“ als separaten Abschnitt aufgeführt und ausdrücklich geschrieben, dass „vollständig autonomes RSI heute noch nicht geschehen ist und nicht vorangetrieben werden sollte, bevor es sicher durchgeführt werden kann“, und forderten die nationalen Netzwerke der KI-Sicherheitsinstitute auf, einen globalen technischen Standard zu formulieren.
In dem Bericht warnte OpenAI unverblümt:
„Da KI-Systeme immer mehr Aufgaben bei der Entwicklung der nächsten Generation von KI übernehmen, können sie zunehmend den Prozess der RSI vorantreiben. Da dieser Prozess immer automatisierter wird, könnte sich das Tempo des KI-Fortschritts dramatisch beschleunigen.“
Obwohl eine vollständig autonome RSI heute noch nicht erreicht ist, ist die Zeit bereits sehr knapp.
In dem Vorschlag scheute OpenAI nicht davor zurück, die derzeitige Hauptaufgabe zu benennen: „Die nächste Phase des KI-Fortschritts steuern, automatisierte KI-Forscher aufbauen und Wege finden, Menschen im Selbstverbesserungszyklus zu halten.“
Beachten Sie die zweite Hälfte des Satzes – „Menschen im Zyklus halten“. Das ist ihre größte Sorge: Menschen könnten bald hinausgeworfen werden!
In dem Bericht erwähnte OpenAI stolz, dass KI-gesteuerte Forschung bereits große Fortschritte in der Mathematik vorangetrieben hat, wie die Bewältigung des NS-Millennium-Problems.
Doch die andere Seite der Medaille ist ein bodenloser Abgrund.
Der Bericht schreibt: „Da dieser Prozess immer automatisierter wird, könnte sich das Tempo des KI-Fortschritts schnell beschleunigen... Ohne angemessene Vorsicht könnte RSI dazu führen, dass Menschen die tatsächliche Kontrolle über die KI-Entwicklung verlieren und nicht in der Lage sind, Forschungsprozesse zu überwachen, die sie nicht mehr verstehen.“
Dies ist der sogenannte „Blackbox-Effekt“. Wenn der Code von KI von KI geschrieben wird, wenn die Logik von KI die des Menschen übersteigt, können Menschen nicht mehr verstehen, was KI tun wird.
Zum Beispiel ist der Code, den Astra jetzt schreibt, für Menschen bereits unverständlich.
Als Nächstes nannte OpenAI den Hugging-Face-Vorfall.
Obwohl sie klarstellten, dass der Vorfall keine direkte Folge von RSI war, war er absolut eine schmerzhafte Vorschau – er zeigte der Welt, welche schwere Katastrophe eine außer Kontrolle geratene KI ohne starke Schutzmaßnahmen und Ausrichtungsmechanismen mit sich bringen würde.
Altman fordert: Wir brauchen ein einheitliches „Spannband“
Wenn es so gefährlich ist, warum zieht OpenAI nicht einfach den Stecker? Weil, sobald die Büchse der Pandora geöffnet ist, sie nie wieder geschlossen werden kann.
Der enorme Nutzen, den die KI-Entwicklung mit sich bringt, macht es für kein Land und kein Unternehmen möglich, aufzuhören.
Daher legte OpenAI einen „Globalen KI-Sicherheitskoordinationsvorschlag“ vor. Was sie fordern, ist nicht, Forschung und Entwicklung zu stoppen, sondern „globale Standards für die nächste Stufe der KI aufzustellen“.
Kernpunkt Eins: Aufbau eines komplementären Netzwerks nationaler und internationaler Frontier-Standards
OpenAI schlägt vor, dass Länder nicht jeweils eigene Wege gehen können, da dies nur zu fragmentierten Standards führen würde.
Sie schlagen vor, bestehende Institutionen wie das „Center for AI Standards and Innovation“ (CAISI) sowie das Netzwerk von KI-Sicherheitsinstituten, das bereits von Australien, Kanada, dem Vereinigten Königreich, Frankreich, Japan und anderen Ländern eingerichtet wurde, zu nutzen, um eine Reihe global anwendbarer technischer Standards zu formulieren.
Diese Standards sollen nicht Open-Source-Modelle oder Start-ups einschränken, sondern richten sich speziell an „Frontier-KI-Modelle“.
Was die Standards klären müssen, ist: Wie bewertet man die RSI-Fähigkeit einer KI? Wie groß ist das Risiko, wenn ein KI-Modell autonom Forschung und Entwicklung betreibt?
Kurz gesagt, OpenAI hofft, die Sicherheitsbewertung in eine quantifizierbare „Wissenschaft“ zu verwandeln.
Kernpunkt zwei: Universelle Mess- und Vorfallmeldeprotokolle (jederzeit bereit, den Stecker zu ziehen)
OpenAI schlägt außerdem vor, dass es klare rote Linien geben muss.
Sie fordern die Einführung der folgenden Standards:
1. Bewerten, wie viel der F&E-Arbeit innerhalb eines Unternehmens tatsächlich automatisch von KI erledigt wird.
2. Verpflichtende Auslösemechanismen für menschliche Aufsicht. Klar angeben, bei welchen Arten automatisierter F&E-Prozesse eine „sofortige menschliche Überprüfung“ zwingend ausgelöst werden muss. KI darf niemals blind in einer Blackbox vorpreschen.
3. Vorfallklassifizierung und Meldeschwellen. Einen Vorfallmeldemechanismus ähnlich denen in der Luftfahrt- oder Nuklearindustrie einrichten. Wenn KI Anzeichen von „Fehlausrichtung“ zeigt, muss es einheitliche Schweregrad-Einstufungen und Meldestandards geben.
Schließlich wird der Dolch enthüllt, und OpenAI schlägt vor: „Die Vereinigten Staaten sollten diesen Prozess anführen.“
Der von OpenAI angegebene Grund ist: Die US-amerikanische KI-Industrie befindet sich derzeit an der technologischen Frontier und besetzt globale Netzwerkknotenpunkte in verschiedenen Schlüsselbereichen.
Sie glauben, dass die Kontrolle des Tempos der Frontier-KI-Entwicklung nicht darin besteht, künstlich ein „Tempolimit-Schild“ aufzustellen, sondern darin, sicherzustellen, dass „das Tempo der Sicherheitsausrichtungsforschung den KI-Fähigkeitsverbesserungen voraus sein muss“.
OpenAI ist der Ansicht, dass die Einrichtung sicherer Kommunikationskanäle zwischen Betreibern kritischer Infrastrukturen und Regierungen weltweit sowie der Austausch von Bedrohungen und Schwachstellen der nationalen Sicherheit ein entscheidender Schritt sind.
Selten im Leben! OpenAI und Anthropic reichen sich die Hand und beginnen gegenseitige Inspektion
Gleichzeitig enthüllte The Information auch: OpenAI und Anthropic finalisieren eine historische Vereinbarung – die beiden Seiten werden die kommerziellen Modelle des jeweils anderen testen!
Sie sollten wissen, dass das Gründungsteam von Anthropic damals wütend ging und ein eigenes Unternehmen gründete, gerade weil sie mit Altman über das Konzept der „KI-Sicherheit“ uneinig waren.
Doch dieses Mal haben die beiden Giganten selten zusammengefunden.
Laut The Information umfasst die ausgehandelte Vereinbarung gegenseitige Tests der Modelle des jeweils anderen und strenge Datensicherungsmaßnahmen. Dies ist kein PR-Gag, sondern vielmehr haben die beiden Giganten angesichts unbekannter Risiken keine andere Wahl, als sich zusammenzuschließen.
Warum tun sie das?
Weil, wenn KI-Fähigkeiten sich dem Rand von RSI nähern, jedes Unternehmen, das die Sicherheit seines eigenen Modells allein bewertet, wie ein Athlet ist, der sich selbst auf Doping testet – nicht nur unglaubwürdig, sondern möglicherweise auch fatale verborgene Gefahren aufgrund technischer blinde Flecken übersieht.
Ebenbürtige Wettbewerber für „gegenseitige Blindtests“ hinzuzuziehen, ist wie eine gegenseitige Inspektionsvereinbarung.
KI-Sicherheitspraktiken haben sich nun auf eine Gemeinschaft mit gemeinsamer Zukunft zubewegt.
Wenn diese Vereinbarung letztendlich umgesetzt wird, wird sie die Sicherheitsstandards des gesamten KI-Ökosystems vollständig neu gestalten.
Zu diesem Zeitpunkt wird "Sicherheit und Alignment" kein bloßes Schlagwort mehr sein.
Wenn RSI bereits naht, hat die Geschwindigkeit der KI-Selbstverbesserung die Menschheit längst weit hinter sich gelassen.
Können die Giganten es wirklich über sich bringen, auf die Bremse zu treten?
Referenzen:
https://x.com/theinformation/status/2102095568335970690
https://www.theinformation.com/articles/openai-anthropic-neared-deal-stress-test-others-ai
Dieser Artikel stammt vom WeChat-öffentlichen Account "Xin Zhi Yuan", Autor: ASI Revelation; Redakteure: Aeneas David














