Zurück zu Nachrichten

OpenAI wird nach dem Anthropic Security Call für integrierte unabhängige Bewertungskräfte angeschlossen

Sam Altman verpflichtet sich OpenAI, externen Bewertern Zugang zu den Mitarbeitern zu geben, indem er eine Branchenwarnung über schnell bewegende Grenzensysteme in eine konkrete Governance-Vorschlag verwandelt.

Maschinell übersetzt · Englisches Original · Original anzeigen

Eine Rivale hat das Bewertungsvorschlag angenommen

OpenAI hat sich verpflichtet, den unabhängigen Bewertern Zugang zu ihren Systemen wie den Mitarbeitern zu ermöglichen, indem sie sich an einem Sicherheitsvorschlag beteiligt, das von Anthropic Chief Executive Dario Amodei gefördert wurde. Die Bewegung ist eine neue Unternehmensaktion nach Amodei's breiterer Aufforderung, den unkontrollierten Fortschritt der grenzüberschreitenden künstlichen Intelligenz zu verlangsamen. Anthropic sagt separat, dass es den Dritten-Evaluatoren einen dauerhaften Zugang auf Personal-Ebene gewährt. Sky News berichtet über die Verpflichtungen am 13. September.

Der Unterschied zwischen Verpflichtung und Verpflichtung ist wichtig. Sam Altman sagte, OpenAI würde das Vorschlag für den Bewertungszugang annehmen und später weitere Details geben. Elon Musk unterstützte die allgemeine Warnung und schlug eine Peer-Review zwischen den Wettbewerbern vor, aber Sky berichtete, dass er aufhört, ohne Anthropic-Verpflichtung zu entsprechen. Eine gemeinsame Zeitplatte, ein Bewertungsverfahren oder ein Durchsetzungsmechanismus sind noch nicht bekannt gegeben.

Was eingebettete Zugriff ändern könnte

Externe Bewertungen testen in der Regel ein Modell an einem bestimmten Punkt, oft durch eingeschränkte Schnittstellen. Der Zugriff wie der Mitarbeiter könnte Fachleute ermöglichen, Systeme kontinuierlicher zu beobachten, Vorschauversionen zu untersuchen und Sicherheitsanforderungen mit internen Praktiken zu vergleichen. In Grundsatz kann dies die Erkennung von Vorfällen verbessern und freiwillige Verpflichtungen auditierbar machen. Der Wert wird davon abhängen, ob die Bewertungskräfte negative Ergebnisse veröffentlichen, relevante technische Informationen erhalten und ohne kommerzielle Druck von den von ihnen bewerteten Unternehmen tätig werden können.

Offizielle britische Forschung unterstützt die Notwendigkeit einer strengen Testung und warnt gegen dramatische Extraktion. Das von der Regierung unterstützte AI Security Institute fand eine schnelle Verbesserung in mehreren kontrollierten Kapazitätsprüfungen und Schwachstellen in jedem System, das er untersucht hat. Es betonte auch, dass die Laborergebnisse keine Vorhersagen von echten Schaden sind. Diese Kombination – mäßbarer Kapazitätswachstum, dauerhafte Sicherheitsfälle und wesentliche Unsicherheit – hilft, die Nachfrage nach kontinuierlicher Zugang anstatt einer ein-off-Zertifizierung zu erklären.

Freiwilligen Koordination hat Grenzen

Amodei's Vorschlag erstreckt sich über die eingebauten Bewertungskräfte hinaus. Es fordert gemeinsame Standards unter Unternehmen in demokratischen Ländern und eine mögliche Koordination mit Regierungen einschließlich China. Dies sind diplomatische und regulatorische Ambitionen, nicht abgeschlossenen Vereinbarungen. Selbst die engere Unternehmensverpflichtung hinterlässt ungelöste Fragen darüber, wer sich als unabhängig qualifiziert, wie empfindliche Ergebnisse behandelt werden und ob Zugang Streitigkeiten über Produktlansationen überlebt.

Die nächste bedeutende Entwicklung wird die Umsetzung sein. OpenAI und Anthropic sollten Bewertungsstellen identifizieren, ihre Autorität definieren, Berichterstattungsverfahren offenlegen und erklären, wie Entdeckungen die Verlängerung oder die Veränderung der Ausführung verhindern können. Die Regulierungsbehörden werden auch entscheiden, ob freiwilligem Zugang ausreichend ist oder eine gesetzliche Anforderung werden sollte. Bis diese Details erscheinen, sind die Verpflichtungen ein Governance-Experiment und nicht ein Beweis dafür, dass die Wettbewerbsrennen zwischen Grenzlaboratorien verlangsamt ist.