Ko-Entwicklung von Verifizierungen für das Pacing der Grenze
Beschreibung
HintergrundGrenzen AI-Labore müssen möglicherweise schließlich die Entwicklung oder Bereitstellung an einem kritischen Fähigkeitsgrenzwert einschränken oder steuern. Das sicher zu tun und anderen Laboren oder Regierungen das Vertrauen zu geben, dass Verpflichtungen tatsächlich eingehalten werden, hängt von Verifizierungsmechanismen ab, die existieren, bevor sie dringend benötigt werden.Ohne sie könnten Labore und Entscheidungsträger mit Entscheidungen von hoher Einsatzzahl konfrontiert werden, bei denen es sehr wenig Spielraum gibt. Das erhöht das Risiko, die Kontrolle über fortschrittliche Systeme zu verlieren oder die Fähigkeit zu verlieren, Entscheidungen über sie zu gestalten (zum Beispiel durch grobe staatliche Eingriffe).„Die Grenze zu steuern“ definiert das Problem, aber nicht die Lösungen. Die Erklärung fordert die Regierung auf, Optionen zu ermöglichen. Wir denken vorläufig, dass dies umgekehrt ist: Grenzlabore haben eher als Regierungen das Fachwissen und die Ressourcen, um Verifizierungswerkzeuge zu entwickeln, bevor sie benötigt werden.Unterdessen arbeitet die Verifizierungsgemeinschaft an technischen Designs, Experimenten und Prototypen. Was fehlt, ist Input von Personen in Grenzlaboren, ob etwas davon tatsächlich in einer Grenzumgebung funktionieren könnte. Und die größten offenen Fragen sind solche, die nur Labore beantworten können: Wann müsste ein Mechanismus einsetzbar sein, passt er zur bestehenden Infrastruktur, passt er zur Sicherheitslage des Labors und welche anderen operativen Beschränkungen würden ihn unpraktisch machen?Start der Ko-EntwicklungsreiheDies ist die erste Veranstaltung in einer Co-Design-Serie, um die Verifizierung von Designs zur Bereitstellung zu bewegen. Die Idee ist, einen großen Stapel von Verifizierungsvorschlägen schrittweise auf eine kleine Anzahl glaubwürdiger Kandidaten zu reduzieren:(a) Mit Laboren vereinbaren, welche Ansprüche für das Pacing zu verschiedenen Zeitrahmen tatsächlich von Bedeutung sind.(b) Red-Teaming auf Papierniveau mit Laborinfrastruktur, Sicherheit und anderen relevanten Teams, um fatale Einschränkungen zu erfassen, bevor jemand Mühe in Prototypen investiert.(c) Proof-of-Concept-Bauten, zunächst außerhalb von Laboren und auf Laborinfrastruktur, wo das hilft.(d) Technisches und operatives Red-Teaming von allem, was übrig bleibt -Diese erste Sitzung ist Stufe (a). Wir wissen, dass die Leute in Laboren nicht viel Zeit haben, um Vorschläge zu prüfen, deshalb werden wir Sie nicht bitten, einen Stapel von Einreichungen zu bewerten.Was wir in dieser Sitzung tun werdenVor der Sitzung werden wir eine Entwurfsliste von Ansprüchen verteilen, die Labore oder Regierungen einander glaubwürdig machen möchten. Es ist nur ein Ausgangspunkt. Bitte hinterfragen, verfeinern, priorisieren und hinzufügen. Besonders möchten wir, dass Personen, die denken, dass die gesamte Verifizierungsagenda fehlgeleitet ist, uns sagen, warum.Gemeinsam werden wir:Das Format ist ein strukturiertes Brainstorming, kleine Gruppenarbeit und eine abschließende Synthese. Es wird Essen geben. Wir möchten, dass dies so sehr ein guter Austausch ist wie eine Arbeitssitzung.Alle nehmen in persönlicher Kapazität teil. Die Teilnahme impliziert keine Zustimmung Ihres Arbeitgebers. Die Diskussion erfolgt unter der Chatham House Regel.
Veranstaltungsort
Lassen Sie Ihr Netzwerk wissen, dass Sie dabei sind
Teilen Sie diese Veranstaltung, um Gespräche zu beginnen, Kollegen einzuladen und sich vorab zu vernetzen.