Enviar evento
Co-desarrollando verificación para Pacing the Frontier

Co-desarrollando verificación para Pacing the Frontier

27 ago. 202617:30 - 21:00 America/Los_AngelesSan Francisco, United States0 AsistentesOpen

Descripción

AntecedentesLos laboratorios de IA fronteriza pueden eventualmente necesitar controlar o limitar el desarrollo o la implementación en un umbral de capacidad crítica. Hacerlo de manera segura y dar confianza a otros laboratorios o gobiernos de que los compromisos se están cumpliendo realmente, depende de mecanismos de verificación que existan antes de que se necesiten urgentemente.Sin ellos, los laboratorios y los responsables de políticas podrían enfrentarse a decisiones de alto riesgo con muy poco margen de maniobra. Eso aumenta el riesgo de perder el control sobre sistemas avanzados, o de perder la capacidad de influir en las decisiones sobre ellos (por ejemplo, a través de una intervención gubernamental contundente)."Pacing the frontier" define el problema pero no las soluciones. La declaración pide al gobierno que habilite opciones. Pensamos tentativamente que esto es al revés: los laboratorios fronterizos tienen más probabilidades que los gobiernos de tener la experiencia y los recursos para hacer funcionar las herramientas de verificación antes de que sean necesarias.Mientras tanto, la comunidad de verificación está construyendo diseños técnicos, experimentos y prototipos. Lo que falta es la opinión de personas de los laboratorios fronterizos sobre si alguno de ellos podría funcionar realmente en un entorno fronterizo. Y las preguntas más importantes son aquellas que solo los laboratorios pueden responder: ¿cuándo necesitaría ser desplegado un mecanismo?, ¿se ajusta a la infraestructura existente?, ¿se ajusta a la postura de seguridad del laboratorio?, y ¿qué otras limitaciones operativas lo harían poco práctico?Iniciando la serie de co-desarrolloEste es el primer evento en una serie de co-diseño sobre cómo mover la verificación de los diseños a la implementación. La idea es reducir progresivamente una gran pila de propuestas de verificación a un pequeño número de candidatos creíbles:(a) Acordar con los laboratorios qué afirmaciones son realmente importantes para el pacing, en diferentes horizontes temporales.(b) Red-teaming a nivel de papel con infraestructura de laboratorios, seguridad y otros equipos relevantes, para detectar limitaciones fatales antes de que alguien invierta esfuerzo en prototipos.(c) Construcciones de prueba de concepto, inicialmente fuera de los laboratorios y en infraestructura de laboratorios donde eso ayude.(d) Red-teaming técnico y operativo de lo que sobrevive-Esta primera sesión es la etapa (a). Sabemos que las personas en los laboratorios no tienen mucho tiempo para revisar propuestas, así que no les pediremos que evalúen una pila de presentaciones.Lo que haremos en esta sesiónAntes de la sesión, circularemos una lista de afirmaciones que los laboratorios o gobiernos podrían querer hacer creíbles entre sí. Es solo un punto de partida. Por favor, desafíenla, refínanla, re-priorízenla y añadan a ella. Especialmente queremos que las personas que piensan que toda la agenda de verificación es errónea nos digan por qué.Juntos, nosotros:El formato es una lluvia de ideas estructurada, grupos pequeños y una síntesis final. Habrá comida. Queremos que esto sea tan agradable como una sesión laboral.Todos participan en una capacidad personal. La participación no implica el respaldo de su empleador. La discusión está bajo la Regla de Chatham House.

Ubicación del evento

Dile a tu red que vas a ir

Comparte este evento para iniciar conversaciones, invitar colegas y conectar antes de que comience.

Related events

Plataforma de inteligencia artificial

Gratis