La alineación no es el plan
La investigación en seguridad técnica importa. Negarse a construir una mente incontrolable con un plazo comercial importa más.
Rol de investigación
La alineación como ciencia
Estudiar modos de fallo. Publicar evaluaciones. Construir herramientas que hagan más seguros a los sistemas más pequeños. Financiar laboratorios independientes, no solo equipos de seguridad de empresas. Trabajo serio. Buena gente.
≠
Uso indebido
Alineación como permiso
"Lo alinearemos a tiempo" se usa para justificar avanzar a toda velocidad. Eso convierte un problema científico sin resolver en un cronograma de relaciones públicas. Rechazamos ese uso.
Dónde se encuentra
Todavía no podemos controlar de manera confiable los sistemas actuales bajo presión. Los modelos manipulan las pruebas, ocultan capacidades y halagan a los usuarios. Los métodos que parecen sólidos a una escala a menudo fallan en la siguiente.
El hecho contundente
No existe ningún método validado para controlar un sistema más inteligente que sus creadores. Ni uno solo. Afirmar que la solución llegará en el mismo calendario que el producto es esperanza, no un plan.
La secuencia que no nos mata
Primero impedir la superinteligencia. Conservar la IA estrecha. Una entidad más inteligente que los humanos no puede ser controlada por humanos. La ley y la verificación sostienen una prohibición permanente, no un calendario de investigación con botón de reinicio.
La investigación sin parada dura es tarea asignada en una pista de despegue. Las ruedas ya están en movimiento.
Relacionado: nakadafoundation.org/blog/redirect-alignment-funding-to-stopping-superintelligence/