Anthropic detalla sus prácticas de seguridad para modelos de IA de frontera
Anthropic expuso los controles de ciberseguridad que está implementando y recomendó normas de contratación pública y cooperación público-privada para proteger los modelos de IA de frontera.
Respuesta rápida
¿Qué medidas de seguridad anunció Anthropic para desarrollar y desplegar modelos de IA de frontera?
Anthropic afirmó que está implementando controles de doble autorización, el Marco de Desarrollo Seguro de Software del NIST, los Niveles de la Cadena de Suministro para Artefactos de Software y otras prácticas de ciberseguridad. También recomendó requisitos de contratación pública, una mayor cooperación público-privada y protecciones más sólidas para los modelos avanzados, sus pesos y la investigación utilizada para desarrollarlos.
Claves
- Anthropic afirmó que está implementando controles de doble autorización, el SSDF, el SLSA y otras prácticas de ciberseguridad.
- La empresa recomendó aplicar la autorización de múltiples partes a todos los sistemas utilizados para desarrollar, entrenar, alojar y desplegar modelos de IA de frontera.
- Anthropic instó a ampliar el Marco de Desarrollo Seguro de Software del NIST para que abarque el desarrollo de modelos.
- La empresa afirmó que los gobiernos podrían establecer inicialmente los controles propuestos mediante requisitos de contratación pública para empresas de IA y proveedores de servicios en la nube.
- Anthropic recomendó tratar a los laboratorios de IA de frontera de forma similar a las empresas de infraestructuras críticas en materia de cooperación público-privada e intercambio de información.
Anthropic afirmó que está implementando un conjunto de prácticas de ciberseguridad destinadas a proteger los modelos de inteligencia artificial de frontera, sus pesos y la investigación utilizada para desarrollarlos. La empresa también propuso requisitos de contratación pública y una cooperación más estrecha entre los laboratorios de IA y los organismos públicos.
Las medidas descritas por Anthropic incluyen controles de doble autorización, el Marco de Desarrollo Seguro de Software del NIST, conocido como SSDF, y los Niveles de la Cadena de Suministro para Artefactos de Software, conocidos como SLSA. Anthropic señaló que serán necesarias protecciones más sólidas a medida que aumenten las capacidades de los modelos y describió esta labor como un proceso iterativo en el que participan el Gobierno y la industria.
Autorización de múltiples partes
Anthropic recomendó aplicar controles de doble autorización a los sistemas utilizados para desarrollar, entrenar, alojar y desplegar modelos de IA de frontera. Denomina este enfoque «diseño de autorización de múltiples partes para infraestructuras críticas de IA».
Según el diseño descrito por Anthropic, ninguna persona tendría acceso permanente a entornos críticos de producción. Quien solicitara acceso necesitaría la autorización de un compañero de trabajo, una justificación empresarial y un permiso por tiempo limitado. La empresa afirmó que los laboratorios de IA emergentes pueden implementar estos controles incluso sin los recursos de las grandes compañías.
Anthropic presentó la medida como una protección frente a actores de amenazas avanzadas y riesgos internos. Señaló que la correcta implementación del control de doble autorización depende de un conjunto más amplio de prácticas de ciberseguridad.
Desarrollo seguro de modelos
Anthropic también recomendó aplicar prácticas de desarrollo seguro de software en todos los entornos de modelos de frontera. Identificó el SSDF y el SLSA como estándares que pueden adaptarse al desarrollo de modelos y al software relacionado.
La empresa afirmó que el uso conjunto de ambos marcos puede crear una cadena de custodia para un sistema de IA desplegado. Anthropic lo describió como una forma de vincular un modelo desplegado con la empresa que lo desarrolló y establecer su procedencia.
Anthropic denomina esta combinación propuesta «marco de desarrollo seguro de modelos». Instó al NIST a ampliar el SSDF mediante su proceso de elaboración de estándares para que el marco incluya expresamente el desarrollo de modelos.
Contratación pública y regulación
Anthropic afirmó que los gobiernos podrían establecer la autorización de múltiples partes y el desarrollo seguro de modelos como requisitos de contratación pública para las empresas de IA y los proveedores de servicios en la nube que aspiren a contratos públicos. Estas medidas se sumarían a otros requisitos de ciberseguridad aplicables a dichas empresas.
La empresa señaló que las normas de contratación pública que afecten a los proveedores estadounidenses de servicios en la nube podrían producir un efecto similar al de una regulación general del mercado, ya que muchas empresas de modelos de frontera utilizan sus infraestructuras. Anthropic propuso la contratación pública como una medida que podría aplicarse antes de establecer requisitos regulatorios.
Anthropic afirmó que muchas medidas de seguridad podrían comenzar como acuerdos voluntarios. Añadió que los gobiernos podrían determinar con el tiempo que el cumplimiento debe imponerse mediante sus facultades de contratación pública o regulación.
Cooperación público-privada
Anthropic recomendó que los laboratorios de investigación de IA de frontera participen en la cooperación público-privada del mismo modo que las empresas de sectores de infraestructuras críticas, como los servicios financieros. Sugirió que la IA de frontera podría designarse como un subsector especial del sector de las tecnologías de la información ya existente.
Según Anthropic, esta designación podría favorecer un mayor intercambio de información y una cooperación más estrecha entre los laboratorios de IA y los organismos gubernamentales. La empresa afirmó que este sistema podría ayudar a los laboratorios a protegerse frente a actores cibernéticos maliciosos con abundantes recursos.
Fuente: anuncio de Anthropic «Frontier model security», publicado el 25 de julio de 2023.
Preguntas frecuentes
- ¿Qué está implementando Anthropic?
- Anthropic afirmó que está implementando controles de doble autorización, el Marco de Desarrollo Seguro de Software del NIST, los Niveles de la Cadena de Suministro para Artefactos de Software y otras prácticas de ciberseguridad.
- ¿Qué entiende Anthropic por control de doble autorización?
- Anthropic describió un diseño en el que ninguna persona tiene acceso permanente a entornos críticos de producción. Cada persona debe solicitar a un compañero acceso por tiempo limitado y aportar una justificación empresarial.
- ¿Qué medidas gubernamentales recomendó Anthropic?
- Anthropic propuso requisitos de contratación pública para las empresas de IA y los proveedores de servicios en la nube que suscriban contratos con los gobiernos. Señaló que podrían comenzar con acuerdos voluntarios y que, con el tiempo, podrían adoptarse obligaciones de contratación pública o regulatorias.
- ¿Cómo propone Anthropic organizar la cooperación público-privada?
- Anthropic afirmó que los laboratorios de IA de frontera deberían cooperar con los gobiernos de forma similar a los sectores de infraestructuras críticas. Sugirió que la IA de frontera podría convertirse en un subsector especial del sector de las tecnologías de la información ya existente.
Fuentes
- Frontier model security \ Anthropic — Anthropic