Anthropic detalla las salvaguardas de Claude de cara a las elecciones en EE. UU.
Anthropic expuso políticas, sistemas de aplicación de normas, pruebas y redirecciones a información de voto destinadas a limitar el uso indebido de Claude en contextos electorales.
Respuesta rápida
¿Qué salvaguardas relacionadas con las elecciones anunció Anthropic para Claude?
Anthropic expuso medidas destinadas a impedir el uso indebido de Claude en contextos electorales, entre ellas restricciones a las campañas, el cabildeo y la desinformación; una aplicación automatizada de las normas respaldada por revisión humana; pruebas de resistencia (red-teaming) dirigidas; y evaluaciones a gran escala. La empresa también redirige las consultas relacionadas con las elecciones hacia información de voto actualizada e indica la fecha de corte del conocimiento de Claude en su instrucción de sistema.
Claves
- Anthropic prohíbe utilizar sus productos para campañas políticas, cabildeo, campañas políticas dirigidas, solicitud de votos y recaudación de fondos con fines políticos.
- La empresa afirma que recurre a la aplicación automatizada de normas, la revisión humana y, en casos extremos, la suspensión de cuentas para abordar el uso indebido relacionado con elecciones.
- Anthropic pone a prueba a Claude frente a la desinformación electoral, la paridad política, la negativa a responder consultas dañinas y las tácticas de perfilamiento de votantes.
- Los usuarios de Claude que buscan información sobre el voto pueden recibir la opción de visitar TurboVote, un recurso apartidista de Democracy Works.
Anthropic expuso políticas, controles técnicos y pruebas destinadas a limitar el uso indebido de Claude en contextos electorales de cara a las elecciones federales, estatales y locales que se celebrarán en Estados Unidos el 5 de noviembre de 2024.
La empresa afirmó que, desde julio de 2023, había adoptado medidas para detectar y mitigar el posible uso indebido de sus herramientas y para orientar a los usuarios hacia fuentes electorales autorizadas. Su anuncio resumió ese trabajo, que incluye restricciones de política, prácticas de aplicación de normas, evaluaciones y redirecciones a información de voto.
Restricciones sobre usos políticos
Anthropic indicó que una actualización de mayo de su Política de Uso aclaró los usos prohibidos relacionados con elecciones y votaciones. La empresa prohíbe utilizar sus productos para campañas políticas y cabildeo. Según esa política, Claude no puede emplearse para promover a un candidato, partido o causa, llevar a cabo campañas políticas dirigidas, solicitar votos o pedir aportes económicos.
La política también prohíbe generar desinformación sobre leyes electorales, candidatos y temas afines. Anthropic señaló que Claude no puede usarse para atacar máquinas de votación ni para obstruir el conteo o la certificación de los votos.
Claude genera texto, no imágenes, audio ni video. Anthropic afirmó que esta limitación elimina el riesgo de deepfakes electorales generados a través del producto.
Aplicación de normas y pruebas
Anthropic señaló que emplea sistemas automatizados para hacer cumplir sus políticas y que audita esos sistemas mediante revisión humana. Sus métodos incluyen modificar las instrucciones en claude.ai, auditar casos de uso en su API propia y, en casos extremos, suspender cuentas.
La empresa también colabora con Amazon Web Services y Google Cloud Platform para identificar y mitigar daños relacionados con elecciones entre los usuarios que acceden a los modelos de Anthropic a través de esas plataformas.
Anthropic indicó que realiza de forma habitual pruebas de resistencia (red-teaming) dirigidas específicamente a consultas electorales. También recurre a pruebas de vulnerabilidad de políticas, realizadas junto con expertos externos en la materia, para examinar la desinformación, los sesgos y el abuso adversarial. Ese proceso incluye seleccionar preguntas relevantes, documentar las respuestas del modelo y registrar si se producen intervenciones de seguridad, como la negativa a atender solicitudes dañinas.
Según Anthropic, las evaluaciones automatizadas ponen a prueba los sistemas a gran escala. Las pruebas examinan la paridad política entre candidatos y temas, la negativa a responder consultas electorales dañinas y la resistencia frente a la desinformación y a tácticas de perfilamiento de votantes. Anthropic afirmó que los hallazgos de este trabajo orientan cambios en sus políticas, sus procesos de aplicación de normas y sus modelos.
Información de voto y transparencia
Anthropic señaló que sus modelos no se entrenan con la frecuencia necesaria para ofrecer información electoral en tiempo real. Ante preguntas relacionadas con las elecciones, la empresa redirige a los usuarios hacia recursos de voto actualizados y autorizados.
Una ventana emergente en Claude ofrece a los usuarios que solicitan información sobre el voto la opción de visitar TurboVote, un recurso apartidista de Democracy Works. Anthropic indicó que TurboVote había incorporado recientemente los nombres de los candidatos que se presentan a elecciones federales y estatales, junto con las propuestas de referéndum.
La empresa también actualizó la instrucción de sistema de Claude para indicar la fecha de corte de su conocimiento. Anthropic señaló que publicó algunas de las evaluaciones automatizadas empleadas en su trabajo electoral y que puso en marcha una iniciativa para financiar evaluaciones independientes de las capacidades y los riesgos de la IA.
Anthropic afirmó que, durante el año, se reunió con responsables de políticas públicas, organizaciones de la sociedad civil y actores de la industria, y que realizó planificación de escenarios ante posibles abusos electorales antes del día de las elecciones en Estados Unidos.
Fuente: anuncio de Anthropic sobre la preparación para las elecciones en Estados Unidos, publicado el 8 de octubre de 2024.
Preguntas frecuentes
- ¿Puede usarse Claude para hacer campaña política?
- Anthropic señala que su política prohíbe utilizar sus productos para campañas políticas y cabildeo. Las restricciones abarcan la promoción de candidatos, partidos o causas, las campañas políticas dirigidas, la solicitud de votos y las peticiones de aportes económicos.
- ¿Cómo vigila Anthropic el uso indebido relacionado con las elecciones?
- La empresa afirma que combina la aplicación automatizada de normas con la revisión humana. Sus métodos incluyen modificaciones de las instrucciones en claude.ai, auditorías de los casos de uso de su API propia y, en casos extremos, la suspensión de cuentas.
- ¿Cómo pone a prueba Anthropic sus salvaguardas electorales?
- Anthropic afirma que realiza pruebas de resistencia (red-teaming) dirigidas, pruebas de vulnerabilidad de políticas junto con expertos externos en la materia, y evaluaciones automatizadas que abarcan varios riesgos relacionados con las elecciones.
- ¿Adónde dirige Claude a los usuarios que buscan información sobre el voto?
- Anthropic implementó una ventana emergente que ofrece redirigir a los usuarios hacia TurboVote, un recurso apartidista de Democracy Works. La empresa señaló que TurboVote se había actualizado con los nombres de candidatos federales y estatales y con las propuestas de referéndum.
Fuentes
- U.S. elections readiness \ Anthropic — Anthropic