Anthropic lanza un programa de subvenciones de 5 millones de dólares para investigar el bienestar en la IA
Anthropic announced funding, model access and technical support for independent, open-source evaluations of AI’s effects on user wellbeing.
Respuesta rápida
¿Qué anunció Anthropic sobre la financiación de investigaciones acerca del impacto de la IA en el bienestar de los usuarios?
Anthropic launched a $5 million grant program for independent research into AI’s effects on user wellbeing. Selected grantees will receive direct funding, access to Anthropic’s models and technical support while independently developing open-source evaluations. Applications are due September 21, with full-proposal invitations scheduled by October 5.
Claves
- Anthropic launched a $5 million grant program for independent research into how AI affects users’ wellbeing.
- El programa proporcionará a los beneficiarios financiación directa, acceso a los modelos de Anthropic y soporte técnico.
- Grantees will work independently and publish their evaluations as open-source projects available to developers.
- Anthropic busca evaluaciones que incluyan conocimientos especializados, conversaciones realistas y validación por parte de expertos humanos.
- Applications are due September 21, and selected applicants will be invited to submit full proposals by October 5.
Programa de subvenciones de Anthropic
Anthropic anunció un programa de subvenciones de 5 millones de dólares para apoyar investigaciones independientes sobre cómo afecta la IA al bienestar de los usuarios. La empresa afirmó que el programa proporcionará financiación directa, acceso a sus modelos y asistencia técnica a los beneficiarios que desarrollen evaluaciones de código abierto.
Según Anthropic, los beneficiarios realizarán su trabajo de forma independiente. Sus proyectos se publicarán como código abierto para que los desarrolladores puedan utilizarlos.
Anthropic afirmó que desea que el programa involucre a profesionales clínicos, psicólogos, especialistas en metodología y otros expertos en la creación de evaluaciones y parámetros de referencia sobre el bienestar de los usuarios.
Enfoque de las evaluaciones
Anthropic afirmó que evaluar el bienestar puede requerir más contexto conversacional que evaluar un comportamiento del modelo que pueda juzgarse a partir de una sola respuesta. La empresa describió situaciones en las que los riesgos solo se hacen evidentes durante un intercambio más prolongado o en las que una respuesta puede ser apropiada en un contexto, pero perjudicial en otro.
Uno de los ejemplos del anuncio se refiere a consejos sobre dieta y ejercicio. Anthropic afirmó que tales consejos podrían ser razonables cuando un usuario pregunta cómo perder peso, pero podrían ser inapropiados o perjudiciales si el usuario ha mostrado antecedentes de trastornos alimentarios. También citó las conversaciones relacionadas con la compañía y las crisis de salud mental como ámbitos en los que todavía se están desarrollando estándares para el comportamiento de los modelos.
La empresa afirmó que desarrolla salvaguardas destinadas a identificar dichas conversaciones y ayudar a Claude a responder adecuadamente. Anthropic también afirmó que publica investigaciones sobre los tipos de conversaciones que los usuarios mantienen con Claude para orientar las salvaguardas, su evaluación y otras medidas relacionadas con el bienestar de los usuarios.
Orientaciones para las evaluaciones
Junto con el programa de subvenciones, Anthropic compartió orientaciones de su equipo de Salvaguardas sobre las características que, a su juicio, hacen rigurosas las evaluaciones del bienestar y los desafíos que pueden limitar su utilidad.
Anthropic afirmó que busca evaluaciones que:
- Definan claramente lo que miden, incluido qué constituye una aprobación o un fallo y por qué es importante la medición.
- Incluyan a expertos clínicos y especialistas en la materia en su diseño y validación.
- Evalúen tanto las precauciones como los daños, incluidos los riesgos derivados del cumplimiento excesivo y del rechazo excesivo.
- Representen cómo utilizan las personas la IA, incluidos escenarios de múltiples turnos en los que el riesgo aumenta y el contexto cambia durante una conversación prolongada.
- Validan los evaluadores automatizados o de otro tipo comparándolos con verdaderos expertos en la materia.
Anthropic remitió a los posibles solicitantes a un formulario de solicitud y proporcionó por separado orientaciones sobre cómo crear evaluaciones y parámetros de referencia del bienestar. Las solicitudes deben presentarse antes del 21 de septiembre. La empresa afirmó que los solicitantes seleccionados para presentar propuestas completas recibirán una notificación antes del 5 de octubre.
Fuente: anuncio de Anthropic «Financiación de mejores evaluaciones del impacto de la IA en el bienestar», publicado el 25 de agosto de 2026.
Preguntas frecuentes
- ¿Cuánta financiación está proporcionando Anthropic?
- Anthropic says the grant program will provide $5 million for independent research into AI’s impact on user wellbeing.
- ¿Qué apoyo recibirán los beneficiarios?
- The company says grantees will receive direct funding, access to its models and technical support.
- ¿La investigación estará disponible públicamente?
- Anthropic says grantees will publish their work as open-source projects that any developer can use.
- ¿Cuándo vence el plazo para presentar las solicitudes?
- Applications are due September 21. Applicants selected to submit full proposals will be notified by October 5.