Anthropic anunció un programa de subvenciones por US$5 millones destinado a financiar investigaciones independientes sobre el impacto de la inteligencia artificial en el bienestar de los usuarios. La iniciativa entregará financiamiento directo, acceso a sus modelos y soporte técnico para desarrollar evaluaciones de código abierto.
Los proyectos seleccionados trabajarán de manera independiente de Anthropic y deberán publicar sus resultados como recursos abiertos, de modo que puedan ser utilizados por otros desarrolladores. La compañía busca ampliar las herramientas disponibles para evaluar situaciones donde los sistemas de IA interactúan con usuarios que buscan compañía, apoyo emocional o asistencia durante una crisis de salud mental.

Evaluaciones adaptadas a conversaciones prolongadas
Anthropic advierte que medir el bienestar presenta dificultades distintas a evaluar la precisión de una respuesta aislada. El contexto puede cambiar durante una conversación extensa y determinados riesgos pueden aparecer después de múltiples intercambios, lo que obliga a considerar escenarios de varias etapas.
El programa priorizará evaluaciones que definan claramente qué miden, incorporen especialistas clínicos y expertos en la materia, analicen tanto precauciones como posibles daños y representen la forma en que las personas utilizan realmente los sistemas de IA. También deberán validar sus mecanismos de evaluación con especialistas humanos.

Convocatoria abierta hasta septiembre
Anthropic espera incorporar al trabajo a clínicos, psicólogos, especialistas en metodología y otros investigadores capaces de desarrollar nuevos métodos para evaluar el bienestar asociado al uso de IA. Las postulaciones estarán abiertas hasta el 21 de septiembre de 2026, mientras que los candidatos seleccionados para presentar propuestas completas serán notificados el 5 de octubre.

