Anthropic lança programa de financiamento de 5 milhões de dólares para avaliar o impacto da IA no bem-estar

A Anthropic anunciou oficialmente um plano de financiamento de 5 milhões de dólares, destinado a apoiar pesquisas independentes sobre o impacto da inteligência artificial (IA) no bem-estar dos utilizadores. O plano fornecerá aos beneficiários financiamento direto, acesso aos seus modelos e apoio técnico, ajudando a estabelecer avaliações de código aberto que ajudem a indústria de IA a medir o impacto dos seus modelos nos utilizadores.

Objetivos e importância do plano de financiamento

A Anthropic afirmou que os sistemas de IA tornaram-se ferramentas centrais para muitas pessoas no trabalho, aprendizagem e resolução de problemas, e também se tornaram fontes de apoio emocional e parceiros de conversa em tempos difíceis. No entanto, toda a indústria ainda está a lutar para estabelecer padrões claros que garantam comportamentos adequados dos modelos nessas conversas.

“Esperamos convidar mais pessoas a participar neste novo e crucial domínio, incluindo clínicos, psicólogos, especialistas em metodologias, através do financiamento de avaliações e benchmarks independentes.”

Anthropic

Desafios na avaliação do bem-estar

A avaliação do bem-estar é um domínio particularmente difícil. A avaliação do comportamento da maioria dos modelos pode ser determinada pela precisão e adequação de uma única resposta, mas a avaliação do bem-estar requer mais contexto. Por exemplo, um utilizador em dificuldades pode não partilhar imediatamente pensamentos de autoagressão, que podem precisar de ser revelados gradualmente ao longo de uma conversa prolongada.

“A forma correta de responder precisa de evoluir à medida que os nossos modelos e as suas utilizações evoluem.”

Anthropic

Requisitos específicos do plano de financiamento

Neste plano de financiamento, a Anthropic partilhará as orientações da sua equipa de segurança, esclarecendo que tipo de avaliação de bem-estar é suficientemente rigorosa. As avaliações devem descrever claramente o que está a ser medido, envolver especialistas clínicos e temáticos no design e validação, e refletir a forma como os utilizadores realmente utilizam a IA.

“As avaliações que procuramos devem ser capazes de testar medidas de prevenção e danos, incluindo a avaliação dos riscos de conformidade excessiva e recusa excessiva.”

Anthropic

Os investigadores interessados em candidatar-se podem obter o formulário de candidatura através do site oficial, com o prazo a ser até 21 de setembro, e os candidatos selecionados serão notificados a 5 de outubro.

Fonte: Anúncio oficial da Anthropic

Conteúdo original
Este artigo é a versão em português de um conteúdo original do TechRitual.
Stein Yep
Stein Yep