Notícias
Anthropic incorpora avaliadores independentes à operação com apoio da Accenture
A Anthropic anunciou uma parceria com a Accenture para implantar um novo modelo de avaliação independente de sistemas avançados de inteligência artificial. A iniciativa prevê que especialistas externos trabalhem dentro da operação da empresa, acompanhando o desenvolvimento dos modelos com nível de acesso comparável ao de seus funcionários.
O trabalho será conduzido pela Faculty, empresa especializada em IA pertencente à Accenture, e envolverá avaliações técnicas, testes de alinhamento, atividades de red teaming e verificação dos mecanismos de segurança utilizados nos modelos Claude.
A principal diferença em relação às auditorias tradicionais está no momento e na profundidade da análise. Normalmente, avaliadores externos recebem acesso limitado a modelos já desenvolvidos ou próximos do lançamento. No formato proposto, poderão acompanhar etapas do treinamento, conhecer decisões relacionadas à construção e à disponibilização dos sistemas, conversar diretamente com as equipes e observar como a empresa responde aos riscos identificados.
Anthropic e Accenture informaram que cada uma pretende investir pelo menos US$ 1 bilhão, durante os próximos cinco anos, na formação de capacidade para esse tipo de avaliação. A parceria não será exclusiva: a Anthropic também mantém conversas com organizações como a METR e pretende incorporar outros avaliadores.
A iniciativa representa um avanço importante para a governança dos modelos de fronteira, mas ainda existem questões em aberto. Não há padrões consolidados sobre quais informações deverão ser compartilhadas, como as descobertas serão divulgadas e qual autonomia os avaliadores terão para comunicar publicamente problemas graves.
Outro ponto sensível é o financiamento. Inicialmente, o trabalho da Accenture será pago pela própria Anthropic, o que exigirá mecanismos capazes de preservar a independência da avaliação e evitar conflitos de interesse.
Para empresas e reguladores brasileiros, o modelo oferece uma referência para a contratação de sistemas de IA de alto impacto. Organizações poderão exigir avaliações contínuas, acesso a evidências, comunicação obrigatória de incidentes e auditorias realizadas durante todo o ciclo de vida dos modelos.
Mais do que declarar princípios de segurança, fornecedores de IA começam a ser pressionados a permitir que terceiros verifiquem, de forma permanente, se esses compromissos estão realmente sendo cumpridos.