Anthropic abre as portas para avaliadores externos testarem seus modelos
Anthropic escolheu a Accenture como primeira avaliadora externa. Anúncio saiu em 18/09. Amodei para desacelerar o avanço dos sistemas de IA mais avançados.

Anthropic escolheu a Accenture como sua primeira avaliadora externa incorporada. O anúncio saiu em 18 de setembro. A medida coloca em prática uma das ideias centrais do plano de Dario Amodei para desacelerar o avanço dos sistemas de IA↳Inteligência artificial440 conteúdosUX e IA: Transformando Experiências Digitais com Inteligência ArtificialProduto & UX · jan 2025MCP: O que é e por que você vai ouvir falar disso em breve?AI · jul 2025IA generativa e a urgência de reconstruir nossa relação com a verdadeAI · jun 2025Ver tudo em AI → mais avançados.
Na prática, especialistas da Faculty, divisão de IA da Accenture, vão trabalhar dentro da empresa. Além disso, eles terão como missão avaliar os mecanismos de segurança dos modelos.
Anthropic transforma proposta de Amodei em estrutura operacional
A ideia partiu do próprio CEO. Amodei propôs que avaliadores independentes recebam acesso em nível de funcionário às empresas de IA.
O objetivo é bem concreto. Esses especialistas verificam diretamente as práticas de segurança e comunicam incidentes.
Ao apresentar o plano, Amodei afirmou que a empresa se comprometeria sozinha com essa primeira etapa. Em seguida, incentivou outras desenvolvedoras a seguirem o mesmo caminho.
Portanto, a chegada da Accenture marca o primeiro passo prático dessa agenda.
O que os avaliadores vão testar de fato
O escopo inclui três frentes. Primeiro, testes de salvaguardas. Depois, exercícios de red team.
Por fim, entram análises sobre o alinhamento dos modelos com valores humanos. Ou seja, o trabalho cobre desde a barreira técnica até o comportamento geral do sistema.
Repare no diferencial desse formato. Um avaliador externo costuma receber o modelo pronto, enquanto um avaliador incorporado enxerga o processo por dentro.
Esse acesso muda a qualidade da auditoria. Afinal, contexto interno revela falhas que o teste de caixa preta deixa passar.
Anthropic banca a conta de pelo menos US$ 1 bilhão
As duas empresas concordaram em investir pelo menos US$ 1 bilhão nessa área. O valor equivale a cerca de R$ 5,3 bilhões. O prazo previsto é de cinco anos.
Contudo, existe um detalhe importante. A Anthropic afirmou que vai financiar diretamente as atividades da Accenture, dada a urgência do trabalho.
No longo prazo, a expectativa segue outra direção. A empresa quer que esse tipo de avaliação seja financiado por recursos compartilhados ou governamentais.
Esse modelo aparece no Advanced AI Framework, apresentado em junho. Como essas estruturas ainda faltam, a companhia pretende testar diferentes avaliadores e formatos de financiamento.
A parceria abre espaço para outros avaliadores
A Accenture chega sem exclusividade. A Anthropic confirmou conversas com a METR, organização de pesquisa sem fins lucrativos.
Além disso, outras entidades podem entrar no processo. Assim, o desenho aponta para um grupo de avaliadores com perfis distintos.
A empresa, porém, deixou uma posição clara. A responsabilidade pela segurança dos modelos continua dela.
Segundo o comunicado, a divulgação acontece agora para que pessoas e outros desenvolvedores acompanhem o processo. Novas informações devem sair conforme o trabalho avançar.
Como o setor reagiu ao plano de três etapas
O plano de Amodei dividiu opiniões. Sam Altman, da OpenAI, e Elon Musk manifestaram apoio.
Jensen Huang, da Nvidia, seguiu outro caminho. Ele rejeitou as preocupações e argumentou contra novas regulamentações.
Há também uma dúvida prática no ar. Afinal, analistas questionam como a proposta funcionará enquanto a empresa se prepara para uma possível abertura de capital.
O que desenvolvedores podem tirar desse movimento
Primeiro, avaliação independente tende a virar exigência de mercado. Clientes corporativos vão pedir evidências de auditoria externa ao escolher fornecedor de modelo.
Segundo, red team deixa de ser tarefa só do provedor. Aplicações construídas sobre modelos também precisam de testes adversariais próprios.
Terceiro, documente as suas salvaguardas. Registro claro de filtros, limites e respostas a incidentes facilita qualquer auditoria futura.
Além disso, acompanhe os relatórios que saírem dessa parceria. Eles devem trazer métodos de avaliação aplicáveis a produtos menores.
Por fim, pense em trilha auditável desde o início. Log de prompt, resposta e decisão do sistema sustenta qualquer investigação.
O que acompanhar nos próximos meses
Fique atento às primeiras publicações da Accenture sobre o trabalho. Acompanhe também a possível entrada da METR como segunda avaliadora.
Enquanto isso, vale observar se outras empresas aderem ao modelo. Caso isso aconteça, a avaliação incorporada pode se tornar padrão no setor.
Acompanhe nosso Perfil no Instagram!











