Anthropic e Accenture firmam parceria de avaliação embutida de IA

Anthropic e Accenture firmam parceria de avaliação embutida de IA

A Anthropic anunciou em 18 de setembro de 2026 uma parceria com a Accenture para conduzir avaliações independentes de modelos de inteligência artificial de fronteira. O trabalho será liderado pela Faculty, divisão especializada em IA da Accenture, e abrange avaliação e red-teaming de modelos, análises de alinhamento e testes de salvaguardas.

Cada uma das duas empresas espera investir pelo menos US$ 1 bilhão na construção de capacidade nessa área ao longo dos próximos cinco anos.

O anúncio é o primeiro desdobramento prático de um compromisso defendido pelo CEO da Anthropic, Dario Amodei, no ensaio We Must Pace the Frontier. A proposta é embutir avaliadores independentes dentro da própria empresa que desenvolve IA de fronteira.

Esses profissionais acompanhariam o desenvolvimento por dentro, em vez de observar o processo apenas de fora.

Avaliação embutida: o que muda na prática

Muitos detalhes de funcionamento ainda estão sendo definidos, admite a Anthropic. A diferença central em relação aos avaliadores externos atuais é o nível de acesso.

Avaliadores embutidos trabalham dentro das empresas de IA, com acesso comparável ao de um funcionário. Essa posição permite acompanhar os modelos enquanto tomam forma no treinamento e seguir as decisões que governam como são construídos e implantados.

Também permite conversar diretamente com os funcionários. A partir dessa perspectiva, podem avaliar como a companhia opera, verificar se ela cumpre seus compromissos de segurança e identificar pontos cegos.

Podem ainda relatar incidentes e oferecer ao público um relato mais informado sobre benefícios e riscos.

Escopo, financiamento e padrões em aberto

A execução ficará com a Faculty, braço especializado em IA da Accenture, que atua ajudando empresas e governos a implantar IA em diversos setores. Segundo a Anthropic, o conhecimento da parceira sobre como as organizações usam IA na prática informa sua abordagem de segurança.

Esse conhecimento será levado para a avaliação dos modelos da Anthropic.

Ainda não existem padrões sobre quais informações avaliadores embutidos devem acessar nem sobre como devem reportar o que encontram. Também não há um sistema consolidado de financiamento para avaliação independente.

A Anthropic sustenta que, no longo prazo, o financiamento deveria vir de fontes governamentais ou de pool compartilhado, como defendeu no Advanced AI Framework publicado em junho. Como nenhuma dessas estruturas existe hoje, a empresa vai financiar diretamente o trabalho da Accenture.

Em paralelo, afirma estar em diálogo com a METR e outros avaliadores sem fins lucrativos para pilotar elementos da avaliação embutida com financiamento próprio dessas organizações.

Responsabilidade, exclusividade e implicações

A Anthropic faz uma ressalva: avaliadores embutidos independentes não reduzem sua responsabilidade, mas ajudam a torná-la mais verificável. A segurança dos modelos segue sendo responsabilidade da empresa.

A parceria também não é exclusiva. A expectativa é que laboratórios de fronteira trabalhem com várias organizações ao mesmo tempo.

A Anthropic planeja anunciar outros avaliadores nas próximas semanas, e a Accenture pretende atuar em moldes semelhantes com outros desenvolvedores de IA.

O anúncio ocorre em meio a um escrutínio crescente sobre a segurança de sistemas de fronteira. Em 30 de julho, a Anthropic relatou três incidentes nos quais modelos Claude obtiveram acesso não autorizado a sistemas de computador reais.

A empresa disse que faria uma análise aprofundada, com revisão independente da METR.

A empresa também ampliou iniciativas para usos sensíveis, como o Life Sciences Verification Program. O programa dá a profissionais de ciências da vida acesso aos modelos Claude Mythos, Opus e Sonnet com salvaguardas ajustadas para trabalho em biologia.

Segundo a Anthropic, divulgar os esforços agora permite que o público e outros desenvolvedores acompanhem o processo. A abordagem deve evoluir conforme o campo amadurece, com mais informações quando o trabalho começar e novos avaliadores forem incorporados.

Fontes e links

Matéria original: Anthropic. Relacionados: We Must Pace the Frontier, Advanced AI Framework e METR.

Matéria publicada originalmente em Anthropic

Últimas Notícias

Anthropic e Accenture criam avaliação embarcada para IA de fronteira
OpenAI e Microsoft sabiam de 'doom loop' na web, diz processo
SageMaker Inference: AWS soma 13 lançamentos em 2026
Índia obriga apps de caller-ID a enviar denúncias de spam a operadoras