NexSift
Indústria TechNovo

Anthropic adota avaliadores externos embutidos e propõe desacelerar IA de fronteira

Publicado 13 de set. de 2026 · Leitura 1 min de leitura · Relevância 9.4

PorTiago CastroCriador do NexSift·NexSift Editorial
O que mudou

Dario Amodei propôs um plano em três etapas para desacelerar a evolução de modelos de fronteira, e a Anthropic se comprometeu unilateralmente a receber avaliadores externos com acesso semelhante ao de equipes internas de risco.

Por que importa

O ponto material não é apenas o discurso sobre desaceleração, mas a decisão de abrir processos internos de treinamento e avaliação a terceiros de forma contínua. Se o modelo funcionar, ele pode mudar o padrão esperado de auditoria em laboratórios de fronteira e influenciar contratos, regulação e critérios de liberação de modelos de alto risco.

A Anthropic passou de recomendações gerais de segurança para um compromisso operacional mais intrusivo: a empresa pretende incorporar avaliadores externos independentes com acesso contínuo a ferramentas, workspaces e processos internos comparável ao de equipes próprias de avaliação de risco.

A medida é a primeira etapa do plano Pace the Frontier, apresentado por Dario Amodei. A segunda etapa propõe coordenação entre laboratórios de IA em países democráticos para estabelecer padrões comuns e limites à evolução não verificada de capacidades. A terceira amplia a coordenação para governos e laboratórios em escala global.

Amodei deixa explícito que a proposta não significa interromper treinamento de modelos. O objetivo declarado é reduzir a velocidade de avanço das capacidades quando avaliação, alinhamento e salvaguardas não conseguem acompanhar. A Anthropic afirma que começará unilateralmente pela presença de avaliadores externos e defende que outros laboratórios adotem mecanismo equivalente.

O que observar agora

Observar qual organização será escolhida como avaliadora, quanto acesso real ela receberá, quais achados poderão ser publicados sem veto editorial da Anthropic e se OpenAI, Google DeepMind ou outros laboratórios adotam compromissos equivalentes ou coordenados.

Tópicos relacionados com este sinal
Continue no radar