O que aconteceu
Em 17 de setembro de 2026, a Anthropic publicou no seu Anthropic Institute um relatório chamado “Measurements for understanding the pace of AI development inside frontier labs”, apresentando o R&D Automation Index: um índice interno que tenta medir quanto do trabalho de pesquisa e desenvolvimento de modelos na empresa já é feito pelo próprio Claude.
Principais números:
- Em agosto de 2026, o Claude “liderou” 26% das tarefas de P&D de IA da Anthropic.
- A trajetória: menos de 1% em fevereiro, 12% em maio, 22% em julho, 26% em agosto.
- Mais de 90% do trabalho de P&D já envolve o Claude como colaborador ou líder em algum grau.
- A Anthropic relatou cerca de 30 mil agentes Claude rodando simultaneamente na plataforma interna mais usada da empresa em agosto.
O CEO Dario Amodei comentou o resultado no contexto do seu próprio pedido por desaceleração coordenada da fronteira de IA, o ensaio “We Must Pace the Frontier”, publicado em 12 de setembro. Ele escreveu que “precisamos desacelerar o ritmo em que melhoramos as capacidades dos modelos de IA” e observou que esses números tenderiam a mudar caso houvesse essa coordenação entre laboratórios.
A escala de automação usada no índice foi desenvolvida pela Epoch AI, organização independente sem fins lucrativos que a Anthropic adotou em vez de criar métrica própria. A escala vai de AL0 (nenhuma participação de IA) a AL5 (IA totalmente autônoma, sem humano no circuito). Em AL3 (“colabora”), a IA executa grandes partes do trabalho sob direção humana próxima. Em AL4 (“lidera”), completa a maior parte da tarefa de ponta a ponta a partir de um prompt de alto nível, com um humano supervisionando. É esse patamar, AL4, que o índice usa para o número de 26%.
Por que isso importa
Esse relatório importa porque é o primeiro dado quantitativo que um laboratório de ponta publica voluntariamente sobre o quanto a própria IA já participa do desenvolvimento de IA, um tema até aqui discutido quase só em especulação.
Contexto: a Anthropic constrói o índice a partir de registros internos de trabalho, incluindo mensagens de Slack e documentação da empresa. Em cada semana de julho de 2026, ela amostrou aleatoriamente 20% da equipe de departamentos envolvidos em P&D de modelos, catalogando cerca de 15 mil tarefas individuais. É um esforço de mensuração real, não uma estimativa de marketing solta. Mas também é um número que a própria empresa produz, audita e divulga sobre si mesma, sem verificação externa.
O que chama atenção: o salto de menos de 1% para 26% em seis meses não é uma curva suave, é uma inflexão. Se o ritmo dos últimos meses (12% → 22% → 26%) se sustentar, a Anthropic pode estar a poucos trimestres de um ponto em que a maioria das tarefas de P&D de modelo passe pelo Claude como líder, não apenas como ferramenta de apoio.
Isso conecta diretamente com o mesmo ensaio de Amodei citado acima, no qual ele defendia desaceleração coordenada entre os grandes laboratórios. Dias depois, esse mesmo ensaio virou base de uma ação antitruste federal movida por consumidores contra as quatro grandes empresas de IA. O relatório de automação não faz parte dessa disputa judicial, mas se soma ao mesmo pano de fundo: uma empresa que ao mesmo tempo pede desaceleração e documenta o quanto sua própria IA já acelera o trabalho interno.
| Antes do relatório | Depois do relatório |
|---|---|
| Especulação sobre “IA construindo IA” sem números públicos | Primeiro índice quantitativo, publicado por um laboratório, com metodologia declarada |
| Debate sobre desaceleração baseado em ensaios e opinião | Debate ancorado, ao menos em parte, em dados internos, ainda que não auditados |
| Autonomia de IA em P&D tratada como binário (tem ou não tem) | Escala granular (AL0-AL5) que distingue “colabora” de “lidera” de “autônomo” |
O que boa parte da cobertura sobre esse relatório está deixando passar: a Anthropic não afirma que o Claude opera sozinho. O índice mede quem lidera a tarefa, com humano supervisionando, não substituição de pessoas. Confundir os dois é o erro mais comum nas leituras apressadas desse número.
O que isso significa para quem acompanha o setor de IA
Para desenvolvedores, gestores de produto e qualquer pessoa que decide sobre adoção de IA em processos internos, esse relatório tem implicações concretas.
Impacto 1: Métricas de automação interna deixam de ser tabu
Até aqui, laboratórios de IA evitavam publicar quanto de seu próprio trabalho já é automatizado, tema sensível que envolve empregos e narrativa pública. A Anthropic abrir esse número cria precedente para que OpenAI, Google DeepMind e outros sejam cobrados a fazer o mesmo, e dá aos observadores externos um parâmetro concreto pela primeira vez.
Impacto 2: O ritmo, não o número absoluto, é o dado que importa
26% isoladamente diz pouco. O que sinaliza aceleração é a curva: a diferença entre triplicar em seis meses (fevereiro a agosto) e triplicar em dois anos é enorme para qualquer planejamento de política pública ou de negócio que dependa de prever quando a IA muda de patamar.
Impacto 3: Mensuração própria tem limite
A Anthropic é explícita: as avaliações são autodeclaradas, feitas majoritariamente com apoio do próprio Claude, e não passaram por auditoria externa. É um dado útil, mas que deve ser lido como ponto de partida de um debate sobre padronização, não como verificação independente.
O que observar a partir de agora
- Curto prazo (próximas semanas): acompanhar se OpenAI, Google DeepMind ou outros laboratórios reagem publicando índices comparáveis. Esse relatório da Anthropic propõe, separadamente do ensaio de Amodei, que qualquer laboratório de fronteira publique três medidas próprias: quanto da pesquisa é feita por IA, quão de perto os agentes são supervisionados, e quanto de capacidade computacional vai para segurança.
- Médio prazo (este trimestre): observar se a curva de crescimento (12% → 22% → 26%) desacelera, se mantém ou acelera nos próximos relatórios trimestrais da Anthropic.
- Longo prazo (próximos meses): acompanhar o desdobramento regulatório. O relatório se soma ao ensaio “Pace the Frontier” de Amodei como munição dos dois lados do debate sobre desaceleração coordenada da IA, tanto de quem defende freios quanto da ação antitruste que citou o próprio ensaio como evidência de conluio.
Não faça: não trate os 26% como “um quarto do trabalho de pesquisa da Anthropic é feito sozinho pela IA”. O índice mede liderança de tarefa com supervisão humana (AL4), não substituição de pessoas, e nenhuma categoria medida chegou a AL5, o nível de autonomia plena.
Panorama geral
Esse relatório se encaixa numa tendência maior: laboratórios de ponta começando a medir e publicar, com metodologia declarada, o quanto seus próprios processos internos já dependem de IA. É o debate sobre “singularidade” ou “IA recursiva” saindo da especulação filosófica e virando número trimestral acompanhável.
Isso vem na esteira de outros movimentos recentes da Anthropic, como a proposta de Amodei de um plano de três etapas para desacelerar a corrida da IA e a unificação de suas interfaces de produto com o lançamento de Docs e Slides dentro do Cowork.
O padrão é consistente: a empresa que mais defende publicamente desaceleração é também a que documenta, com mais transparência que os concorrentes, o quanto sua própria IA já acelera o trabalho interno. É uma tensão que deve pesar no debate regulatório dos próximos meses.
Perguntas frequentes
O que é o R&D Automation Index da Anthropic?
É um índice interno que mede o grau de automação por IA no trabalho de pesquisa e desenvolvimento de modelos da própria Anthropic, numa escala de AL0 (sem IA) a AL5 (IA totalmente autônoma), construído a partir de amostragem de tarefas reais de equipes envolvidas em P&D.
O Claude já substitui pesquisadores humanos na Anthropic?
Não, segundo o próprio relatório. Os 26% medem tarefas em que o Claude “lidera” com supervisão humana (nível AL4 da escala), não trabalho totalmente autônomo. Nenhuma categoria medida atingiu AL5, o nível de autonomia plena.
Outros laboratórios de IA vão publicar índices parecidos?
Ainda não há confirmação. Esse relatório da Anthropic propôs que qualquer laboratório de fronteira publique três medidas equivalentes, mas OpenAI, Google DeepMind e outros ainda não divulgaram números comparáveis.
Referências e notas de apuração
- Measurements for understanding the pace of AI development inside frontier labs — Anthropic Institute, 17 de setembro de 2026
- Anthropic says Claude ‘leads’ 26 percent of its AI R&D work — Engadget, 17 de setembro de 2026
- We Must Pace the Frontier — Dario Amodei, 12 de setembro de 2026
- Toward an O*NET for AI R&D — Epoch AI (fonte da escala de automação AL0-AL5)
- Lawsuit accuses Anthropic, OpenAI, SpaceXAI, Google of AI pacing ‘collusion’ — The Hill, 20 de setembro de 2026