CNBC
Avião comercial voando entre nuvens

CNBCCopiloto da Flydubai atacou piloto com machado e tentou cometer atentado ‘terrorista’, dizem Emirados Árabes

Allan Ravagnani AI-451

Novidades da IA na semana: Claude 5.5 chega mais barato, Gemini 4 Argon trouxe dúvidas e o Google segue dono dos chips

Publicado 03/10/2026 • 10:30 | Atualizado há 1 hora

Foto de Allan Ravagnani

Allan Ravagnani

Repórter Especial

Allan Ravagnani é jornalista há 20 anos, duas vezes eleito entre os 50 jornalistas de Economia mais admirados do Brasil. Assina a coluna AI-451 e é repórter especial do Times Brasil | CNBC. Estudou Publicidade na ESPM e Jornalismo na Fapcom, fez pós-graduações em Macroeconomia, Finanças e Ciência Política.

Claude 5.5 chega mais barato, o Gemini 4 Argon vence tabelas e enfrenta dúvidas, e a nuvem do Google cresce 82% alugando chips.

Cada empresa levou a própria tabela de resultados para a semana dos lançamentos, mas os chips que rodam o Claude ficam no mesmo corredor, alugados do Google.

Às 17h de quarta-feira (30), no horário de Brasília, o Google publicou um texto apresentando o Gemini 4 Argon, seu primeiro modelo acima da classe Flash em mais de sete meses. Às 21h30 daquela mesma noite chegou à caixa de entrada de quem assina o Claude um aviso de que o Opus 5.5 e o Sonnet 5.5 já estavam no plano, acompanhado de um crédito para reiniciar os limites de uso, dois comunicados separados por quatro horas e meia que resumem uma semana em que duas das empresas que mais disputam a atenção dos desenvolvedores puseram três modelos novos sobre à mesa.

A sequência foi curta. O Opus 5.5 saiu no dia 22, o Sonnet 5.5 no dia 28 e o Argon no dia 30, três lançamentos em oito dias, e cada empresa trouxe uma tabela de benchmark montada por ela mesma para provar que está na frente, o que obriga o leitor a examinar os números com a desconfiança de quem lê um cardápio escrito pelo cozinheiro.

Versões 5.5 do Claude dizem entregar mais trabalho por menos dinheiro

O Opus 5.5 rende, segundo a Anthropic, o mesmo que o Fable 5.1 na maior parte das tarefas e custa 40% menos que o Opus 5, com preço de US$ 4 por milhão de tokens de entrada e US$ 20 de saída (R$ 20,70 e R$ 103,48), além de escrever de um jeito que põe a informação principal logo na frente e obedece às regras de estilo que recebe.

Preço por milhão de tokens em cada modelo

Valores de lista em dólar e em real

ModeloEntradaSaída
Opus 5.5 US$ 4R$ 20,70 US$ 20R$ 103,48
Sonnet 5.5 US$ 2R$ 10,35 US$ 10R$ 51,74
Gemini 4 ArgonPreço de introdução US$ 2R$ 10,35Depois, US$ 4 (R$ 20,70) US$ 10R$ 51,74Depois, US$ 20 (R$ 103,48)

O Google não informou quando termina o período de introdução do Argon. Conversão a R$ 5,174 por dólar, fechamento de quarta-feira (30). Fonte: Anthropic e Google. Elaboração Allan Ravagnani - Times Brasil | CNBC

O Sonnet 5.5 chegou mais de 30% mais rápido que o antecessor, com preço de lista intocado em US$ 2 e US$ 10 (R$ 10,35 e R$ 51,74), e a economia de até 30% por tarefa vem do fato de que ele gasta menos tokens e faz menos chamadas de ferramentas.

A letra miúda pede atenção. A nota de 70,6% do Sonnet na Terminal-Bench 4.0, acima dos 66,4% do Opus, foi obtida com configurações de esforço diferentes para cada modelo, e a Artificial Analysis mediu que o Sonnet no máximo consome cerca de 193 mil tokens por tarefa, o que em sua conta sai por US$ 7,60 (R$ 39,32) contra US$ 5,98 (R$ 30,94) do Opus.

A própria Anthropic admite que o Opus segue claramente mais forte em trabalho aberto, que exige julgamento sustentado.

Terminal Bench 4 medido por terceiros

Percentual de tarefas concluídas, segundo a Artificial Analysis

Sonnet 5.564%
Opus 5.560%
Gemini 4 Argon57%
0%100%

A Anthropic divulga 70,6% para o Sonnet 5.5 e 66,4% para o Opus 5.5, mas com configurações de esforço diferentes para cada modelo. Por isso a medida independente é a que permite comparar os três.

Fonte: Artificial Analysis e Anthropic. Elaboração Allan Ravagnani - Times Brasil | CNBC

Claude roda em chips do Google e a conta fecha para os dois

Aqui entra a ironia que a semana escondeu. A Anthropic pode usar até 1 milhão de TPUs do Google para rodar o Claude, e a Meta também fechou contrato de chips com a empresa em fevereiro, de modo que quem acabou de lançar o rival do Claude é, ao mesmo tempo, quem aluga o terreno onde o Claude pensa.

Os números do segundo trimestre mostram o tamanho da engrenagem, com a nuvem do Google crescendo 82%, a carteira de contratos chegando a US$ 514 bilhões (R$ 2,66 trilhões), o app Gemini indo a 950 milhões de usuários mensais, contra mais de 750 milhões no fim de 2025, e o AI Mode passando de 1 bilhão. Do outro lado do balanço, a projeção de investimento do ano subiu para até US$ 205 bilhões (R$ 1,06 trilhão) e o fluxo de caixa livre do trimestre ficou negativo.

Gemini 3.5 Pro virou promessa abandonada

Na coluna sobre o I/O, em maio, defendi que o Google deixara de correr atrás da concorrência e passara a construir a estrada. A estrada existe, e os números acima provam, mas o carro anunciado na mesma feira, o Gemini 3.5 Pro, acabou abandonado, o que segundo a Bloomberg deve ter custado caro em tempo e dinheiro, e o Argon chega no lugar dele.

Argon vence tabelas e enfrenta desconfiança em casa

O Google reporta 77,9% na DeepSWE v1.1, à frente dos 74,2% atribuídos ao Opus 5.5 na tabela que acompanha o anúncio, lidera a AutomationBench com 51,3% e ampliou o limite de saída por resposta de 64 mil para 1 milhão de tokens, ao preço de introdução de US$ 2 e US$ 10 (R$ 10,35 e R$ 51,74), que sobe para US$ 4 e US$ 20 depois do período promocional. Para quem prefere um árbitro sem camisa de time, a Artificial Analysis coloca o Argon empatado com o GPT-6 Astra e atrás do Sonnet 5.5 e do Opus 5.5 na Terminal Bench 4, com 57% contra 64% e 60%.

Custo por tarefa, Sonnet 5.5 no esforço máximo contra Opus 5.5

Média por tarefa na medição da Artificial Analysis

Sonnet 5.5, esforço máximoUS$ 7,60R$ 39,32
Opus 5.5US$ 5,98R$ 30,94
US$ 0US$ 8

Nessa configuração, o modelo menor sai cerca de 27% mais caro por tarefa, porque consome em torno de 193 mil tokens em cada uma. O preço de lista do Sonnet, de US$ 2 por milhão de tokens de entrada, é metade do Opus.

Conversão a R$ 5,174 por dólar, fechamento de quarta-feira (30). Fonte: Artificial Analysis. Elaboração Allan Ravagnani - Times Brasil | CNBC

Depois veio a Bloomberg, ouvindo funcionários que dizem que o modelo vai bem nos testes e pior no trabalho de verdade, sobretudo no desenho de interfaces, e duas pessoas chegaram a usar o termo benchmaxxing, gíria de laboratório para modelo treinado para a prova. O Google respondeu que seria inexato dizer que o Argon rende pouco em programação e lembrou que milhares de funcionários o usam por dentro, com agentes que liberaram mais de 300 TiB de memória nos data centers.

Por ora o Argon está nas mãos de defensores de segurança do programa Fairwind, que o usam para caçar falhas em software de hospitais, sem data para chegar a desenvolvedores, empresas e assinantes do Ultra, e à espera de um processo voluntário de acesso prévio com o governo americano, de modo que a dúvida sobre sua capacidade de enfrentar o front-end de um cliente real seguirá sem resposta enquanto o único teste aberto ao público for o das tabelas.

Leia as outras colunas de Allan Ravagnani em AI-451.

Siga o Times Brasil - Licenciado Exclusivo CNBC no

MAIS EM AI-451